LM/llama.cpp for TurboQuant

From Fundamental Ramen
< LM
Revision as of 07:37, 21 August 2026 by Tacoball (talk | contribs) (→‎Build)
(diff) ← Older revision | Latest revision (diff) | Newer revision → (diff)
Jump to navigation Jump to search

Download source

sudo apt install git cmake
sudo apt install libssl-dev openssl
mkdir -p ~/llama.cpp/src

git clone https://github.com/TheTom/llama-cpp-turboquant ~/llama.cpp/src-tbq

List available options

grep -rn "option(GGML_SYCL" CMakeLists.txt ggml/CMakeLists.txt
grep -rn "SYCL" CMakeLists.txt ggml/CMakeLists.txt

Build

sudo apt install libvulkan-dev glslc spirv-headers

# set options
cmake -B build/vulkan -G Ninja \
  -DCMAKE_BUILD_TYPE=Release \
  -DGGML_VULKAN=ON \
  -DGGML_NATIVE=ON \
  -DGGML_VULKAN_CHECK_RESULTS=OFF \
  -DCMAKE_BUILD_TYPE=Release \
  -DCMAKE_INSTALL_RPATH="\$ORIGIN/../lib"

# build
cmake --build build/vulkan --parallel

# install 
cmake --install build/vulkan --prefix ~/llama.cpp/vulkan

# clean
rm -rf build

# test GPU
cd ~/llama.cpp/vulkan/bin
./llama-cli --list-devices

Got It!

Available devices:
  SYCL0: Intel(R) Arc(TM) Pro B70 Graphics (32656 MiB, 32128 MiB free)