LM/llama.cpp for CUDA

From Fundamental Ramen
< LM
Revision as of 03:42, 4 September 2026 by Tacoball (talk | contribs) (Created page with "== Build == <syntaxhighlight lang="bash"> cmake -B build/cuda -G Ninja \ -DGGML_CUDA=ON \ -DCMAKE_BUILD_TYPE=Release cmake -B build/cuda -G Ninja \ -DGGML_CUDA=ON \ -DGGML_NATIVE=ON \ -DGGML_LTO=ON \ -DCMAKE_BUILD_TYPE=Release \ -DCMAKE_INSTALL_RPATH="\$ORIGIN/../lib" \ -DCMAKE_CXX_FLAGS="-O3 -fp-model=fast=2 -qopenmp" \ -DCMAKE_C_FLAGS="-O3 -fp-model=fast=2 -qopenmp" cmake --build build/cuda cmake --install build/cuda --prefix ~/llama.cpp/cuda </syn...")
(diff) ← Older revision | Latest revision (diff) | Newer revision → (diff)
Jump to navigation Jump to search

Build

cmake -B build/cuda -G Ninja \
  -DGGML_CUDA=ON \
  -DCMAKE_BUILD_TYPE=Release

cmake -B build/cuda -G Ninja \
  -DGGML_CUDA=ON \
  -DGGML_NATIVE=ON \
  -DGGML_LTO=ON \
  -DCMAKE_BUILD_TYPE=Release \
  -DCMAKE_INSTALL_RPATH="\$ORIGIN/../lib" \
  -DCMAKE_CXX_FLAGS="-O3 -fp-model=fast=2 -qopenmp" \
  -DCMAKE_C_FLAGS="-O3 -fp-model=fast=2 -qopenmp"

cmake --build build/cuda
cmake --install build/cuda --prefix ~/llama.cpp/cuda