LLM/Ryzen AI 7 350/2026-07-09: Difference between revisions

From Fundamental Ramen
Jump to navigation Jump to search
Line 109: Line 109:
sudo systemctl daemon-reload
sudo systemctl daemon-reload
sudo systemctl restart lemond
sudo systemctl restart lemond
</syntaxhighlight>
<syntaxhighlight lang="bash">
vim ~/.cache/lemonade/config.json
</syntaxhighlight>
</syntaxhighlight>



Revision as of 09:18, 9 July 2026

Install lemonade from PPA

sudo add-apt-repository ppa:lemonade-team/stable
sudo apt update
sudo apt install lemonade-server

Run lemonade server

sudo systemctl start lemond
sudo systemctl enable lemond

Install Backends

Open http://localhost:13305, then ...

Install llama.cpp cuda

  • Click backends at left sidebar.
  • Find Llama.cpp GPU
  • Find child item cuda
  • Click download
sudo vim /etc/gdm3/custom.conf
[daemon]
# 強制 GDM 的 Wayland 渲染走 AMD 的基底
Environment=VK_LOADER_DRIVERS_SELECT=*radeon*
Environment=MESA_VK_DEVICE_SELECT=pci-0000_66_00_0
sudo vim /etc/default/grub
GRUB_CMDLINE_LINUX_DEFAULT="quiet splash nvidia-drm.modeset=0"
sudo update-grub

Install Fastflow

  • Click backends at left sidebar.
  • Find FastFlowLM NPU
  • Find child item npu
  • Click download
  • Install XDNA driver
sudo apt install amdxdna-dkms
sudo reboot
cd 下載
sudo apt install ./fastflowlm_0.9.44_ubuntu26.04_amd64.deb
flm --version
flm validate
Memlock limit is too low (8MB). Please ...
sudo nano /etc/security/limits.conf

Add before `# End of file`

* soft memlock unlimited
* hard memlock unlimited
sudo reboot
ulimit -l
flm validate
sudo systemctl edit lemond
[Service]
# 強制點亮 NPU 功能
Environment="LEMONADE_ENABLE_NPU=true"
# 允許同時載入 2 個模型
Environment="LEMONADE_MAX_LOADED_MODELS=2"
# 讓常駐模型不會因為一段時間沒人聊天就被系統偷偷踢掉 (TTL 設為 0 代表永久常駐)
Environment="LEMONADE_MODEL_TTL=0"
sudo systemctl daemon-reload
sudo systemctl restart lemond
vim ~/.cache/lemonade/config.json

Debug

sudo journalctl -u lemond.service -n 50 --no-pager
sudo journalctl -u lemond -f -n 100