LLM/Ryzen AI 7 350/2026-07-09
< LLM | Ryzen AI 7 350
Jump to navigation
Jump to search
Install lemonade from PPA
sudo add-apt-repository ppa:lemonade-team/stable
sudo apt update
sudo apt install lemonade-server
Run lemonade server
sudo systemctl start lemond
sudo systemctl enable lemond
Install Backends
Open http://localhost:13305, then ...
Install llama.cpp cuda
- Click backends at left sidebar.
- Find Llama.cpp GPU
- Find child item cuda
- Click download
Install Fastflow
- Click backends at left sidebar.
- Find FastFlowLM NPU
- Find child item npu
- Click download
- Install XDNA driver
sudo apt install amdxdna-dkms
sudo reboot
- Get FastFlowLM release from https://github.com/FastFlowLM/FastFlowLM/releases/
- Download the latest db for Ubuntu 26.04
cd 下載
sudo apt install ./fastflowlm_0.9.44_ubuntu26.04_amd64.deb
flm --version
flm validate
Memlock limit is too low (8MB). Please ...
sudo nano /etc/security/limits.conf
Add before `# End of file`
* soft memlock unlimited * hard memlock unlimited
sudo reboot
ulimit -l
flm validate
sudo systemctl edit lemond
[Service] # 強制點亮 NPU 功能 Environment="LEMONADE_ENABLE_NPU=true" # 允許同時載入 2 個模型 Environment="LEMONADE_MAX_LOADED_MODELS=2" # 讓常駐模型不會因為一段時間沒人聊天就被系統偷偷踢掉 (TTL 設為 0 代表永久常駐) Environment="LEMONADE_MODEL_TTL=0"
sudo systemctl daemon-reload
sudo systemctl restart lemond