支持的硬件
消费级 AMD 的 ROCm 支持仅限 Linux,且因架构而异。RDNA3(7900 XTX)和 RDNA2(6800 XT)社区反馈最好。Windows ROCm 仍属实验性。
text
Good: RX 7900 XTX, RX 6800 XT, RX 6900 XT (Linux)
Patchy: RX 6700 XT, older Polaris
Not supported: integrated Radeon graphicsHIP 编译 llama.cpp
安装 ROCm 6.x,以 GGML_HIP=ON 编译。若显卡不在官方列表,设置 HSA_OVERRIDE_GFX_VERSION。
bash
# Ubuntu 22.04 example
sudo apt install rocm-dev
git clone https://github.com/ggerganov/llama.cpp
cd llama.cpp
cmake -B build -DGGML_HIP=ON -DCMAKE_C_COMPILER=clang -DCMAKE_CXX_COMPILER=clang++
cmake --build build -j$(nproc)
./build/bin/llama-server -m ./model.gguf -ngl 99 -c 4096 --host 0.0.0.0接下来
看看 🔴 Radeon RX 7900 XTX 还能跑哪些模型反向查询 —— 24GB、8192 上下文,按质量排序本文涉及的模型
相关指南
部署指南仅供学习参考。每个模型均有独立许可协议 — 下载或部署前请阅读 Hugging Face 官方模型卡。