要用AMD Radeon RX 7700 XT搭建聊天机器人,核心思路是:用显卡做推理加速(本地运行大模型),而不是训练模型。RX 7700 XT 是 RDNA3 架构,支持 ROCm / Vulkan / DirectML,在 Linux 下体验最好,Windows 下也能用(稍有限制)。
✅ 推荐方案(最稳)
⚠️ Windows 方案
| 项目 | 参数 |
|---|---|
| 显存 | 12GB GDDR6 |
| 架构 | RDNA3 |
| 适合模型 | 7B(Q4/Q5)很流畅,13B 可用 |
| 不适合 | 30B+ 全精度模型 |
✅ 结论:
sudo apt update
sudo apt install rocm-hip-runtime验证:
/opt/rocm/bin/rocminfocurl -fsSL https://ollama.com/install.sh | shollama run llama3或中文模型:
ollama run qwen2docker run -d -p 3000:8080 \
--add-host=host.docker.internal:host-gateway \
ghcr.io/open-webui/open-webui:main浏览器访问:
http://localhost:3000ollama run llama3import requests
res = requests.post(
"http://localhost:11434/api/generate",
json={
"model": "llama3",
"prompt": "你好,介绍一下自己"
}
)
print(res.json())| 模型 | 大小 | 推荐 |
|---|---|---|
| LLaMA 3 8B | 4–6GB | ✅ 首选 |
| Qwen2 7B | 4–5GB | ✅ 中文强 |
| Mistral 7B | 4GB | ✅ 快 |
| Gemma 7B | 4GB | ✅ 稳定 |
✅ 可以,但要用 Q4 量化,速度略慢
❌ 不推荐,显存不够,训练建议用云 GPU
你可以直接告诉我:
1️⃣ 用 Windows 还是 Linux
2️⃣ 想做 个人助手 / 客服机器人 / 知识库问答
3️⃣ 是否要 联网 / 接入微信 / 接入企业系统
我可以给你一步一步定制方案 + 配置示例。