ollama --versionDeepSeek-R1 有多个尺寸(1.5B / 7B / 8B / 14B / 32B / 70B)
例如(轻量版):
ollama run deepseek-r1:1.5b想跑更强的:
ollama run deepseek-r1:7b
ollama run deepseek-r1:14b⚠️ 模型越大,显存 / 内存要求越高
docker run -d -p 3000:3000 -e OLLAMA_BASE_URL=http://host.docker.internal:11434 ghcr.io/open-webui/open-webui:mainhttp://localhost:3000https://github.com/ggerganov/llama.cpp/releases
llama-server -m deepseek-r1.Q4_K_M.gguf -ngl 35适合开发者 / 做二次开发
pip install transformers acceleratefrom transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained(
"deepseek-ai/DeepSeek-R1-Distill-Llama-8B"
)| 模型大小 | 最低配置 |
|---|---|
| 1.5B | 8GB 内存 |
| 7B | 16GB 内存 |
| 14B | 16GB+ 显存 |
| 32B+ | 专业显卡 |
❌ 显存不足
❌ 模型名写错(R1 是推理模型,不是 chat)
你电脑是 笔记本还是台式?有没有独显?