Windows怎么跑起DeepSeekR1

AI技术
小华
2026-09-23

在 Windows 上跑 DeepSeek-R1(深度求索的开源推理模型)有几种常见方式,按难易程度 + 适用场景给你整理一下:

一、最省事:用 Ollama(推荐新手)

1️⃣ 安装 Ollama

  • 官网:https://ollama.com
  • 下载 Windows 安装包,直接下一步安装
  • 安装完成后,命令行能识别:
ollama --version

2️⃣ 拉取并运行 DeepSeek-R1

DeepSeek-R1 有多个尺寸(1.5B / 7B / 8B / 14B / 32B / 70B)
例如(轻量版):

ollama run deepseek-r1:1.5b

想跑更强的:

ollama run deepseek-r1:7b
ollama run deepseek-r1:14b
⚠️ 模型越大,显存 / 内存要求越高

3️⃣ 图形界面(可选)

  • Open WebUI
docker run -d -p 3000:3000 -e OLLAMA_BASE_URL=http://host.docker.internal:11434 ghcr.io/open-webui/open-webui:main

浏览器打开 http://localhost:3000

二、有 NVIDIA 显卡:用 llama.cpp / GPT4All(更快)

方案 A:llama.cpp(性能好)

  1. 下载 Windows CUDA 版:

https://github.com/ggerganov/llama.cpp/releases

  1. 下载 DeepSeek-R1 GGUF 模型(HuggingFace)
  2. 运行:
llama-server -m deepseek-r1.Q4_K_M.gguf -ngl 35

三、纯 Python 用户:用 transformers / vLLM

适合开发者 / 做二次开发

pip install transformers accelerate
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained(
"deepseek-ai/DeepSeek-R1-Distill-Llama-8B"
)

⚠️ 需要 至少 16GB 显存(8B 模型)

四、配置建议(很重要)

模型大小最低配置
1.5B8GB 内存
7B16GB 内存
14B16GB+ 显存
32B+专业显卡

五、常见坑

❌ 显存不足
❌ 模型名写错(R1 是推理模型,不是 chat)

❌ 用 CPU 跑大模型(非常慢)

六、如果你愿意,我可以:

  • 按你的 电脑配置 推荐具体模型
  • 教你 本地部署 + 前端界面
  • 对比 DeepSeek-R1 vs ChatGPT

你电脑是 笔记本还是台式?有没有独显?

亿速云提供售前/售后服务

售前业务咨询

售后技术保障

400-100-2938

7*24小时售后电话

官方微信小程序