你要做的是哪一类?
| 类型 | 说明 |
|---|---|
| ✅ 本地推理服务 | 单人或小团队用 |
| ✅ 内部 API 服务器 | 多个业务调用 |
| ✅ 多用户 Web 服务 | 类似“小 Midjourney” |
| ✅ 高并发生产环境 | 企业级 |
Stable Diffusion 强烈依赖 NVIDIA GPU
| 场景 | 推荐 GPU |
|---|---|
| 个人/测试 | RTX 3060 12G |
| 小团队 | RTX 4090 / A5000 |
| 企业 | A100 / H100 |
| 云 | 按需租用(RunPod / AutoDL) |
✅ 显存建议 ≥ 8GB
| 项目 | 建议 |
|---|---|
| CPU | 8 核以上(不重,但别太差) |
| 内存 | ≥ 32GB |
| 磁盘 | ≥ 100GB(模型很大) |
| 系统 | Ubuntu 22.04(首选) |
nvidia-smi若无输出,先装驱动:
sudo apt update
sudo apt install -y nvidia-driver-535推荐:
验证:
nvcc --versionsudo apt install python3.10 python3-pip建议用 conda:
conda create -n sd python=3.10
conda activate sdgit clone https://github.com/AUTOMATIC1111/stable-diffusion-webui
cd stable-diffusion-webui
pip install -r requirements.txt启动:
./webui.sh --api --listen --xformers✅ --api:开启 API
✅ --listen:允许远程访问
--xformers:显存优化POST http://服务器IP:7861/sdapi/v1/txt2img{
"prompt": "a cat in space",
"steps": 20,
"width": 512,
"height": 512
}✅ 适合:
git clone https://github.com/comfyanonymous/ComfyUI
cd ComfyUI
pip install -r requirements.txt
python main.py --listen 0.0.0.0API 示例:
POST http://IP:8188/prompt✅ 适合:
pip install diffusers transformers acceleratefrom diffusers import StableDiffusionPipeline
import torch
pipe = StableDiffusionPipeline.from_pretrained(
"runwayml/stable-diffusion-v1-5",
torch_dtype=torch.float16
).to("cuda")
image = pipe("a futuristic city").images[0]
image.save("out.png")✅ 适合:
from fastapi import FastAPI
from diffusers import StableDiffusionPipeline
import torch
app = FastAPI()
pipe = StableDiffusionPipeline.from_pretrained(
"runwayml/stable-diffusion-v1-5",
torch_dtype=torch.float16
).to("cuda")
@app.post("/generate")
def generate(prompt: str):
image = pipe(prompt).images[0]
path = "result.png"
image.save(path)
return {"path": path}启动:
uvicorn server:app --host 0.0.0.0 --port 8000常见模型:
| 类型 | 路径 |
|---|---|
| SD1.5 | sd-v1-5.safetensors |
| SDXL | sd_xl_base.safetensors |
| LoRA | models/Lora |
| ControlNet | models/ControlNet |
✅ 建议:
--xformersfloat16enable_attention_slicing()❌ 显存爆炸 → 用 SD1.5 先跑
❌ 模型下载慢 → 用 hf-mirror
❌ 远程访问失败 → 检查 --listen
❌ 生成慢 → 没开 xformers
你可以直接告诉我:
1️⃣ 是 本地服务器 / 云服务器?
2️⃣ 是否要 多用户 / 登录 / 计费?
3️⃣ 用 SD1.5 / SDXL / 自定义模型?
4️⃣ 并发量大概多少?
我可以直接给你:
你打算用在什么场景?