run_nvidia_gpu.bat(Windows)或启动脚本找到 ComfyUI 目录下的启动脚本,编辑它,在 python main.py 后面加参数。
--lowvram
--medvram
--highvram
--disable-smart-memory
--gpu-only| 参数 | 适用情况 | 说明 |
|---|---|---|
--lowvram | 显存 ≤ 6GB | 最省显存,速度最慢 |
--medvram | 显存 6–10GB | 平衡显存与速度 |
--highvram | 显存 ≥ 12GB | 尽量全放显存,速度快 |
| 不加参数 | 自动判断 | 默认行为 |
--disable-smart-memory | 高级用户 | 关闭智能显存管理 |
--gpu-only | 大显存 | 强制只使用 GPU(不推荐小显存) |
✅ 推荐组合示例:
python main.py --medvram或
python main.py --lowvram| 显存 | 推荐参数 |
|---|---|
| 4GB | --lowvram |
| 6GB | --lowvram 或 --medvram |
| 8GB | --medvram |
| 12GB+ | 不加参数 或 --highvram |
Zluda 或 DirectML--lowvram--lowvram + 分批加载模型启动后看命令行日志,例如:
Using lowvram mode或
Total VRAM: 8192 MBCUDA out of memory✅ 解决:
--lowvram✅ 解决:
--lowvram--medvramimport torch
torch.cuda.set_per_process_memory_fraction(0.9, 0)ComfyUI 显存设置的核心就是:根据显存大小加--lowvram / --medvram / --highvram,并控制模型数量和分辨率。
如果你愿意,可以告诉我:
我可以给你一套最优启动参数和节点配置。