释放 ComfyUI 显存的核心在于优化模型加载策略、调整推理参数以及利用显存管理机制。最直接有效的方案是:开启模型卸载(Offload)、使用低显存模式以及减少同时加载的模型数量。
以下是具体操作方法,按优先级排序:
在 ComfyUI 的 Web 界面中,点击右侧的 “设置”(齿轮图标)或 “ComfyUI Manager”,进行以下调整:
--lowvram 或 --medvram 相关选项。如果没有,可以在启动命令中添加参数。--lowvram:强制模型在生成过程中频繁在 CPU 和 GPU 之间交换数据,速度变慢但能极大降低显存占用(适合 6GB-8GB 显卡)。--medvram:折中方案,适合 10GB-12GB 显卡。Auto Unload Models 或调整 Upcast Attention。VAE 和 CLIP 模型在不需要时被卸载到系统内存(RAM)中,而不是一直占用显存。在具体的节点连接中,通过以下方式减少显存:
VAEDecode (Tiled) 替代 VAEDecode:KSampler (Advanced) 或 Efficient Loader:ComfyUI-Inspire-Pack 或 Efficiency Nodes。Free GPU Memory 或 Unload Models。如果你是通过命令行或脚本启动 ComfyUI,可以在 main.py 后添加以下参数:
| 参数 | 说明 | 适用场景 |
|---|---|---|
--lowvram | 极低显存模式 | 6GB 及以下显卡,牺牲速度换显存 |
--medvram | 中等显存模式 | 8GB-12GB 显卡 |
--highvram | 高显存模式 | 24GB 及以上显卡,不推荐用于释放显存 |
--disable-smart-memory | 禁用智能显存管理 | 当自动管理失效时使用,通常配合 lowvram 使用 |
--preview-method auto | 调整预览方式 | 避免使用 taesd 以外的预览方式占用额外显存 |
进阶建议:如果经常遇到显存不足,建议尝试 --lowvram 参数,并安装 ComfyUI-Manager,使用其中的 Use Deprecated Frontend 切换回旧版界面有时也能减少前端渲染带来的显存开销。