优化 ComfyUI 的模型参数,核心在于平衡显存占用、生成速度与画面质量。ComfyUI 作为节点式工作流,其参数优化比 WebUI 更灵活,但也需要更系统的理解。
这是影响出图效果最直接的参数,位于 KSampler 节点。
| 参数 | 建议设置 | 优化逻辑 |
|---|---|---|
| Sampler (采样器) | Euler a (创意/变化大) |
DPM++ 2M Karras (写实/收敛快)
LCM (极速出图) | 不同采样器决定了去噪的路径。DPM++ 系列通常在较少步数下达到高质量。 |
| Steps (步数) | 20-30 (标准)
10-15 (LCM)
40+ (高清修复) | 步数并非越多越好。通常 20-30 步是边际效应递减的临界点。 |
| CFG Scale | 5.0 - 7.0 (标准)
3.0 - 4.0 (XL模型)
1.0 - 2.0 (LCM) | 数值过高会导致画面过饱和、崩坏;过低会导致画面与提示词不符。SDXL 对 CFG 更敏感,建议降低。 |
| Scheduler (调度器) | karras 或 normal | karras 能在低步数下获得更好的细节表现;simple 最稳定。 |
优化建议:
XY Plot 节点(需安装插件)测试不同 Sampler 和 Steps 的组合,找到你显卡和模型的“甜点”。如果你遇到 CUDA Out of Memory 或者生成速度极慢,请调整以下设置。
在 run_nvidia_gpu.bat 或启动脚本中添加参数:
# 基础配置:如果显存小于 8G,建议开启
--lowvram
# 进阶配置:如果显存大于 12G,但想跑大模型,开启分块加载
--medvram
# 混合精度:通常自动开启,显存不足时强制开启
--precision full --force-fp16
# 避免预读模型(节省显存,但切换模型稍慢)
--highvram # 不推荐低显存使用fp16 版本的模型,或者将模型转换为 fp8 格式(ComfyUI 支持直接加载 FP8 模型,显存占用减半且画质损失极小)。b1=1.1, b2=1.2, s1=0.9, s2=0.2 (根据模型微调)。tile 选项(分块解码),虽然慢一点但能防止爆显存。不要直接生成大图,使用工作流进行放大:
ComfyUI_TiledDiffusion 插件。这是生成超大图(4K+)的终极方案,将大图拆分成小块分别渲染,完美解决显存不足问题。Load LoRA 节点,注意模型兼容性(SD1.5 的 LoRA 不能用于 SDXL)。resize 选项。masterpiece, best quality, ultra-detailed。(worst quality, low quality:1.4), (zombie, sketch, interlocked fingers:1.2)。(keyword:1.2) 加强权重,使用 [keyword] 减弱权重。如果你不知道怎么调,这里是一个通用的高效配置:
DPM++ 2M Karras256.01024 x 1024sdxl_vae.safetensorsFreeU 节点,设置 b1=1.2, b2=1.4。如果出图有问题,按此顺序检查:
--lowvram 参数,换 FP16/FP8 模型。--medvram。