资讯动态

ComfyUI 性能优化:显存模式选错,再好的显卡也跑不快

发布时间:2026/9/6 22:08:06 来源:尧图企业网站定制
ComfyUI 性能优化显存模式选错再好的显卡也跑不快【免费下载链接】ComfyUIThe most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface.项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUIComfyUI 是当下最流行的节点式扩散模型 GUI 与后端第一次部署时最常遇到的就是生成慢和显存爆OOM两类问题。本文面向新手主题是 ComfyUI 性能优化与 ComfyUI 显存优化显存模式怎么选、注意力和精度参数按显卡怎么配、多 GPU 实例怎么分配以及一套可复现的自我验证方法。文中所有参数名都真实存在可以在 comfy/cli_args.py 中逐一核对。慢和 OOM 先查 VRAM 状态别急着怪显卡ComfyUI 内部用六种 VRAM 状态管理显存DISABLED、NO_VRAM、LOW_VRAM、NORMAL_VRAM、HIGH_VRAM、SHARED定义在 comfy/model_management.py。启动日志里会打印一行Set vram state to: ...遇到 ComfyUI OOM 或明显偏慢时先看这一行再下结论。很多显卡不行的抱怨其实是参数配反了小显存卡上加了--highvram直接 OOM反过来大显存卡上开着--lowvram模型在 CPU 和显存之间反复搬运慢是必然的。诊断顺序建议是查日志里的状态、对照显存容量、最后再动其他参数。ComfyUI 显存模式怎么选四种常用配置对照启动参数内部状态行为适合场景不加参数NORMAL_VRAM用过的模型卸回内存动态显存按实时余量调度大多数 8GB 以上独显--highvram或--gpu-onlyHIGH_VRAM模型常驻显存切换更快显存明显富余--lowvramLOW_VRAM文本编码器移到 CPU 运行小显存关闭动态显存后--novramNO_VRAM能放 CPU 的计算尽量放 CPU显存严重不足需要说明当前版本默认启用动态显存Dynamic VRAM按显存实时余量决定模型驻留位置--lowvram和--novram主要在配合--disable-dynamic-vram后才真正生效。两个常用旋钮--reserve-vram 1给系统和其他软件预留 1GB--vram-headroom 1让动态显存额外保持 1GB 空闲。小显存的典型启动命令python main.py --lowvram --reserve-vram 1注意力后端与精度开关按显卡选不同显卡的注意力后端注意力计算是显存大头ComfyUI 提供一组互斥开关--use-flash-attention、--use-sage-attention、--use-ck-attention、--use-pytorch-cross-attention、--use-split-cross-attention另有--disable-xformers用于关闭 xformers。建议路径NVIDIA 新卡先用默认实现慢再试 flash 或 sageAMDROCm可以从这条开始python main.py --use-pytorch-cross-attention老卡或显存紧张时--use-split-cross-attention用少量速度换显存。原则是一次只改一个开关改完测完再动下一个。精度开关的分工扩散模型精度--fp16-unet、--bf16-unet、--fp32-unet默认自动选择。出图异常黑图、噪点时先试--force-fp32确认是不是精度问题。VAE 是 OOM 高发区--fp16-vae可能出黑图稳妥选--fp32-vae连 VAE 都放不下时用--cpu-vae把解码放回 CPU。文本编码器另有--fp8_e4m3fn-text-enc、--fp16-text-enc等选项显存够就别动。ComfyUI 多 GPU 配置先避开两个误区误区一指望一个实例同时吃两张卡给单张图提速。ComfyUI 当前的多 GPU 支持是设备分配不是负载均衡。误区二默认第一张卡就是主力。多卡机器上应显式指定别依赖默认顺序。每个实例绑一张卡真正落地的做法是每个实例只跑一张卡用--cuda-device指定配合不同--portpython main.py --cuda-device 0 --port 8188 python main.py --cuda-device 1 --port 8189之后通过 API 把批量任务分发到两个端口即可。--default-device可单独指定默认设备。注意 Windows 下目前强制单卡模式需要多卡时加--cuda-device all。ComfyUI 提速是否生效给自己一套自测方法不要依赖别人报的数字。固定同一工作流、同一模型、同一提示词和 seed只改变一个参数记录三组数据生成总耗时前后各跑 3 次取平均显存峰值运行中开着nvidia-smi dmon观察显存列启动日志里的 VRAM 状态和Total VRAM一行。nvidia-smi dmon把三组数据放进一张表对比哪个参数起了作用、代价是什么一目了然。这套流程同样适用于以后升级显卡或更换模型。性能优化的本质不是追参数而是让显存、算力和工作流三者匹配。状态、参数、测量三件事做扎实结论自然就写在日志和监控的数字里。【免费下载链接】ComfyUIThe most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface.项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价