Why did VRAM usage skyrocket after updating to the latest ComfyUI version?

此问题通常发生在将 ComfyUI 更新到引入 Comfy 编译器(commit: 804eb551)的版本后,使用 MiniMax-H3 等视频生成模型或 Block Sparse Attention 等节点时,显存占用从约 70% 飙升至 98% 甚至接近满占。优先排查该确定的问题根因,可通过添

快速结论:此问题通常发生在将 ComfyUI 更新到引入 Comfy 编译器(commit: 804eb551)的版本后,使用 MiniMax-H3 等视频生成模型或 Block Sparse Attention 等节点时,显存占用从约 70% 飙升至 98% 甚至接近满占。优先排查该确定的问题根因,可通过添加启动参数来缓解。

适用环境:ComfyUI(更新后版本,包含 commit 15eb748);已确认的显卡为 NVIDIA RTX 5090(约 31.8GB 显存)和一张 8GB 显存 + 16GB 内存的显卡(测试环境);模型为 MiniMax-H3;关联节点为 Block Sparse Attention、Kijai 的 Patch Sol-Attn。

最快修复方案:暂无确认的一步修复方案。但根据 Issue 讨论,可优先尝试在启动 ComfyUI 时添加 --vram-headroom x.x 参数(单位为 GB)来预留显存,或添加 --reserve-vram x.x;也可以尝试添加 --disable-comfy-compiler 参数以禁用新引入的 Comfy 编译器功能。

注意事项:--reserve-vram--vram-headroom 语义不同,前者会在推理时保持配额行为(低显存下可能不满足预期),后者会尽量让指定大小的显存完全不被使用。这些是用户建议与开发者的说明,并非 Issue 中记录的单次验证方案;请根据你的使用场景测试。禁用 Comfy 编译器会失去该功能带来的优化,可能影响性能。

问题场景

在将 ComfyUI 更新到最新版本(如 commit: 15eb748)后,用户在进行 MiniMax-H3 视频生成时发现显存占用飙升到接近满卡(31.2GB / 31.8GB),而升级前约为 22GB / 31.8GB。有用户反映使用 Block Sparse Attention 节点或 Kijai 的 Patch Sol-Attn 节点时出现了 OOM 错误。另有一位 5090 用户报告更新前显存约 80%,更新后直接到 98%,且操作变卡顿。

报错原文

Why did VRAM usage skyrocket after updating to the latest ComfyUI version?
This can easily cause OOM errors during workflow execution.

原因分析

经 Issue 讨论确认,此显存飙升问题由引入 Comfy 编译器的 commit 804eb5513a9dec3c0e624044ba72a2c026d92491(对应 Pull Request #15861)引起。该更新后的显存管理机制(aimdo)会尽量利用全部可用显存,因此在未预留显存的情况下会达到接近满占的状态,这属于该新行为的预期表现,而并非泄漏。但在与部分节点(如 Block Sparse Attention、Patch Sol-Attn)搭配时,会触发 OOM 错误。

环境排查

  • 确认 ComfyUI 版本是否包含 commit 804eb5513a9dec3c0e624044ba72a2c026d92491(或更新的包含该提交的版本)。
  • 检查显卡显存容量,记录常规工作流和异常工作流的显存占用率。
  • 确认是否使用了 Block Sparse Attention、Patch Sol-Attn 等对显存敏感的节点。
  • 确认模型为 MiniMax-H3(或使用 w4a8 量化版本)。
  • 整理当前的 ComfyUI 启动参数,以确认是否未预留显存。

解决步骤

  1. 如果你不需要 Comfy 编译器的新功能,可优先尝试在启动命令中添加 --disable-comfy-compiler 参数后启动 ComfyUI。
  2. 如果你希望保留 Comfy 编译器,但仍需预留部分显存给其他程序或避免 OOM,可优先尝试添加 --vram-headroom x.x 参数,将 x.x 替换为你希望预留的显存大小(单位 GB),该参数会尽量保持指定大小的显存不被使用。
  3. --vram-headroom 不方便使用,可尝试用 --reserve-vram x.x 替代,但需注意它的语义不同:它匹配非动态显存模式,推理显存会被计入配额,可能无法达到完全保留的效果。
  4. 如果你在使用 Block Sparse Attention 节点时出现 OOM,请确认已更新到包含 Pull Request #16148 修复的版本(该 PR 修复了 Block Sparse Attention 搭配新显存管理时的 OOM 问题)。

验证方法

重新启动 ComfyUI 并执行之前会触发 OOM 或显存占满的工作流,观察任务管理器或显卡监控软件中的显存占用峰值是否回落到预期范围(如 80% 左右),同时确认不再出现 OOM 错误,且工作流执行速度正常。

参考来源

Comfy-Org/ComfyUI #16140

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 22214

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注