comfyui-kitchen attention commit causes OOMs that did not exist before this commit

在 ComfyUI 的 Minimax(MiniMax-H3)参考工作流中,使用 comfyui-kitchen attention 相关提交后,低显存设备(如 RTX 4050 6GB)在生成 10 秒视频时出现 OOM。优先排查 attention 实现的内存峰值,可先尝试更新到修复该问题的 c

快速结论:在 ComfyUI 的 Minimax(MiniMax-H3)参考工作流中,使用 comfyui-kitchen attention 相关提交后,低显存设备(如 RTX 4050 6GB)在生成 10 秒视频时出现 OOM。优先排查 attention 实现的内存峰值,可先尝试更新到修复该问题的 commit(62b3c94)或使用 KJ Low VRAM Attention 节点。

适用环境:ComfyUI(Windows 便携版)、RTX 4050 6GB VRAM + 16GB RAM、PyTorch 版本支持 CUDA 13.0、Minimax 参考工作流(int8 convrot minimax checkpoint),使用了 --fast fp16_accumulation--fast-disk 启动参数。

最快修复方案:更新到修复该问题的 commit(62b3c94bd45154f6486c7abf1b9efcacee96ea69)。Issue 作者确认此提交解决了 OOM 问题。在更新前,可优先尝试使用 KJ Low VRAM Attention 节点作为临时规避方案。

注意事项:该修复 commit 是针对 attention 内存峰值的修复,但 Issue 中没有说明是否影响所有模型或所有 attention 模式;低显存设备(6GB)在生成高分辨率长视频时仍可能遇到内存压力。

问题场景

用户在 ComfyUI 中运行 Minimax(MiniMax-H3)参考工作流(0.4 兆像素、10 秒视频),使用 int8 convrot minimax checkpoint。在某个 attention 相关 commit 之前,工作流可以正常运行;更新后即使不启用新的 comfyui-kitchen attention 标志,10 秒视频也会 OOM,而 5 秒视频仍可正常生成。

报错原文

comfyui-kitchen attention commit causes OOMs that did not exist before this commit

[ERROR] !!! Exception during processing !!! Allocation on device 0 would exceed allowed memory. (out of memory)
Currently allocated     : 1.29 GiB
Requested               : 1.70 GiB
Device limit            : 6.00 GiB
Free (according to CUDA): 0 bytes
PyTorch limit (set by user-supplied memory fraction)
                        : 17179869184.00 GiB

原因分析

该问题指向 attention 实现引入的内存峰值变化。Issue 评论者在对比测试中发现,pytorch attention 和新的 ck attention 都会出现 VRAM 峰值,而旧实现没有此问题。可能原因包括:

  • attention 提交中改变了内存分配策略,导致在长序列(10 秒视频)上显存占用增加。
  • 新 attention 实现对特定模型(如 MiniMax-H3)或特定配置(int8)的内存占用优化不足。
  • 该提交可能影响了 VAE 解码或模型加载阶段的内存管理(相关 PR 包括 #15446 MiniMax-H3 VAE 优化、#15456 VAE decode 前释放内存)。

环境排查

  • ComfyUI 版本/commit:确认是否包含 62b3c94bd45154f6486c7abf1b9efcacee96ea69 修复。
  • PyTorch 版本:确认是否支持 CUDA 13.0。
  • 显卡 VRAM:6GB 或更低的设备更容易触发此问题。
  • Minimax checkpoint 类型:int8 convrot minimax checkpoint。
  • 启动参数:--fast fp16_accumulation--fast-disk 对内存/性能的影响。
  • 视频分辨率/时长:0.4 兆像素 10 秒会 OOM,5 秒正常。

解决步骤

  1. 首选:更新 ComfyUI 到包含 commit 62b3c94bd45154f6486c7abf1b9efcacee96ea69 的版本。该提交针对此问题进行了内存峰值修复。
  2. 临时规避:在更新前,使用 KJ Nodes 中的 KJ Low VRAM Attention 节点替代默认 attention,Issue 中确认此方法可以避免 OOM。
  3. 排查其他 attention 模式:单独测试 pytorch attention、comfyui-kitchen attention、sage attention,确认是否所有模式都会 OOM(Issue 中三种模式均复现 OOM)。
  4. 检查相关 PR:关注 #15446(MiniMax-H3 VAE 优化)和 #15456(VAE decode 前释放内存)等合并状态,可能影响内存表现。
  5. 确认重复 Issue:该问题与 #15271 可能为同一问题,可参考其讨论获取更多线索。

验证方法

更新到修复 commit 后,重新运行 Minimax 参考工作流(0.4 兆像素、10 秒视频),确认不再出现 Allocation on device 0 would exceed allowed memory 报错且视频可以正常生成。也可在生成过程中监控 VRAM 占用,确认峰值是否回落到正常水平。

参考来源

Comfy-Org/ComfyUI #15482

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 18287

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注