快速结论:在 ComfyUI 的 Minimax(MiniMax-H3)参考工作流中,使用 comfyui-kitchen attention 相关提交后,低显存设备(如 RTX 4050 6GB)在生成 10 秒视频时出现 OOM。优先排查 attention 实现的内存峰值,可先尝试更新到修复该问题的 commit(62b3c94)或使用 KJ Low VRAM Attention 节点。
适用环境:ComfyUI(Windows 便携版)、RTX 4050 6GB VRAM + 16GB RAM、PyTorch 版本支持 CUDA 13.0、Minimax 参考工作流(int8 convrot minimax checkpoint),使用了 --fast fp16_accumulation 和 --fast-disk 启动参数。
最快修复方案:更新到修复该问题的 commit(62b3c94bd45154f6486c7abf1b9efcacee96ea69)。Issue 作者确认此提交解决了 OOM 问题。在更新前,可优先尝试使用 KJ Low VRAM Attention 节点作为临时规避方案。
注意事项:该修复 commit 是针对 attention 内存峰值的修复,但 Issue 中没有说明是否影响所有模型或所有 attention 模式;低显存设备(6GB)在生成高分辨率长视频时仍可能遇到内存压力。
问题场景
用户在 ComfyUI 中运行 Minimax(MiniMax-H3)参考工作流(0.4 兆像素、10 秒视频),使用 int8 convrot minimax checkpoint。在某个 attention 相关 commit 之前,工作流可以正常运行;更新后即使不启用新的 comfyui-kitchen attention 标志,10 秒视频也会 OOM,而 5 秒视频仍可正常生成。
报错原文
comfyui-kitchen attention commit causes OOMs that did not exist before this commit
[ERROR] !!! Exception during processing !!! Allocation on device 0 would exceed allowed memory. (out of memory)
Currently allocated : 1.29 GiB
Requested : 1.70 GiB
Device limit : 6.00 GiB
Free (according to CUDA): 0 bytes
PyTorch limit (set by user-supplied memory fraction)
: 17179869184.00 GiB
原因分析
该问题指向 attention 实现引入的内存峰值变化。Issue 评论者在对比测试中发现,pytorch attention 和新的 ck attention 都会出现 VRAM 峰值,而旧实现没有此问题。可能原因包括:
- attention 提交中改变了内存分配策略,导致在长序列(10 秒视频)上显存占用增加。
- 新 attention 实现对特定模型(如 MiniMax-H3)或特定配置(int8)的内存占用优化不足。
- 该提交可能影响了 VAE 解码或模型加载阶段的内存管理(相关 PR 包括
#15446MiniMax-H3 VAE 优化、#15456VAE decode 前释放内存)。
环境排查
- ComfyUI 版本/commit:确认是否包含
62b3c94bd45154f6486c7abf1b9efcacee96ea69修复。 - PyTorch 版本:确认是否支持 CUDA 13.0。
- 显卡 VRAM:6GB 或更低的设备更容易触发此问题。
- Minimax checkpoint 类型:int8 convrot minimax checkpoint。
- 启动参数:
--fast fp16_accumulation和--fast-disk对内存/性能的影响。 - 视频分辨率/时长:0.4 兆像素 10 秒会 OOM,5 秒正常。
解决步骤
- 首选:更新 ComfyUI 到包含 commit
62b3c94bd45154f6486c7abf1b9efcacee96ea69的版本。该提交针对此问题进行了内存峰值修复。 - 临时规避:在更新前,使用 KJ Nodes 中的 KJ Low VRAM Attention 节点替代默认 attention,Issue 中确认此方法可以避免 OOM。
- 排查其他 attention 模式:单独测试 pytorch attention、comfyui-kitchen attention、sage attention,确认是否所有模式都会 OOM(Issue 中三种模式均复现 OOM)。
- 检查相关 PR:关注
#15446(MiniMax-H3 VAE 优化)和#15456(VAE decode 前释放内存)等合并状态,可能影响内存表现。 - 确认重复 Issue:该问题与
#15271可能为同一问题,可参考其讨论获取更多线索。
验证方法
更新到修复 commit 后,重新运行 Minimax 参考工作流(0.4 兆像素、10 秒视频),确认不再出现 Allocation on device 0 would exceed allowed memory 报错且视频可以正常生成。也可在生成过程中监控 VRAM 占用,确认峰值是否回落到正常水平。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


![[SYCL] Misc. bug: test-backend-ops -b SYCL0 assertion: ggml_sycl_op_concat dst: q4_0](https://www.chat-gpts.plus/wp-content/uploads/2026/08/26936-11981dc2-768x403.jpg)