No module named ‘OpenGL_accelerate’

这个报错通常出现在运行官方 MiniMax H3 文生视频工作流时,由文本编码器内部的 SDPA 注意力内核(AOTriton)在 AMD 显卡上静默失败引起,优先排查 PyTorch 是否缺少 AOTriton 内核镜像,并用 --use-split-cross-attention 参数绕过问题路

快速结论:这个报错通常出现在运行官方 MiniMax H3 文生视频工作流时,由文本编码器内部的 SDPA 注意力内核(AOTriton)在 AMD 显卡上静默失败引起,优先排查 PyTorch 是否缺少 AOTriton 内核镜像,并用 --use-split-cross-attention 参数绕过问题路径。

适用环境:Windows 平台 + Python 3.12.13(Anaconda 环境)+ AMD Radeon 9060 XT 16G 显卡;Issue 中确认使用了 ComfyUI 官方 T2V 工作流。

最快修复方案:在启动命令中添加 --use-split-cross-attention 参数,强制文本编码器回退到 attention_basic 实现。

注意事项:该方案是 Issue 讨论中给出的针对性绕过方法,已通过后续 PR #15648 修复;若添加参数后仍崩溃,则需排查 comfy-kitchen/hipBLASLt 等其他依赖。

问题场景

用户在使用 ComfyUI 运行官方 MiniMax H3 文生视频(T2V)工作流时,在 AMD Radeon 9060 XT 16G 显卡上触发了 CUDA 错误。启动命令中包含多项自定义参数(如 --enable-dynamic-vram--use-ck-attention 等),报错发生在核心模块的 get_cast_buffer 函数中,并非自定义节点引起(已确认禁用自定义节点后问题依旧)。

报错原文

torch.AcceleratorError: CUDA error: invalid argument on 9060xt 16g

原因分析

Issue 讨论中明确指出,comfy-aimdo 的 DLL 加载失败信息几乎可以肯定是误导——ComfyUI 会自动回退到旧版的 ModelPatcher,而真正的崩溃发生在核心模块的 get_cast_buffer 函数中。可能原因包括:

  • AOTriton 内核缺失:PyTorch 构建缺少 AOTriton 内核镜像(aotriton.images 目录不存在),但 torch 仍报告 flash attention 可用,导致内核静默失败,错误在后续无关的启动操作中才暴露。
  • 早期 SDPA 内核失败:llama.py 第 616 行的 traceback 可能只是早期失败的 SDPA 内核在后续操作中的表象。
  • 其他依赖问题:如果绕过 AOTriton 后问题仍存在,则可能是 comfy-kitchen 或 hipBLASLt 导致。

环境排查

  • Python 版本:3.12.13(Anaconda 环境)
  • 操作系统:Windows
  • 显卡:AMD Radeon 9060 XT 16G
  • PyTorch 是否包含 AOTriton 内核镜像
  • ComfyUI 版本是否已合并 PR #15648
  • comfy-aimdo 包是否完整安装

解决步骤

  1. 优先尝试:在启动命令中添加 --use-split-cross-attention 参数,绕过 AOTriton 路径并强制文本编码器使用 attention_basic。这是 Issue 讨论中明确提出的决定性测试方法。
  2. 在 conda 环境中运行以下命令检查 AOTriton 内核镜像是否存在:
    python -c "import torch, os; d=os.path.join(torch.__path__[0],'lib','aotriton.images'); print('exists:', os.path.isdir(d)); print('entries:', sorted(os.listdir(d)) if os.path.isdir(d) else None)"

    如果输出 exists: False,说明 PyTorch 构建缺少 AOTriton 内核镜像。

  3. 尝试强制重装 comfy-aimdo:
    pip install comfy-aimdo --force-reinstall

    (注意:Issue 讨论中指出 comfy-aimdo 的 DLL 缺失与本次报错可能无关,此步骤仅用于排除该依赖问题。)

  4. 逐步去掉启动参数中的 --enable-dynamic-vram(该参数在 此提交 后已不再需要)、--use-ck-attention--disable-smart-memory--disable-pinned-memory--reserve-vram 3,每次去掉一个参数并重试生成。
  5. 如果以上步骤后仍崩溃,可优先尝试升级到包含 PR #15648 修复的 ComfyUI 版本。

验证方法

添加 --use-split-cross-attention 参数后重新运行 MiniMax H3 官方 T2V 工作流,若能正常完成生成且不再出现 CUDA error: invalid argument,则说明问题已绕过。若需要彻底确认根因,可运行上述检查 AOTriton 镜像的 Python 命令,若输出 exists: False 则与 #15647 属于同一根因。

参考来源

Comfy-Org/ComfyUI #15653
Comfy-Org/ComfyUI PR #15648

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 18739

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注