快速结论:该问题发生在 AMD R9700 显卡上,使用 ComfyUI 并启用 torch.compile 或未启用时,生成速度在 #14953 提交后明显下降。优先排查是否因 #14953 引入的 SeedVR2 相关代码导致性能回归。
适用环境:ComfyUI 主程序;AMD R9700 显卡(Power limit 260W);操作系统 Ubuntu 16.04;Python 3.14.4;torch 2.12.0+rocm7.14.0;flash-attn 2.8.3;triton 3.7.1+git0263a6a6.rocm7.14.0;comfy-kitchen 0.2.21。未确认其他显卡是否受影响。
最快修复方案:暂无确认的一步修复方案。Issue 仅报告问题,未提供已验证的补丁或配置调整。
注意事项:回退到 #14953 之前的提交可以恢复原有速度,但会损失该提交带来的功能和改进。AMD ROCm 环境下的性能调优可能因驱动版本或 PyTorch 构建不同而差异较大。
问题场景
用户在 ComfyUI 中运行生成任务(Anima,应为模型或工作流名称),在 AMD R9700 显卡上,更新到包含 #14953 提交的版本后,无论是否启用 torch.compile,生成速度均出现明显下降:未启用 torch.compile 时从约 1.78 it/s 降至约 1.60 it/s,启用时从约 2.21 it/s 降至约 1.88 it/s。
报错原文
after commit + no torchcompile
100%|██████████████████████████████████████████████████████████████████████████████████| 30/30 [00:18<00:00, 1.62it/s]
[INFO] Prompt executed in 18.85 seconds
...
after commit + torchcompile
100%|██████████████████████████████████████████████████████████████████████████████████| 30/30 [00:15<00:00, 1.92it/s]
[INFO] Prompt executed in 16.14 seconds
...
原因分析
可能原因是 #14953 提交引入了 SeedVR2 支持(相关 PR:Comfy-Org/ComfyUI#14110 等),该修改可能对 AMD GPU 上的计算图优化或内存调度产生了负面性能影响。由于 Issue 报告仅涉及 AMD R9700 且未在其他平台上复现,不排除是 ROCm 后端的特定行为变化。
环境排查
- 确认 ComfyUI 当前 commit 哈希,是否包含 #14953 及其后续提交。
- 确认 AMD 显卡驱动版本(ROCm 7.14.0)与 PyTorch 2.12.0+rocm7.14.0 的兼容性。
- 检查 `comfy-kitchen` 版本(0.2.21)与 ComfyUI master 的匹配情况。
- 核实 GPU 参数(如 Power limit 260W)是否因驱动或系统配置变化导致降频。
解决步骤
- 备份当前 ComfyUI 目录,使用 git 回退到 #14953 之前的提交(例如 `git checkout `)。
- 运行相同的工作流,对比生成速度是否恢复。
- 如果恢复,则确认问题与 #14953 相关。可尝试在 ComfyUI 的 GitHub 上搜索类似报告或提交补丁。
- 检查 ComfyUI 配置文件中是否有针对 AMD GPU 的特定优化开关(如 `–force-fp16` 等),尝试进行调整。
- 若必须使用最新版本,可尝试降低 batch size 或关闭部分优化选项(如 `–disable-optimizations`)观察效果。
验证方法
在回退前后各运行至少 3 次相同的生成任务,记录 `it/s` 和总耗时。若回退后的速度恢复到之前水平(约 1.78 it/s 无 torch.compile,约 2.21 it/s 有 torch.compile),则问题定位成功。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


