快速结论:在 ComfyUI 最新版本中配合 Sol-Attn 自定义节点运行模型时崩溃,回退到 0.33.0 或禁用 Sol-Attn 后恢复正常,应优先排查第三方注意力扩展与新版动态显存加载路径的兼容性。
适用环境:OS: linux;Python 3.12.13(Anaconda);PyTorch 2.12.0+cu130;显卡 NVIDIA GeForce RTX 3060,VRAM 11.63 GB(cudaMallocAsync);ComfyUI Templates Version 0.11.44。
最快修复方案:禁用 Sol-Attn 项目后恢复生成(用户已确认可行);如仍在错误版本上,另一条已验证路径是回退 ComfyUI 到 0.33.0。
注意事项:回退版本和禁用 extension 都只是规避而非根因修复;Issue 中未确认具体触发 commit,也未确认核心注意力是否同样失败。
问题场景
用户在 ComfyUI 最新版本中加载 MiniMaxH3 模型并启用 Sol-Attn 稀疏注意力(日志中出现 [Sol-Attn] S=25438 density=0.261 (~3.8x fewer blocks) prefix_blocks=19 tau=1.3)进行采样。生成进行到 1/5 步、约 39.40s/it 后崩溃,进程被 GDB 捕获堆栈,日志显示大量 [New LWP ...] 线程信息。用户测试发现回退到 0.33.0 恢复正常,随后确认禁用 Sol-Attn 后也恢复正常。
报错原文
the lastest version error
[INFO] [Sol-Attn] S=25438 density=0.261 (~3.8x fewer blocks) prefix_blocks=19 tau=1.3
[New LWP 9696]
...
0x000071375d12a072 in epoll_wait (epfd=36, events=events@entry=0x7134812d0930, maxevents=maxevents@entry=5, timeout=timeout@entry=3195415) at ../sysdeps/unix/sysv/linux/epoll_wait.c:30
warning: 30 ../sysdeps/unix/sysv/linux/epoll_wait.c: 没有那个文件或目录
#0 0x000071375d12a072 in epoll_wait (...)
#1 0x000071375bb4c848 in select_epoll_poll_impl (...)
#2 select_epoll_poll (...)
#3 0x000060fa965821ca in _PyEval_EvalFrameDefault (...)
#4 0x000060fa966383df in PyEval_EvalCode (...)
原因分析
最可能的原因是 Sol-Attn 扩展在 ComfyUI 新版动态显存加载/注意力调用路径上引入了不兼容行为。Issue 中维护者指出,崩溃堆栈里的 cudaMallocAsync 空闲状态并不代表原始故障点,CUDA 错误可能异步地在后续 API 调用才浮现,因此该堆栈不能直接定位根因。用户最终通过禁用 Sol-Attn 恢复,说明故障与 Sol-Attn 路径强相关。Issue 未确认是 Sol-Attn 本身、动态显存(DynamicVRAM)staging 路径,还是两者组合导致,因此核心注意力是否同样失败仍属未验证部分。
环境排查
- 确认 ComfyUI 当前 commit,并与最后一次正常 commit 对比(Issue 提示不要只写“latest”与 0.33.0)。
- 确认是否启用了 Sol-Attn 或其他自定义注意力节点/扩展。
- 确认是否开启动态显存加载(DynamicVRAM),可测试
--disable-dynamic-vram启动参数。 - 确认 PyTorch 版本(本 Issue 为 2.12.0+cu130)与 CUDA 版本。
- 确认显卡显存与后端:RTX 3060 11.63 GB、cudaMallocAsync。
- 确认 Python 版本与虚拟环境(本 Issue 为 Anaconda Python 3.12.13)。
- 确认模型、seed、分辨率在对照测试中保持一致。
解决步骤
- 禁用 Sol-Attn 项目/扩展,重新运行同一工作流。Issue 中用户确认此操作后恢复正常。
- 若禁用后仍有问题,可将 ComfyUI 回退到 0.33.0。Issue 中用户确认回退有效。
- 如需定位根因,按维护者建议在当前版本做三组受控测试(保持模型、seed、分辨率与 PyTorch 环境一致):①使用核心注意力、禁用所有自定义节点运行原生 H3;②同样工作流加
--disable-dynamic-vram;③用CUDA_LAUNCH_BLOCKING=1复现一次失败用于诊断。 - 记录并提交当前 ComfyUI commit 与最后一次正常 commit,便于维护者二分定位。
验证方法
在同一模型、seed 与分辨率下重新运行:若禁用 Sol-Attn 后采样不再崩溃并正常出图,即可确认问题由该扩展路径触发;若回退 0.33.0 后同样恢复正常,可作为版本兼容性回归的佐证。若要进一步确认根因归属,按上述三组对照测试观察核心注意力与动态显存开关分别是否复现崩溃。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。
![[Bug] Hybrid Search in dataset settings cannot persist reranking_enable=true when the retrieval method card is already selected, so rerank s](https://www.chat-gpts.plus/wp-content/uploads/2026/09/42553-e2af1a92-768x403.jpg)
![[Refactor/Chore] Improve vp check performance](https://www.chat-gpts.plus/wp-content/uploads/2026/09/38865-ee0372e8-768x403.jpg)
![[Bug]: GatedDeltaNet metadata builder classifies a stateless first chunk as a decode (same root cause as #51483)](https://www.chat-gpts.plus/wp-content/uploads/2026/09/51562-14e6939c-768x403.jpg)