快速结论:该报错发生在 Linux 系统(尤其是 AMD GPU 环境)下首次加载 checkpoint 时,每次都卡在“load checkpoint”阶段。优先排查 PyTorch TunableOp 是否处于无缓存的强制调优模式,以及 MIOpen 编译缓存是否未持久化。
问题场景
用户在 Arch Linux(Cachy OS)上使用 AMD 7800XT GPU 运行 ComfyUI,每次打开软件首次生成图像时都卡在加载 checkpoint 步骤,且重启后问题重复。用户已正确安装 PyTorch ROCm 版本,创建 venv 并安装 requirements.txt。
报错原文
Stuck at load checkpoint for the first time, every time it is opened on linux.
原因分析
可能原因有两个:
- PyTorch TunableOp 无缓存调优:当前环境变量
PYTORCH_TUNABLEOP_ENABLED=1会在每次启动时重新调优 GEMM 内核,而不是重用缓存结果,导致每次首次加载 checkpoint 或首次推理时变慢。 - MIOpen 编译缓存未持久化:AMD GPU 首次运行时的 MIOpen 编译会生成缓存,如果未设置
MIOPEN_USER_DB_PATH指向持久化目录,则每次重启都会重新编译。
两种因素叠加,使得问题在 Linux 下比 Windows 更明显。
环境排查
- GPU:AMD 7800XT
- 操作系统:Arch Linux / Cachy OS
- Python 版本:3.13 / 3.14
- PyTorch + ROCm:通过
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/rocm7.2安装 - 环境变量:需确认
PYTORCH_TUNABLEOP_ENABLED、MIOPEN_USER_DB_PATH是否设置正确
解决步骤
- 关闭 PyTorch TunableOp 调优(可优先尝试):在启动 ComfyUI 前设置环境变量:
export PYTORCH_TUNABLEOP_ENABLED=0如果问题解决,则说明是 TunableOp 无缓存导致。后续可启用缓存模式:
export PYTORCH_TUNABLEOP_FILENAME=$HOME/.cache/tunableop.csv export PYTORCH_TUNABLEOP_TUNING=0 - 持久化 MIOpen 编译缓存:设置环境变量:
export MIOPEN_USER_DB_PATH=$HOME/.cache/miopen注意:该目录需要提前创建,并且确保写入权限。
- 按上述环境变量组合重新启动 ComfyUI:可在启动脚本中永久添加上述
export语句,然后正常执行python main.py。 - 如果依旧卡顿:检查用户提供的启动脚本,其中已包含
set -gx MIOPEN_USER_DB_PATH $HOME/.cache/miopen,但未设置PYTORCH_TUNABLEOP_ENABLED=0或对应的缓存文件。建议先关闭 TunableOp 再测试。
验证方法
重启 ComfyUI 后,首次加载 checkpoint 的时间应与后续加载相近(通常在几秒内)。如果首次加载不再明显卡顿,说明问题已解决。同时可观察终端日志,检查是否仍有 MIOpen 重新编译或 TunableOp 调优的输出。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


