快速结论:该问题发生在 ComfyUI 0.33.0+ 于 WSL2/Docker Desktop 环境下运行时,DynamicVRAM 会将模型权重固定到页锁定主机内存,Windows 将其计为 Shared GPU memory。优先排查是否启用了 --disable-pinned-memory 或直接改用 --fast-disk 参数退出该行为。
适用环境:ComfyUI 0.33.1、Windows 主机 + WSL2(Docker Desktop 后端)、NVIDIA RTX 5060 Ti 16 GB、PyTorch 2.13.0+cu130,无自定义节点。
最快修复方案:启动 ComfyUI 时添加 --fast-disk 命令行参数,实测 Shared GPU memory 从 6774 MB 降至约 382 MB,且不影响运行速度。
注意事项:--fast-disk 并非完全禁用 staging,仅跳过 pin_memory() 调用;在模型频繁换入换出的工作流中,页锁定内存仍可能对性能有帮助(RAM 缓存机制 #15027),因此该方案更适合模型集能完全装入 VRAM 的场景。
问题场景
在 Windows 主机上通过 Docker Desktop / WSL2 运行 ComfyUI 0.33.0 及以上版本时,加载一个能完整装入 16 GB VRAM 的 SDXL 工作流(约 6.6 GB),Windows 任务管理器中 GPU 的 Shared GPU memory 出现异常占用(约 6.7 GB),而专用 VRAM 只用了约 8.4 GB。模型加载完成后,Shared GPU memory 持续保持高位,即使 GPU 空闲也不释放。
报错原文
Dynamic vram disabled with argument. If you have any issues with dynamic vram enabled
**please give us a detailed reports** as this argument will be removed soon.
原因分析
可能原因:ComfyUI 0.33.0 中的提交 6b30dc20(”Don’t disable dynamic vram on WSL.”,#15562)移除了此前 1080bd44(#12706)中添加的 is_wsl() 守卫,导致 WSL2 环境下的 DynamicVRAM 路径开始将完整模型权重 staging 到页锁定(page-locked)主机内存中。Windows 将 GPU 映射的页锁定主机内存计为 Shared GPU memory,且该内存在模型加载时即提交、按模型大小分配、在模型生命周期内一直保持占用。
关键点在于:问题不在 staging 本身(--disable-pinned-memory 测试中 Staged 日志仍然存在),而在于 pin_memory() 调用导致的内存页锁定,这是 Shared GPU memory 占用的直接来源。
环境排查
- 确认 ComfyUI 版本是否为 0.33.0 或更高版本(此行为在 0.33.0 中引入)
- 确认运行环境是否为 WSL2(包括 Docker Desktop 的 WSL2 后端)
- 确认是否启用了 DynamicVRAM(默认启用;使用
--disable-dynamic-vram会关闭) - 用任务管理器或 PowerShell
Get-Counter检查 Shared GPU memory 占用 - 核对 PyTorch、CUDA 版本(实测环境为 torch 2.13.0+cu130)
解决步骤
- 启动 ComfyUI 时添加
--fast-disk参数:python main.py --listen 0.0.0.0 --disable-all-custom-nodes --fast-disk - 如果不想使用
--fast-disk,可改用--disable-pinned-memory参数(DynamicVRAM 保持开启,跳过页锁定步骤),实测 Shared GPU memory 从 6774 MB 降至约 403 MB。 - 如以上参数均不想使用,可用
--disable-dynamic-vram禁用 DynamicVRAM(回归 0.30.2 及更早版本的行为),Shared 占用接近零。 - 需要说明的是:
--fast-disk的帮助文本当前只描述为 NVMe 性能选项,无法从字面上看出它与主机内存固定相关;如果以后再次遇到类似问题,可优先尝试该参数。
验证方法
重启 ComfyUI(不可复用已有进程或容器,因为已驻留的模型会掩盖加载时行为),加载同一工作流并连续执行三次,然后检查 Windows 任务管理器 GPU 的 Shared GPU memory 占用。添加 --fast-disk 后,Shared 应降至约 400 MB 以下(实测 382 MB),专用 VRAM 占用基本不变(实测 8223 MB),warm 运行时间没有明显变化。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


![[Bug]: Structured-output scheduler can keep advancing a terminated xgrammar matcher](https://www.chat-gpts.plus/wp-content/uploads/2026/08/42619-81e0022e-768x403.jpg)