NaN/Inf Occurs When Running MiniMax H3 with FP16 Precision (Tesla V100 16GB)

该报错发生在 Tesla V100(SM70)上以 FP16 精度运行 MiniMax H3 模型时,属于模型结构性的数值溢出问题。优先排查方案是改用 FP32 精度,并建议添加 --disable-dynamic-vram 启动参数以避免第二个独立的 NaN 触发源。

该报错发生在 Tesla V100(SM70)上以 FP16 精度运行 MiniMax H3 模型时,属于模型结构性的数值溢出问题。优先排查方案是改用 FP32 精度,并建议添加 --disable-dynamic-vram 启动参数以避免第二个独立的 NaN 触发源。

该问题主要出现在 ComfyUI 的“反复运行(重复执行工作流、中途修改提示词后再次运行)”场景,表现为显存占用卡在 23.3/24 GB 附近、GPU 使用率 100% 但采样无法继续或无法停止。优先排查方向是关闭动态显存管理相关参数,并检查系统共享内存(Shared GPU Memory)是否被

该报错通常发生在自托管 Langfuse 搭配 ClickHouse 26.x 时,Scores 页面因查询优化器对 FINAL LEFT JOIN 查询的错误改写而卡在加载骨架。优先排查 ClickHouse 查询优化器设置,以及 Langfuse 容器是否启用了 CLICKHOUSE_DISAB
![[BUG]: Azure Foundry CLI options have changed](https://www.chat-gpts.plus/wp-content/uploads/2026/08/6072-4ca2cc24-768x403.jpg)
此报错通常发生在 AnythingLLM 桌面版通过 CLI 调用 Azure Foundry 本地服务时,由于 Foundry 0.10.2 及以上版本调整了命令行参数,导致旧的命令格式失效。优先排查 Foundry 版本并尝试执行 foundry --help 查看当前可用的命令结构。
![[BUG]: OCR of multi-page scanned PDF fails on all pages except one (race condition in PDFSharp/Sharp buffer handling)](https://www.chat-gpts.plus/wp-content/uploads/2026/08/6118-10d4e952-768x403.jpg)
这个报错通常发生在 AnythingLLM 通过 Docker 处理多页扫描版 PDF(尤其是 1-bit 位图、CCITT G4 压缩的扫描件)时。优先排查 PDF 内嵌图片的编码格式,并降低 OCR 并发 worker 数量。
![[Bug] Group member model setting appears ignored when the group topic has a selected model](https://www.chat-gpts.plus/wp-content/uploads/2026/08/17690-6a6f71e9-768x403.jpg)
当群组会话已选定模型后,群组成员的独立模型设置可能被忽略,成员回复会沿用群组会话的主题模型而非自身配置。优先检查成员 Agent 是否被显式传入了模型覆盖参数。

在 InvokeAI 的 ROCm Docker 容器中遇到 CPU 回退,核心报错为 No module named 'kernels' 。该问题通常源于容器内缺少 ROCm 相关依赖或设备权限配置不当,优先排查容器内是否包含 rocminfo 工具以及 render 组的 ID 是否与宿主机一致
![[Question]: About uploaded file size limit](https://www.chat-gpts.plus/wp-content/uploads/2026/08/6903-55d30477-768x403.jpg)
该报错通常发生在通过源码方式部署 RAGFlow 后上传 PDF 等文件时,系统提示文件过大但实际文件只有 2MB。优先排查 MAX_CONTENT_LENGTH 环境变量是否生效,并确认是否存在 Python 内置上传限制或反向代理(如 Nginx)的额外限制。
![[Question]:Add chat's ollama model hint 102](https://www.chat-gpts.plus/wp-content/uploads/2026/08/4074-06c47b07-768x403.jpg)
该报错通常发生在 RAGFlow 添加 Ollama Chat 模型时,返回 “No models found for provider ‘Ollama’” 且错误码为 102。优先排查添加模型时是否勾选了模型列表,而不是直接检查 Ollama 连接。

这个报错通常发生在 Gradio 的 gr.Model3D 组件尝试加载纯点云(只有顶点坐标和颜色、没有三角面)的 .ply 或 .obj 文件时,渲染结果为空。优先排查本地 Gradio 版本是否为 4.38.1,并尝试将 display_mode 设置为 "point_cloud" 验证是否仍然