Not using CUDA

在 Windows 上通过一键安装脚本运行 TextGen WebUI 时,脚本没有正确安装 CUDA 版 PyTorch,导致启动后 GPU 不可用,核心报错为 Not using CUDA。优先检查 PyTorch 是否为 CPU 版本,以及 CUDA 运行时是否装对。

在 Windows 上通过一键安装脚本运行 TextGen WebUI 时,脚本没有正确安装 CUDA 版 PyTorch,导致启动后 GPU 不可用,核心报错为 Not using CUDA。优先检查 PyTorch 是否为 CPU 版本,以及 CUDA 运行时是否装对。
![[Bug]: Refine/CompactAndRefine streaming collapsed to a single chunk since 0.14.22 (#21374)](https://www.chat-gpts.plus/wp-content/uploads/2026/09/22831-856a571a-1-768x403.jpg)
当你在 LlamaIndex 0.14.22 及以上版本中,用 Refine 或 CompactAndRefine 并设置 streaming=True 时,流式输出会退化成一次性返回单个 chunk。优先确认是否调用了受影响版本,并在能改动 response mode 的前提下先切到 TREE_S

这个报错通常出现在用 LlamaIndex 的 FunctionAgent 构建工作流、并在 workflow.run(...) 阶段执行时,属于 llama-index-workflows 与 llama-index-core 版本不匹配导致的兼容问题。优先排查这两个包的版本组合,而不是先去改 A
![[Bug]: Streaming responses broken since 0.14.0 for ContextChatEngine and similar classes](https://www.chat-gpts.plus/wp-content/uploads/2026/09/22749-8310a4fe-1-768x403.jpg)
这个报错通常出现在使用 LlamaIndex ContextChatEngine 、 CondenseQuestionChatEngine 或 CondensePlusContextChatEngine 进行流式对话时:调用 astream_chat() 或 stream_chat() 后,异步/同

当你在 Diffusers 的 Flux 注意力处理器中启用 Flash/Sage varlen(变长)注意力并叠加 torch.compile 时,varlen 实现为在运行时推导最大序列长度会触发 Tensor.item() ,被 Dynamo 判定为 Graph break,从而无法完整编译。
![[Bug] Ascend NPU: RMSNorm crashes with elementwise_affine=False; _native_npu FA rejects [B, N, 1, Skv] masks (LTX-2)](https://www.chat-gpts.plus/wp-content/uploads/2026/09/14380-1858c464-1-768x403.jpg)
在 Ascend NPU 上运行 LTX-2(例如 LTX-2.3 LoRA FlowGRPO 训练)并使用 attn_backend=_native_npu 时,会遇到两个 NPU 兼容性报错:一是 RMSNorm 在 elementwise_affine=False 时把 weight=None
![[Bug]: Drop down menu of ´Add Lora to prompt´ does nont have a ´none´ selection and always charge the last Lora selected](https://www.chat-gpts.plus/wp-content/uploads/2026/09/9041-6fefaf96-768x403.jpg)
当你在 Stable Diffusion WebUI 的 Settings 中启用 sd_lora 后,底部“Add Lora to prompt”下拉菜单没有 None /空白选项,导致每一次生成都会强制带上上一次选中的 Lora;如果这个 Lora 文件是空文件或损坏文件,还会在激活时抛出 Sa

该报错通常出现在 Linux 上首次运行 Stable Diffusion WebUI 的 webui.sh 安装脚本时,脚本无法生成或激活项目目录下的 Python 虚拟环境(venv)。优先排查系统是否真正装好 python3-venv / virtualenv ,以及 venv/ 目录是否被正

这个报错通常出现在 Stable Diffusion WebUI 的“生成”按钮、提示词清理按钮、保存/应用按钮点击无响应,浏览器前端 JS 报错时;优先排查 Gradio 前端静态资源是否完整、是否损坏,以及 Gradio 版本是否与 WebUI 版本匹配。

当你已经配好 OpenAI 兼容的 FLUX 图片生成端点、Playground → Images 能出图,但普通聊天里看不到 Image/Image Generation 入口、模型只把 dalle.text2im 当纯文本吐出来时,先把排查重点放在聊天输入框的 Integrations 菜单里