[Question]: Chat doesn’t retrieve answer from knowledge
![[Question]: Chat doesn't retrieve answer from knowledge](https://www.chat-gpts.plus/wp-content/uploads/2026/08/8022-2eace44f-768x403.jpg)
这个问题通常出现在 RAGFlow 中聊天机器人的检索组件未正确关联知识库,或系统提示词缺少 {knowledge} 变量,导致大语言模型(LLM)无法接收知识库内容。优先检查知识库是否已正确关联、嵌入模型是否一致,以及系统提示词是否包含 {knowledge} 变量。
![[Question]: Chat doesn't retrieve answer from knowledge](https://www.chat-gpts.plus/wp-content/uploads/2026/08/8022-2eace44f-768x403.jpg)
这个问题通常出现在 RAGFlow 中聊天机器人的检索组件未正确关联知识库,或系统提示词缺少 {knowledge} 变量,导致大语言模型(LLM)无法接收知识库内容。优先检查知识库是否已正确关联、嵌入模型是否一致,以及系统提示词是否包含 {knowledge} 变量。

在 Gradio Gallery 组件中设置 rows=1 后,图片数量过多时不会按预期分行,而是继续追加新行,且当指定 height 参数后新行被裁切,却不会出现滚动条。此问题在 Gradio 6.25.0(main 分支,提交 375335e60)上已无法复现,可能已由 #11938 修复,优先

该报错通常发生在 Gradio 5.x 升级后,Chatbot 或 Markdown 组件无法渲染 LaTeX 公式的场景。优先排查两点:一是确认是否通过 latex_delimiters 参数正确传递分隔符;二是检查 Python 字符串中反斜杠是否被转义,建议使用 raw string( r".

该报错通常出现在 Gradio gr.Dataframe 使用搜索过滤后点击单元格时,表现为表格异常滚动到顶部/底部、 gr.SelectData 返回错误的行索引或值、以及事件回调响应延迟。优先排查 Gradio 版本是否处于 v5.24.0 至 v5.25.1 区间,并确认是否存在未过滤表的行索

该报错是 DeepSeek-V4 模型在并行处理( -np > 1 )与投机解码(MTP/DSpark)同时启用时触发的 KV 缓存回滚重放 bug,导致长程注意力失效并输出乱码。优先排查是否同时启用了并行槽位和投机解码,并尝试暂时禁用投机解码或仅使用单槽位验证。

该报错是 llama.cpp 在 CUDA 后端执行推理时,GPU 因长时间被占用未响应导致驱动看门狗(Watchdog)超时并触发内核态重置(Xid 8),进而引发 cudaStreamSynchronize 同步失败。优先排查 GPU 看门狗超时时间设置及超长上下文推理导致的单次 Kernel

该报错是 Dify 1.14.2(main 分支)在开启 RBAC 的工作区中,普通成员可以绕过权限校验读取工作区默认模型和模型提供商配置。优先排查 api/controllers/console/workspace/models.py 中 DefaultModelApi.get 和 ModelPr

这是 Workspace 模型条目在合并时被丢弃导致的配置不生效问题。核心原因是自定义模型条目的 base_model_id 被错误设置成了它自己的 id(或任意非空值),导致该条目在模型列表合并时被丢弃,所有元数据设置(如禁用内置工具)从未被应用。优先排查 base_model_id 字段值。

该报错通常是因为把 `transformers.pipeline` 工厂函数错误地写成了大写开头的 `Pipeline` 类并直接实例化。优先检查导入语句,将 `from transformers import Pipeline` 改为 `from transformers import pipel

该报错发生在多线程并发调用同一 tokenizer 实例时,尤其是每次调用的 padding/truncation 设置不同导致每次都会触发内部状态重配的场景。优先排查是否为同一 tokenizer 实例被多线程共享,并检查每次调用的 padding/truncation 参数是否一致。