[Question]: Successful parsing and chunking but Retrieval Testing always has 0 Files

该报错通常在使用 RAGFlow -slim Docker 镜像时出现,解析和分块成功但检索测试始终显示 0 文件。优先排查镜像版本,建议切换到 nightly (非 nightly-slim )镜像。

快速结论:该报错通常在使用 RAGFlow -slim Docker 镜像时出现,解析和分块成功但检索测试始终显示 0 文件。优先排查镜像版本,建议切换到 nightly(非 nightly-slim)镜像。

适用环境:RAGFlow v0.19.0-slim / nightly-slim,Docker 部署,操作系统涉及 Linux 和 macOS。

最快修复方案:更换 Docker 镜像至 nightly(非 nightly-slim)。具体操作:停止当前容器,拉取 infiniflow/ragflow:nightly 并重新部署。

注意事项:nightly 为每日构建版本,可能包含不稳定功能,但已知修复了检索测试的 bug。

问题场景

用户在 RAGFlow WebUI 上传 PDF 或 DOCX 文件,解析与分块过程成功完成,但在“知识库”->“检索测试”界面中始终显示“0/0 files selected”,无法看到已解析的文件,也无法进行检索测试。

报错原文

[Question]: Successful parsing and chunking but Retrieval Testing always has 0 Files

原因分析

可能原因包括:

  • 使用的 Docker 镜像为 -slim 版本,存在已知 bug 导致检索测试中无法返回文件列表(已在 nightly 版本中修复)。
  • 未在检索测试界面中正确选择知识库,或知识库配置有误。
  • 多个知识库同时被选择但嵌入模型不一致,导致检索静默失败。
  • 数据块(chunk)的 available_int 标志未被设置为 1(可能因处理异常或 bug 导致)。
  • 前端过滤状态(doc_ids)为空或配置错误,导致文件列表不显示。

环境排查

  • 确认当前使用的 Docker 镜像版本(例如 v0.19.0-slimnightly-slim)。
  • 检查 RAGFlow 版本(WebUI 底部或 Docker 日志)。
  • 确认检索测试界面中是否已选中包含已解析文件的知识库。
  • 若选择了多个知识库,确认它们使用的嵌入模型是否一致。
  • (可选)进入数据库检查 chunk 表中 available_int 字段的值。

解决步骤

  1. 更换镜像为 nightly(非 nightly-slim
    停止当前容器:docker stop <容器名>
    拉取 nightly 镜像:docker pull infiniflow/ragflow:nightly
    按官方文档重新部署容器。
  2. 确认知识库选择
    在检索测试页面左侧知识库列表中,确保已勾选目标知识库(而非为空)。
  3. 检查嵌入模型一致性
    如果使用了多个知识库,检查每个库的嵌入模型设置,确保一致(例如均为 BAAI/bge-large-zh-v1.5)。
  4. 尝试基础检索测试
    在检索测试中输入简单问题,不添加额外过滤条件,查看是否出现文件列表。
  5. 重新解析文档
    若以上步骤无效,进入知识库将已解析的 PDF/DOCX 删除后重新上传并解析,触发 chunk 重新生成。

验证方法

在检索测试界面中,能看到已解析文件的名称列表,且输入查询后能返回对应的 chunk 内容和分数,表示问题已解决。

参考来源

infiniflow/ragflow #8001

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 15146

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注