1990s:我们用上了 B+ 树和倒排索引,世界上已经没有什么几秒钟查不出来的东西了。 2010s:我们推广了分布式全文搜索引擎,几十亿条日志毫秒级命中。 2025:我们把所有文档切成稀碎的 chunk,烧掉了不知道多少算力把它们向量化后扔进向量数据库,最后把搜出来的垃圾拼成几万字 prompt 塞进大模型,然后开始祈祷它别出现幻觉。 2026:大模型告诉我们,这个 find,还有这个 grep 工具真好用。

X 用户 @__soragoto__ 用一条时间线调侃检索技术的四十年:从 B+ 树、倒排索引、分布式全文搜索,到向量数据库加 RAG,最后大模型反而觉得 find、grep 这类命令行工具好用。这条帖子 174.9 万次浏览,戳中了 RAG 落地中真实存在的效率疑问。








