标签: LLM

Fields Medalist Timothy Gowers says most famous mathematics problems solved by LLMs so far have almost all been with counterexamples rather than proofs (Timothy Gowers/Gowers’s Weblog)

Fields Medalist Timothy Gowers says most famous mathematics problems solved by LLMs so far have almost all been with counterexamples rather than proofs (Timothy Gowers/Gowers's Weblog)

菲尔兹奖得主 Timothy Gowers 在其博客中观察到一个关键现象——目前大语言模型(LLM)解决的著名数学问题,几乎都是通过构造反例完成的,而非提供严格证明。这个判断为评估 AI 在数学推理中的真实能力提供了一个重要参照。

第二期 小路和你读AI论文。本期五篇。 如果时间不多,建议读第四篇最有意思 也最有启发: 来自蚂蚁集团的《借助围棋死活题探测大语言模型推理中的搜索效率》 今天除了”Agent 技能/记忆持久化安全隐患”这条线之外,还有一类工作挺有意思:用大规模受控实验去戳破业界的一些直觉判断,比如”LLM 能不能取代 embedding 模型””CoT 越长是不是推理越好”。 1. The Embedder’s Dilemma: LLMs Are B…

第二期 小路和你读AI论文。本期五篇。 如果时间不多,建议读第四篇最有意思 也最有启发: 来自蚂蚁集团的《借助围棋死活题探测大语言模型推理中的搜索效率》 今天除了"Agent 技能/记忆持久化安全隐患"这条线之外,还有一类工作挺有意思:用大规模受控实验去戳破业界的一些直觉判断,比如"LLM 能不能取代 embedding 模型""CoT 越长是不是推理越好"。 1. The Embedder's Dilemma: LLMs Are B…

本期五篇论文集中挑战了两个业内直觉:LLM 并不天然适合替代 embedding 模型;CoT 越长也不代表推理更好。其中蚂蚁集团的围棋死活题测评(TsuGO)最值得一读,它给“推理能力评估”提供了一个新维度。

[Question]: Unable to import PDF files

[Question]: Unable to import PDF files

该报错通常发生在 RAGFlow Docker 版 20.2 部署后首次创建知识库时,表现为 PDF 文件无法导入、知识库创建后无法打开。优先检查 Docker 容器日志与知识库服务状态,并尝试在浏览器中缩小页面比例以解决模型选择列表无法滚动的问题。

软件开发中的人工智能现状

软件开发中的人工智能现状

开发者 Srikanth C 结合自身经验,梳理了当前用大模型做软件开发的真实状态——写代码的时间没有消失,而是变成了写详细规格、准备上下文和调提示词的时间。这篇文章引发了关于“AI 编程到底省没省时间”的技术讨论。

与AI协作与其说是编程,不如说是领导

与AI协作与其说是编程,不如说是领导

Hacker News 上围绕“与 AI 协作到底是编程还是领导”展开了一场辩论,核心观点是:用大模型干活,更像是在做任务分解和流程设计,而不是单纯的写代码或管理人。这个讨论揭示了 AI 工作流正在重塑开发者的核心技能。