标签: 大模型

AI 革命究竟新在何处?

AI 革命究竟新在何处?

TIME 刊文讨论“AI 革命究竟新在何处”,指出人工智能并非 2020 年代才出现,自 1956 年达特茅斯会议起已历经数十年起落;真正的新变化是通用基础模型、自然语言交互和具备行动能力的 Agentic AI 三件事叠加,但谁来管理、如何与人类协作,目前仍是开放问题。

当 LLM 评判者意见一致时,我们该信吗?

当 LLM 评判者意见一致时,我们该信吗?

亚马逊云科技团队在 ICML 上提出一种“依赖感知”的 LLM 评委聚合方法,用 Ising 模型识别多个评审模型之间是否只是“同源同错”,在三个任务上比加权多数投票基线准确率提升 9%–14%,论文时间标注为 2026 年 8 月 26 日。

为什么机器学习研究 Agent 不会过拟合?

为什么机器学习研究 Agent 不会过拟合?

亚马逊科学家在 2026 年 9 月 10 日发布研究指出,LLM 驱动的机器学习研究 Agent 反复在同一基准上迭代却不会过拟合,原因是它们学到的是高度可压缩的策略,而非记住数据。这项工作给"基准刷榜是否等于真实进步"这个老问题提供了可实验的解释。

AI 负责创造,人来干脏活,这事儿能否停一下?

AI 负责创造,人来干脏活,这事儿能否停一下?

亚马逊云科技在 2026 年 9 月 10 日宣布 AI 办公工具 Amazon Quick 全面可用,它把"动态任务流"放在首屏,试图让 Agent 主动接管邮件、会议、CRM 之间的衔接工作。这值得关注,因为它正面回应了一个被行业长期回避的问题:AI 负责创造,人却在替 AI 干搬运和拼凑的脏活。