由DeepMind校友创立的Inherent表示,其AI“队友”在复现研究方面刚刚超越了Anthropic和OpenAI。

由 Google DeepMind 校友创立的伦敦 AI 实验室 Inherent 发布了一款名为 Faraday 的 AI 智能体,在“复现已发表科学论文结论”这一任务上,超越了参数规模大得多的 Anthropic Claude Opus 4.8 与 OpenAI GPT-5.5。更关键的是,它基于仅 27…

由 Google DeepMind 校友创立的伦敦 AI 实验室 Inherent 发布了一款名为 Faraday 的 AI 智能体,在“复现已发表科学论文结论”这一任务上,超越了参数规模大得多的 Anthropic Claude Opus 4.8 与 OpenAI GPT-5.5。更关键的是,它基于仅 27…

Apollo经济学家通过分析321个职业的实际AI使用数据发现,AI对劳动力市场的首个可测量冲击并非裁员,而是薪资增长放缓——高暴露岗位在2023年后工资增长比低暴露岗位慢了6.7%,且低收入群体受冲击最重。

YouGov 一项覆盖英国用户的调查显示,Anthropic 旗下 Claude 在用户满意度上以 56.2 的净得分领先 Gemini 和 ChatGPT;而 Grok 与 Siri 则排名垫底,反映出 AI 助手市场口碑正在出现明显分化。

Anthropic 在为可能创纪录的 IPO 做准备,但其招股书将罕见地把“美国民众反对 AI 与数据中心扩建”列为重大风险因素,反映出公众情绪正从技术圈外溢到资本市场定价逻辑中。

Anthropic 被曝在 Claude Code 中通过服务端进行 A/B 测试,悄悄下调了模型对“high”努力档位的实际响应力度,数值相当于过去的“low”。这一行为未被写入更新日志,引发开发者对其透明度的质疑。

据知情人士透露,Anthropic 正在准备的 IPO 文件中,计划将“公众对 AI 的反对声浪”列为正式风险因素。这家被视为 OpenAI 头号对手的公司,正在将社会情绪当作影响估值的核心变量来对待。

一家名为 Guidelight AI Standards 的机构评估了五家前沿AI实验室的“失控模型遏制方案”,发现多数实验室几乎没有公开可查的应急计划,OpenAI 排名第一,Anthropic 和 Meta 垫底。随着AI代理开始在企业系统中自主执行任务,这一安全空白正从技术问题升级为监管和商业风险。

OpenAI 公开呼吁加州在去年通过的 AI 安全法案 SB 53 基础上增加更多保护措施,并表态支持“反向联邦主义”——这意味着这家头部大模型公司正在从反对监管转向主动呼吁更严格的安全边界。

Anthropic 产品负责人 Dianne Penn 在近期访谈中提出,AI 产品经理的核心能力不再是写 PRD,而是建立评测体系。Anthropic 早期用户抱怨“不听话”的 80% 问题,最终被定位为“不会输出 JSON”,这一案例直接定义了评测驱动的开发流程。

Anthropic 于 8 月 22 日发布了 Claude Code 命令行工具的 v2.1.240 版本,主要包含 Bug 修复与可靠性改进,进一步强化了这款 AI 编程助手在真实开发环境中的稳定性。