Anthropic 想让你知道 Claude 主导了其四分之一的研究,但“主导”的含义跟你想的不一样

Anthropic 公布内部数据,称 Claude 在 2026 年 8 月“主导”了 26% 的模型研发工作,但这里的“主导”并不等于 AI 自主决策——它按人类工时加权计算,评分还由 Claude 自己完成。

Anthropic 公布内部数据,称 Claude 在 2026 年 8 月“主导”了 26% 的模型研发工作,但这里的“主导”并不等于 AI 自主决策——它按人类工时加权计算,评分还由 Claude 自己完成。

Google DeepMind 研究人员指出,大模型用自然语言写出可见的思维链(CoT),是目前监控 AI 是否在欺骗、是否形成危险计划的关键手段;但 OpenAI 的 GPT-6 Astra 系统卡已显示,这种可监控性正在明显下降。

有研究团队借助 Anthropic 的 Claude Opus 5 模型,发现了 OpenAI 产品中的安全漏洞并成功入侵,最终获得 6500 美元漏洞赏金。这既是一次典型的 AI 安全研究案例,也把"用大模型找漏洞"这件事推到了台前。

Google 扩充其 AI 与经济研究团队,引入诺贝尔经济学奖得主 Philippe Aghion 等学者,并任命两位研究总监,系统追踪 AI 对就业、生产力和全球经济增长的实际影响。

Claude 官方账号透露,其项目正在引入一种“跨会话共享记忆”能力,让 Claude 能记住发布改到周五、动计费服务前该找谁这类上下文。这指向一个趋势:AI 助手正从单次对话工具,变成能长期跟随一个项目的协作成员。

Claude 官方账号透露,Threads 目前运行在云端,因此用户电脑离线时任务仍会继续,但它暂时无法访问本机文件和内网工具;官方称本地支持“很快”上线。这意味着 Claude 正在把长时间任务的执行从本地搬到云侧,为后续打通本地环境做铺垫。

Anthropic 在 Claude 官方账号确认,Pro 和 Max 订阅方案上的现有项目将保持当前使用方式不变,并会随着新功能在 Claude 全平台铺开而逐步获得升级,同时开放了提前访问的等待名单。

开发者 Thariq 在 X 上透露,Claude Code 引入了名为 Projects 的机制,把 Claude Tag 的架构搬了过来:每个项目对应一个主 Agent,负责管理记忆并按需拆分出子 Agent 执行任务,还支持定时或主动式工作流。

Anthropic 旗下 Claude 推出新版 Projects 体验,可由 Claude 统一协调用户在同一项目下的多个会话;一位日常使用者表示,这套机制让她能够“批量派发任务后继续做别的事”,把操作层级从单次对话抬升到任务编排。

《纽约时报》记者 Natasha Singer 在新书《Coding Kids》中回顾了 Code.org 如何把编程课推进美国公立学校,并指出当下科技公司向校园推销 AI 工具,几乎是同一套剧本的又一次上演。