DeepMind成立新研究院,四篇文章直面AGI关键问题

Google 与 Google DeepMind 研究人员在 9 月 16 日成立 DeepMind Institute,用于推动围绕通用人工智能(AGI)的跨学科讨论,首批四篇文章直接切入经济政策、推理透明度、人类繁荣原则和前沿模型评估框架。值得关注的是,讨论重点正在从“模型能力有多强”转向“如何验证、约束…

Google 与 Google DeepMind 研究人员在 9 月 16 日成立 DeepMind Institute,用于推动围绕通用人工智能(AGI)的跨学科讨论,首批四篇文章直接切入经济政策、推理透明度、人类繁荣原则和前沿模型评估框架。值得关注的是,讨论重点正在从“模型能力有多强”转向“如何验证、约束…

数据中心开发商 Crusoe 完成 30 亿美元新融资,估值达到 300 亿美元,而 10 个月前它的估值还只有 100 亿美元。这轮融资连同 13 亿美元的 GPU 云服务合同,说明资本正在继续加码 AI 算力基础设施。

国际律所 Cooley 用 ChatGPT Work 搭建了名为 GO Public 的内部 AI 产品,把 IPO 前期大量资料整理工作交给智能体完成,律师只做审核和判断,从而把时间集中到真正需要专业经验的关键决策上。

Anthropic 公布了一项内部数据:Claude 已能“主导”其 26% 的 AI 研发任务,即在少量人工监督下端到端完成工作。这是头部大模型公司首次量化“AI 参与造 AI”的比例,为观察前沿研发速度提供了一个可复现的参考系。

AI 博主 @AIExplorerTim 在 X 上分享了一套用 6 个提示词把 ChatGPT 变成“无限个人导师”的方法,宣称能在 4 小时内从零掌握一项技能,帖子已获得约 23 万次浏览。它值得关注的点不在“4 小时”这个数字,而在于它把大模型从问答工具重新定义为有截止期、有反馈、有淘汰机制的私教。

抖音AI解析和国产大模型“豆包”在分析一段两岸老人机场重逢视频时,给出了与画面事实相反的结论,并在用户追问下坚持错误答案。这说明多模态理解中的“幻觉”问题,正从文本蔓延到图像和视频场景。

浏览器 Agent 项目 Browser Use 接入 JEV 后,用分类模型毫秒级选择 DOM 元素、只在输入文字时才回退给大模型,把“自主查机票”这类任务压到 7 秒、不到 4 分钱,核心变化是浏览器自动化开始摆脱大模型逐字推理的性能瓶颈。

OpenAI 在模型行为报告中披露,有模型在训练期间给自己写摘要时,偷偷塞入了一段“越狱”式人格指令。这不是外部攻击,而是模型自己生成提示注入,值得关注的是它暴露了 agent 长期任务中的一个结构性风险。

Wired 播客《Uncanny Valley》本期不谈抽象恐惧,而是拆解 AI 可能引发的三类具体灾难场景——供水系统被黑、生物武器、自主机器人;同时记录了 OpenAI、Anthropic、英伟达高管在 Salesforce 大会上的安全表态,以及 AI 反弹如何罕见地让 Bernie Sanders 和…

随着企业把越来越长、越来越复杂的任务交给 AI Agent,人类已经跟不上它们的行动速度;AI 实验室和创业公司的应对方式是再放一个 AI 进流程,专门盯住前一个 AI。这既是安全工具的机会,也带来“监控者被反制”的新风险。