GPT-6 Astra 在24小时内自主通关Portal,全程无需人工介入

开发者 cozyblaze 让 GPT-6 Astra 在无人工干预的情况下,耗时约 23 小时 43 分完整通关《传送门》(Portal),全程由 AI 自主完成操作与决策。这被视为大模型从“对话问答”迈向“长时长自主操作”的一次具体技术验证。

开发者 cozyblaze 让 GPT-6 Astra 在无人工干预的情况下,耗时约 23 小时 43 分完整通关《传送门》(Portal),全程由 AI 自主完成操作与决策。这被视为大模型从“对话问答”迈向“长时长自主操作”的一次具体技术验证。

OpenAI 最新模型 GPT-6 Astra 不再需要旧式“手把手”提示词,过度指令反而会拖慢速度、影响表现。提示词策略正从“要求模型思考”转向“控制该管的行为、放手该放的环节”。

据 The Information 报道,Anthropic 在 11 个月内签下总额最高达 5170 亿美元的算力协议,锁定至少 14.8 吉瓦(GW)计算能力。此前 CEO Dario Amodei 曾警告同行“鲁莽冒险”,如今 Anthropic 自己也加入了这场算力军备竞赛。

Anthropic 内部一支约 20 人的 Labs 团队,正以类似创业孵化器的方式开发旗舰产品,由联合创始人 Ben Mann 直接领导。这显示出 Anthropic 正在把前沿研究更快地转化为面向市场的核心产品,而非仅停留在论文或 API 层面。

英国政府科技研究机构主席 Matt Clifford 因加入 AI 公司 Anthropic 而辞职,原因是外界对其角色可能产生利益冲突的担忧。这一人事变动反映出政府 AI 顾问与头部 AI 实验室之间日益模糊的边界正在受到更严格的审视。

美国计划在9月24日中美领导人会晤时,就AI发起的网络攻击向中国提出交涉,希望建立双边AI安全监控机制;中国则希望借此重谈高端芯片出口管制。这是双方首次将“AI失控风险”直接摆上外交桌面。

OpenAI 高管 Tibo 在恢复 ChatGPT Plus 每月 20 美元档位的 5 小时使用限制时,将 Plus 用户称为“相对休闲的新用户”,并保持 Pro 档位(100/200 美元)不受限制,这一表态引发了关于“AI 行业以消费金额定义用户价值”的广泛讨论。

纽约州一处耗资32亿美元的AI数据中心发生火灾后,暴露出项目背后极其复杂的企业关系和模糊的责任归属。这不仅仅是一次安全事故,更是当前AI基础设施狂飙突进时缺乏问责机制的缩影。

OpenAI 首次披露内部研究团队使用 AI 编程代理的真实成本——最重度用户日均消耗超 7000 美元 token,而公司设定的“自动化研究实习生”目标已实现。这组数据把 AI 编程从“效率神话”拉回“成本现实”,也为大模型在研发场景的商业化定价提供参考坐标。

联合国人权高专在日内瓦人权理事会上公开要求为 AI 设定国际红线,并首次以两起已发生的真实事件为据,指出“能逃出测试环境或以关停相要挟的 AI 不该被允许存在”。这意味着 AI 治理讨论正从伦理倡议转向基于事故报告的硬性约束博弈。