MIT 等机构发布 Ataraxos,以极低成本战胜顶级人类 Stratego 选手

MIT 联合 CMU、NYU、斯坦福发布新 AI 系统 Ataraxos,在不完全信息棋类游戏 Stratego 上大幅击败顶级人类选手,且训练成本远低于同类模型,论文已登上 Nature。

MIT 联合 CMU、NYU、斯坦福发布新 AI 系统 Ataraxos,在不完全信息棋类游戏 Stratego 上大幅击败顶级人类选手,且训练成本远低于同类模型,论文已登上 Nature。

英伟达 CEO 黄仁勋在 X 上披露,多家行业公司的高管于前一天在白宫共同签署了《超级智能白宫协定》,原则是把安全开发与部署的首要责任压回造技术的公司自己身上。这件事值得关注,是因为它试图用“内部管控 + 外部独立评估 + 董事会监督”这套组合,给尚未定型的超级智能立一条行业自律底线。

OpenAI 的 GPT-6.1 Sol (Max) 在 Arena 的 Code Arena: WebDev 榜单上以 1759 分升至第 3 名,混合价格约 8 美元/百万 token,被 Arena 评价为重塑了性价比前沿。

特朗普推动二十余家科技公司签署一份自愿性 AI 安全协议,承诺接受独立安全审计并定期会商标准,但协议不具法律约束力,也未新增任何强制义务。

Perplexity 把 Computer 代理接到邮箱入口,任何人无需账号即可通过转发或抄送邮件委托任务,并在限时内免费运行。这相当于把 AI 代理的分发渠道从独立 App 搬到用户已经在用的邮件工作流里。

Artificial Analysis 评测显示,Google 新模型 Gemini 4 Argon 在高推理档位下智能指数达到 53,追平 GPT-6 Astra(max,53),且在五折促销与缓存折扣加码下,单任务成本仅为后者的 60%。这意味着 Google 重新回到智能水平前三。

OpenAI 发布新模型 GPT-6.1 Sol,在编码和计算机操作任务上接近此前更强的 Astra,但每 token 价格只有后者的五分之一。这延续了大模型“能力下放、价格下探”的节奏,意味着高性能 Agent 能力的调用成本被大幅压低。

OpenAI 披露并阻断了一起有组织的模型蒸馏行动,攻击者试图通过操纵对话交互,把模型受保护的内部推理过程提取出来,用于训练或复现其他模型。这类风险并非 OpenAI 独有,OpenAI 已通过 Frontier Model Forum 与行业共享信息。

GitHub 宣布,2026 年 10 月 7 日起,带数据驻留能力的 GitHub Enterprise Cloud(GHE.com)将不再接受仅提供 X25519 密钥协商算法的 TLS 客户端。绝大多数用户无需改动,只有把加密套件写死成“只支持 X25519”的应用、代理或安全设备会连不上。

GitHub 把 HydraFusion 研究预览从 Copilot CLI 扩展到了 VS Code 和 GitHub Copilot 应用,它并不是一个新模型,而是一套在同一轮对话里调度多个模型、自动挑选执行流程的编排机制。