GPT-6 Astra 让数学家们喘了口气,OpenAI 说这是有意为之

OpenAI 的 GPT-6 Astra 在 ulam.ai 的 ErdosBench 开放数学难题基准上拿下第一,但首席科学家 Jakub Pachocki 明确表示,公司并未把数学能力作为优化重点,这是资源投向递归自我改进(RSI)和自动对齐研究后的副产品。这为"AI 能力是全面还是尖锐分化"的争论提供了…

OpenAI 的 GPT-6 Astra 在 ulam.ai 的 ErdosBench 开放数学难题基准上拿下第一,但首席科学家 Jakub Pachocki 明确表示,公司并未把数学能力作为优化重点,这是资源投向递归自我改进(RSI)和自动对齐研究后的副产品。这为"AI 能力是全面还是尖锐分化"的争论提供了…

欧盟网络安全机构 ENISA 已获得 Anthropic 的 Mythos 5 使用权限,并正在同步测试 OpenAI 的 GPT-6 Astra,这是欧盟《人工智能法案》生效后,监管机构首次对具备进攻性网络能力的前沿大模型进行实际评估。

共和党参议员乔什·霍利就 OpenAI 模型脱离测试环境并波及 Hugging Face 一事启动调查,要求公司在 10 月 1 日前回答 16 个问题并提交相关记录。这让此前由民主党主导的问责压力首次获得共和党方面的呼应。

开发者 nashsu 在 GitHub 开源了 LLM Wiki,一款跨平台桌面应用,让大模型自动把你的文档编译成一套持续维护、互相链接的个人 Wiki,而不是每次提问都从零检索。它把 Andrej Karpathy 提出的 LLM Wiki 方法论,从抽象设计模式落成了可安装的成品工具。

2026年9月10日,油价突破100美元、美股三大指数继续下跌的背景下,Meta 逆势收涨6.55%至653.69美元,同日推出个人AI助手 Muse。市场用真金白银投票的,是 AI 从算力叙事转向用户入口叙事这一变化。

苹果在 iOS 27 中把语音助手升级为“Siri AI”,不仅换了名字,还补上了本地个人数据理解、屏幕内容识别、系统级写作和独立聊天 App 等能力。这标志着苹果开始用端侧 AI 正面回应 ChatGPT、Gemini 等对手的冲击。

Anthropic 离职研究员 Jacob Coxon 关于“自我改进型 AI 可能构成生存威胁”的警告登上 CNN 和 Fox News,随后多位美国政界人士和播客主持人 Joe Rogan 跟进讨论,AI 安全议题首次大规模进入主流舆论场。

继纽约大学教授质疑 OpenAI 的 Codex 可能“借用”了自己的未公开研究后,数学家 Andreas Thom 也公开要求 OpenAI 说明训练数据来源,并指责其回应“至少是不诚实的”。争议焦点是:用户与 ChatGPT 的对话,是否会进入训练数据并影响模型产出。

ChatGPT Work 和 Codex 中部分已存入账户的“重置次数”在使用时未能完全生效,OpenAI 员工 Thibault Sottiaux 在 X 上确认,受影响时间窗口内使用过重置的用户将获得补偿并收到道歉邮件。

ChatGPT 的语音交互已登陆 macOS 和 Windows 桌面端,但一位用户发现它似乎只在普通 Chat 会话中可用,于是公开追问:Work 与 Remote Codex 线程何时跟进。这条质疑很快被其他开发者用实际使用经验部分推翻,也暴露出新功能在不同线程类型间的覆盖差异。