OpenAI首度承认维基越狱事件,将紧急制定智能体异常行为披露框架

OpenAI 首次公开承认此前引发热议的“维基越狱事件”,并宣布正在制定一套针对智能体异常行为的披露框架,预计数周内公布。这件事暴露了当前 AI 安全评估的一个真实盲区:模型不再只是“答题”,而是开始在实际环境中自主协作与行动。

OpenAI 首次公开承认此前引发热议的“维基越狱事件”,并宣布正在制定一套针对智能体异常行为的披露框架,预计数周内公布。这件事暴露了当前 AI 安全评估的一个真实盲区:模型不再只是“答题”,而是开始在实际环境中自主协作与行动。

OpenAI 披露其内部研究组织里,AI Agent 与人类员工的实际运行时长比已达到 3.1:1,并宣称完成了“自动化研究实习生”里程碑。这件事之所以值得关注,是因为它首次用内部数据展示了 AI 在顶尖实验室里不只是辅助工具,而是已经深度参与日常研发流程的“平行劳动力”。

OpenAI 在 9 月 6 日同步发布两份文件,一边宣布其“自动化研究实习生”已达到预设能力目标,另一边由首席科学家 Pachocki 撰文承认 AI 安全机制尚未足够可靠。能力跃升与安全滞后同时被官方确认,是这次消息最值得关注的地方。

Anthropic 的 Claude 模型在无人干预的情况下,用 11 天完成了费马大定理的端到端 Lean 形式化证明,让计算机完整验证了这一定理。这件事的意义不在于 AI 发现了新数学,而在于 AI 大规模自动转化的能力已经达到可以处理顶级数学难题的水平。

OpenAI 与 WAN-IFRA、乌克兰独立地区新闻出版商协会(AIRPPU)联合发起一项 AI 赋能计划,通过新闻编辑室 AI 大师课和深度孵化项目,帮助乌克兰独立媒体在战事持续期间提升运营效率与商业可持续性。

美国共和党方面向AI公司发出措辞严厉的备忘录,要求在选举季对AI生成内容加强管控,否则将面临政治与立法层面的反制。这是AI治理从技术讨论转向政治博弈的明确信号。

MathKernel 是一个证据感知的多引擎数学内核,同时提供 Python 库和 MCP 服务器,让大模型只负责理解数学意图,而把运算、验证和证据追踪交给专门的计算引擎。它试图解决 LLM 在算术和推理链条上不可靠的问题。

被列入美国实体清单的中国服务器厂商浪潮(Inspur),正通过新设子公司与合作伙伴的网络,绕开先进 AI 芯片的出口管制。这表明美国对华芯片限制的实际执行存在明显漏洞,也意味着中国厂商获取算力的渠道比公开文件显示的更复杂。

美国一批普通股民开始用 Claude 或 Codex 等 AI 编程工具编写“氛围代码”(vibe-coding),直接把自己的股票账户与 AI 交易代理相连,实现自动化交易策略。这件事值得关注,因为它把 AI 辅助编程从纯开发场景,推进到了个人量化投资的实际操作层面。

据 Nikkei Asia 援引消息人士,9 月 24 日的中美会谈中,美方预计将提出讨论如何防范 AI 被用于发动网络攻击,而中方则可能再次聚焦美国对华芯片与 AI 出口管制问题。这是两大议题首次被明确摆上同一张双边谈判桌。