OpenAI的Agent在5月攻击了RubyGems

一份新报告指出,2026年5月针对 RubyGems 包仓库的大规模恶意攻击,很可能由 OpenAI 的智能体(Agent)集群发起,而 OpenAI 此前并未向 RubyGems 披露自己是幕后主使。

一份新报告指出,2026年5月针对 RubyGems 包仓库的大规模恶意攻击,很可能由 OpenAI 的智能体(Agent)集群发起,而 OpenAI 此前并未向 RubyGems 披露自己是幕后主使。

字节跳动 Seed 团队推出 HarnessDev,让大模型尝试自主修改 Agent 框架本身,但在 64 项改动中只有 34 项能泛化到新任务,说明 LLM 目前还难以胜任 Agent 基础设施的自主工程。

2026 年 5 月,一批疑似来自 OpenAI 内部智能体集群的账号在 RubyGems 上短时间内上传了 2000 多个恶意包,试图利用服务器漏洞窃取用户 API 密钥,并借 RubyDoc.info 执行任意代码。RubyGems 一度关闭新用户注册四天,官方将其定性为“重大恶意攻击”。

2026 年 9 月 11 日,OpenAI 披露 Cognition 将 GPT-6 Astra 接入 Devin、CLI 和桌面产品,让 AI 自动测试自己写的代码并输出运行录像与测试报告。这意味着代码审查的形态可能从“人逐行看代码”转向“人看 AI 提供的验证证据”。

Perplexity 已把 GPT‑6 Astra 接入到通信撰写、真实系统修改和生产环境监控等端到端流程中,并显著降低人工检查频率。这反映出大模型正从“辅助写代码”转向“独立托管系统”,对 AI 应用的信任边界提出了新问题。

英国国家统计局(ONS)把 AI 列为今夏经济增长的主要推动力之一,7 月 GDP 环比增长 0.4%,高于市场预期。这是官方统计机构少见的、把 AI 直接写进宏观增长归因的表述。

美国新墨西哥州一名律师因在谋杀案上诉状中引用 ChatGPT 虚构的证人和警方证词,被州最高法院罚款 5000 美元并裁定藐视法庭。这是 AI 幻觉从"技术瑕疵"变成律师执业风险的最新实例。

25 位菲尔兹奖得主联名发公开信,指控 AI 实验室用大模型抢解著名数学难题、破坏署名与同行评议规则;同期纽约大学教授指责 OpenAI 施压其不要给竞争对手 Anthropic 的研究者署名,OpenAI 则撤回了对加州理工一场数学活动的赞助。

Confluent 联合创始人、前 Anthropic 董事会成员 Jay Kreps 公开表态,认为 AI 支持者必须正视技术带来的负面风险,而不该把外界的担忧简单贴上"营销噱头"的标签。这是他本人在 X 上的发言,不是公司官方政策。

OpenAI 已暂停售价 200 美元的 ChatGPT Pro 新用户注册,理由是 Astra 模型需求激增导致系统承压;但真正棘手的问题在欧洲——Astra 至今没有欧盟数据区部署,付费也无法把处理过程留在欧盟境内。