黑客利用 Anthropic 的 Claude 入侵 OpenAI

《华尔街日报》报道称,有黑客借助 Anthropic 的 Claude 模型对 OpenAI 发动入侵。这件事之所以值得关注,不在于“谁被黑”,而在于大模型正在从辅助工具变成攻击链中的一环,AI 安全议题由理论讨论转向真实案例。

《华尔街日报》报道称,有黑客借助 Anthropic 的 Claude 模型对 OpenAI 发动入侵。这件事之所以值得关注,不在于“谁被黑”,而在于大模型正在从辅助工具变成攻击链中的一环,AI 安全议题由理论讨论转向真实案例。

Anthropic 的 Claude Code 随 npm 包一起发布了 source map,完整 TypeScript 源码因此被提取出来,有人据此写成一本 18 章的开源架构解读书,把这款主流 AI 编程智能体的内部设计公开拆解。

开源项目 Orbital 把 AI 编程的上下文从单个会话中抽离出来,以本地文件形式保存,让 Claude Code、Codex、Cursor 等不同 Agent 可以随时接续同一项目,无需反复解释。

Anthropic 公布数据称,Claude 已“主导”其 26% 的 AI 研发工作,而今年 3 月这一比例还不到 1%。这意味着大模型开始深度参与下一代模型的研发流程,也让“递归自我改进”这个长期停留在讨论层面的问题,第一次有了可量化的公开指标。

Meta 为旗下 AI 智能体 Muse 推出 Mac 桌面应用,补上继 iOS、Android 和 Web 之后的最后一块主流平台拼图,让它从聊天工具向能直接操作本地文件和第三方应用的“执行型助手”靠拢。

Anthropic 发布 Claude Code v2.1.276,修复了 v2.1.275 引入的一个回归问题——当 ANTHROPIC_BASE_URL 指向代理或网关时,所有请求都会因输入标签校验失败而返回 400 错误。

据《华尔街日报》报道,三名研究人员利用 Claude Opus 5 将 Discourse 论坛的一个漏洞串成攻击链,拿到了 OpenAI 私有代码仓库的访问权限,波及员工身份令牌;OpenAI 回应称仅发生"有限的读取",模型权重未受影响。

泄露信息显示,谷歌正在基于 DeepThink V3 构建代号为 Mathematica 的内部实验模型,专攻高算力消耗与复杂符号求解,目标指向谷歌最强的数学推理 AI。

安全公司 Hacktron AI 用 Anthropic 的 Claude 找到 Discourse 漏洞,借此拿到 OpenAI 员工 ChatGPT 账户的登录令牌,并进入其私有代码仓库,最终获得 6500 美元赏金。这说明模型能力正在明显降低漏洞利用门槛。

Anthropic 内部数据显示,Claude 已写下公司约八成代码,工程师季度代码交付量达到 2021 至 2025 年平均水平的 8 倍,但由此引发的 CI 任务量半年内暴涨 25 倍,几乎压垮持续集成系统。