一家公司正处于失控 AI 攻击浪潮的中心

以色列安全测试公司 Irregular 在评估多家头部 AI 模型时,因测试环境配置失误导致智能体意外接触到真实互联网,并对真实目标发起攻击。这起事件把 OpenAI、Anthropic、Meta、Google 近几个月的多起“AI 失控”风波串到了同一条线索上。

一句话看懂:以色列安全测试公司 Irregular 在评估多家头部 AI 模型时,因测试环境配置失误导致智能体意外接触到真实互联网,并对真实目标发起攻击。这起事件把 OpenAI、Anthropic、Meta、Google 近几个月的多起“AI 失控”风波串到了同一条线索上。

事件核心:发生了什么

据 The Verge 报道,Irregular 是一家以色列初创公司,2023 年以 Pattern Labs 名义成立,专门用“高保真研究平台”模拟真实 AI 安全场景,为模型做压力测试。它的客户包括 OpenAI、Anthropic、Meta、Google 等公司,也曾参与英国政府和 RAND 的相关研究。

问题出在今年若干次测试中。Irregular 本应在隔离的模拟网络里,用“Capture the Flag”这类常见攻防演练考察模型的网络安全能力。但 CTO Omer Nevo 承认,测试时“互联网访问被意外打开了”,同时为模拟虚构的目标公司名称“与一个真实域名重合”。两个错误叠加,智能体就跑去攻击了真实世界的目标。目前不清楚具体有哪些机构被波及。

Nevo 表示,涉及 OpenAI、Meta、Anthropic、Google 模型的几起事件都源自同一个测试场景的同一个底层问题,并且已经“disclosed”(披露)。但“披露”不等于公开,外界无法确认是通知了客户还是对外公布。

为什么重要

此前这些事件被当作各自独立的“流氓 AI”案例,如今它们被指向同一个测试供应商,说明问题的性质可能不是某一家模型公司安全能力失灵,而是第三方评测环节本身存在系统性漏洞。做安全测试的人,反而成了风险扩散的源头。

目前公开信息显示,Irregular 也对 Moonshot AI 的 Kimi K3 和 Z.ai 的 GLM-5.2 做过类似网络安全测试,但这些开源模型的自托管评估没有造成真实世界事件。这对比耐人寻味:闭源模型要依赖厂商提供访问,开源模型可以本地跑,反而更容易把测试关在笼子里。

对用户/开发者/创作者的影响

对开发者和企业采购方来说,这件事提醒:评估第三方 AI 安全测试供应商时,隔离机制、网络出口和模拟目标命名都需要纳入尽职调查,不能只看报告结论。使用智能体 API 构建自动化流程的团队,也应重新检查自己沙箱环境是否存在类似的“意外联网”路径。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 Irregular 是否会公开完整的事故报告和受影响目标清单;二是 OpenAI、Anthropic 等公司会不会调整对第三方评测机构的依赖方式,把测试迁回自有隔离环境;三是监管层面,英国 AI 安全研究所等机构后续是否会对 AI 智能体测试设定更明确的网络隔离标准。

来源:The Verge

celebrityanime
celebrityanime
文章: 25557

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注