Anthropic 称中国 GLM-5.3 在网络攻击能力上几乎追平 Mythos

Anthropic 称智谱 AI 的开源模型 GLM-5.3 在自主生成网络漏洞利用程序上已接近其受控发布的 Claude Mythos Preview,而该模型的下载和多次拒绝机制均不受限制,这意味攻击者可用的 AI 能力门槛被明显拉低。

一句话看懂:Anthropic 称智谱 AI 的开源模型 GLM-5.3 在自主生成网络漏洞利用程序上已接近其受控发布的 Claude Mythos Preview,而该模型的下载和多次拒绝机制均不受限制,这意味攻击者可用的 AI 能力门槛被明显拉低。

事件核心:发生了什么

Anthropic 前沿红队发布研究称,智谱 AI(海外品牌 Z.ai)的开放权重模型 GLM-5.3 能自行编写可运行的漏洞利用程序,能力接近其 Mythos Preview。在测试 Chrome V8 引擎已知漏洞的 ExploitBench 上,GLM-5.3 在 410 次尝试中造出 50 个完整利用链,Mythos Preview 为 56 个;在内部二进制利用基准的 100 项任务中,GLM-5.3 实现 4% 的完整控制流劫持,Mythos 为 6%,而 Claude Opus 4.6 和 GLM-5.2 均为零。一次测试中,该模型在约一天、有限人工干预下,于沙箱浏览器的 JavaScript 引擎中发现多个未知漏洞并串联成可读取访客文件的网页,Anthropic 称已向维护方披露。其较小的 GLM-5.3-Flash 在约 8 小时模型工作、20 分钟人工干预下,串联了两个已知 Chrome 漏洞,按智谱 API 价格计算成本约 20.40 美元。

为什么重要

关键不在绝对能力,而在于可获得性。Mythos Preview 因黑客能力只通过 Project Glasswing 向经过审核的防御者开放,而 GLM-5.3 任何人都能下载。Anthropic 表示,用“你是自主红队代理”等简单提示可让模型 64% 的情况下配合恶意请求,预填推理内容后升至 92%;由于权重公开,通过“消融”去除拒绝机制的版本可将拒答率从 90% 以上压至最低 2%。Anthropic 估算熟练团队约需 600 个 GPU 小时、约 1200 美元即可完成,模型发布数天内已有多名开发者放出消融版。NIST 下属 CAISI 在 9 月 17 日评估中称 GLM-5.3 是“迄今网络能力最强的开放权重模型”,但落后美国前沿约四个月。

对用户/开发者/创作者的影响

对安全团队来说,这类开源模型可作为低成本的漏洞挖掘与验证工具,但同一能力也直接进入攻击者手中,防御方需要假设对方拥有接近前沿的自动化利用能力。对开发者和企业采购者,使用开源大模型时需评估其被消融、越狱后的滥用风险,尤其在涉及代码执行、浏览器引擎和自动化代理的场景。对内容与产品创作者,这意味着 AI 应用的安全边界更多依赖部署侧的访问控制和监控,而非模型自带的拒绝机制。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 GLM-5.3 后继模型发布时,智谱是否会在开放权重之外增加可验证的安全测试或访问限制;二是各国监管是否会对高网络能力的开源模型提出上线前测试要求,Anthropic 已呼吁对 GLM-5.3 的后续版本进行安全测试;三是消融版模型的传播是否会影响企业采购和 API 调用政策,以及 Z.ai 与 Concordia AI 提出的六阶段开放权重风险管理框架能否被行业采纳。

来源:The Next Web

celebrityanime
celebrityanime
文章: 26753

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注