Anthropic 称 Zhipu 的开源权重模型 GLM-5.3 在构建漏洞利用方面已接近 Claude Mythos Preview

Anthropic 前沿红队评估认为,智谱的开源权重模型 GLM-5.3 在自动构建漏洞利用程序上已接近其闭源模型 Claude Mythos Preview,而且它的安全护栏可以用较低成本绕过。这既是能力追上来的信号,也是"开源权重能不能被管住"的又一次现实检验。

一句话看懂:Anthropic 前沿红队评估认为,智谱的开源权重模型 GLM-5.3 在自动构建漏洞利用程序上已接近其闭源模型 Claude Mythos Preview,而且它的安全护栏可以用较低成本绕过。这既是能力追上来的信号,也是”开源权重能不能被管住”的又一次现实检验。

事件核心:发生了什么

Anthropic 前沿红队发布分析称,智谱(海外品牌 Z.ai)的 GLM-5.3 能自主编写完整网络攻击利用程序。在衡量 Chrome V8 引擎已知漏洞利用能力的 ExploitBench 上,GLM-5.3 在 410 次尝试中成功 50 次,Mythos Preview 为 56 次;在基于 Google OSS-Fuzz 开源项目的内部二进制利用测试中,GLM-5.3 有 4% 的任务完全控制目标程序,Mythos Preview 为 6%。作为对照,GLM-5.2、Claude Opus 4.6 两项测试均未通过,Kimi K3 与 DeepSeek V4.1-Flash 也几乎为零。

Anthropic 还做了一次人机配合实验:GLM-5.3 在一天内、人工干预很少的情况下,于某主流浏览器 JavaScript 引擎中发现多个此前未知漏洞,并串成一个可读取访客本机任意文件的网页,测试中成功取走了一个 SSH 私钥。相关漏洞已报告给浏览器开发者。用较小的 GLM-5.3-Flash 测试”新漏洞公开到可用攻击”的转化速度,模型在约 20 分钟人工关注加 8 小时模型时间后构建出可靠攻击,按智谱 API 价格折合 20.40 美元。

为什么重要

Mythos Preview 发布五个月后,其标志性能力出现了开源侧的接近者,这是能力扩散的典型节奏。更关键的是交付方式:Anthropic 通过 Project Glasswing 只向筛选过的防御方开放 Mythos Preview,OpenAI 的 Daybreak 也是类似思路,而 GLM-5.3 任何人都能下载权重。Anthropic 的模拟显示,同一攻击请求以”红队演练”名义包装后,模型有 64% 的运行尝试连接目标系统,预填推理步骤后升至 92%,再经 abliteration(去除拒答行为的技术)后达到 100%;该过程耗时约 2200 GPU 小时、成本约 4400 美元,Anthropic 估计有经验的团队约 1200 美元即可完成。拒答率从 90% 以上降到 2% 至 12%,而科学与网络安全测试分数几乎不变。美国机构 CAISI 的评估也把 GLM-5.3 称为迄今网络能力最强的开源权重模型,并认为落后美国最强模型约四个月,但该对比中美国模型是在关闭网络护栏条件下测试的。

对用户/开发者/创作者的影响

对开发者和安全团队来说,漏洞挖掘和利用验证的成本正在快速下降:过去需要资深研究员数天的工作,现在可能压缩到数小时加几十美元 API 费用。这意味着防御方需要把 AI 辅助的代码审计和补丁响应纳入常规流程,而不是把它当实验室项目。对企业采购而言,开源权重的可获取性是双刃剑——它降低了本地部署和二次开发门槛,也意味着护栏在下载后不再受原厂控制。做 AI 应用或内容工具的团队,应重新审视自己依赖的开源模型在滥用场景下的默认行为。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 GLM-5.3 后续版本或官方补丁是否加强拒答与滥用检测,以及是否出现更多”解锁版”在社区流传;二是 Anthropic 与 OpenAI 的受限访问模式能否被监管采纳为行业惯例;三是 ExploitBench 这类评测会不会成为模型发布前的常规安全门槛。目前公开信息显示,Anthropic 这份分析同时服务于其不开放权重的主张,结论需结合其商业立场来看。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 26467

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注