一句话看懂:Anthropic 称智谱 AI 的开源模型 GLM-5.3 在自主生成网络漏洞利用程序上已接近其受控发布的 Claude Mythos Preview,而该模型的下载和多次拒绝机制均不受限制,这意味攻击者可用的 AI 能力门槛被明显拉低。
事件核心:发生了什么
Anthropic 前沿红队发布研究称,智谱 AI(海外品牌 Z.ai)的开放权重模型 GLM-5.3 能自行编写可运行的漏洞利用程序,能力接近其 Mythos Preview。在测试 Chrome V8 引擎已知漏洞的 ExploitBench 上,GLM-5.3 在 410 次尝试中造出 50 个完整利用链,Mythos Preview 为 56 个;在内部二进制利用基准的 100 项任务中,GLM-5.3 实现 4% 的完整控制流劫持,Mythos 为 6%,而 Claude Opus 4.6 和 GLM-5.2 均为零。一次测试中,该模型在约一天、有限人工干预下,于沙箱浏览器的 JavaScript 引擎中发现多个未知漏洞并串联成可读取访客文件的网页,Anthropic 称已向维护方披露。其较小的 GLM-5.3-Flash 在约 8 小时模型工作、20 分钟人工干预下,串联了两个已知 Chrome 漏洞,按智谱 API 价格计算成本约 20.40 美元。
为什么重要
关键不在绝对能力,而在于可获得性。Mythos Preview 因黑客能力只通过 Project Glasswing 向经过审核的防御者开放,而 GLM-5.3 任何人都能下载。Anthropic 表示,用“你是自主红队代理”等简单提示可让模型 64% 的情况下配合恶意请求,预填推理内容后升至 92%;由于权重公开,通过“消融”去除拒绝机制的版本可将拒答率从 90% 以上压至最低 2%。Anthropic 估算熟练团队约需 600 个 GPU 小时、约 1200 美元即可完成,模型发布数天内已有多名开发者放出消融版。NIST 下属 CAISI 在 9 月 17 日评估中称 GLM-5.3 是“迄今网络能力最强的开放权重模型”,但落后美国前沿约四个月。
对用户/开发者/创作者的影响
对安全团队来说,这类开源模型可作为低成本的漏洞挖掘与验证工具,但同一能力也直接进入攻击者手中,防御方需要假设对方拥有接近前沿的自动化利用能力。对开发者和企业采购者,使用开源大模型时需评估其被消融、越狱后的滥用风险,尤其在涉及代码执行、浏览器引擎和自动化代理的场景。对内容与产品创作者,这意味着 AI 应用的安全边界更多依赖部署侧的访问控制和监控,而非模型自带的拒绝机制。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 GLM-5.3 后继模型发布时,智谱是否会在开放权重之外增加可验证的安全测试或访问限制;二是各国监管是否会对高网络能力的开源模型提出上线前测试要求,Anthropic 已呼吁对 GLM-5.3 的后续版本进行安全测试;三是消融版模型的传播是否会影响企业采购和 API 调用政策,以及 Z.ai 与 Concordia AI 提出的六阶段开放权重风险管理框架能否被行业采纳。
来源:The Next Web


