GLM-5.3 登顶开源模型排行榜,价格低于对手,但发布推迟

智谱旗下 Z.ai 发布的新模型 GLM-5.3 在 Artificial Analysis 榜单上追平 Kimi K3,并列开源模型第一,且单任务成本比对手低 19%。但开放权重版本因安全顾虑推迟约两周,引发对开源节奏与安全边界的讨论。

一句话看懂:智谱旗下 Z.ai 发布的新模型 GLM-5.3 在 Artificial Analysis 榜单上追平 Kimi K3,并列开源模型第一,且单任务成本比对手低 19%。但开放权重版本因安全顾虑推迟约两周,引发对开源节奏与安全边界的讨论。

事件核心:发生了什么

8 月 19 日,中国 AI 初创公司 Z.ai 的 GLM-5.3 模型在 Artificial Analysis Intelligence Index 上拿下 60 分,与月之暗面的 Kimi K3 并列开源模型榜首,同时比上一代 GLM-5.2 高出 7 分。最大提升集中在智能体(Agent)任务上——在 GDPval-AA v2 基准中,其 Elo 评分从 1,524 跃升至 1,770,提升 246 分,仅次于 Claude Opus 5(1,855)。

成本方面,Artificial Analysis 估算 GLM-5.3 每任务成本为 0.68 美元,是前代 0.44 美元的约 1.5 倍,但比 Kimi K3 的 0.84 美元便宜约 19%。模型目前通过 Z.ai 的 API 开放使用,但开放权重(open weights)版本被推迟约两周。Z.ai 解释称,GLM-5.3 检测安全漏洞的能力过强,公司正在加强控制措施,并将完整访问权限限制在特定安全合作伙伴范围内。

为什么重要

这是开源模型首次在主流评测中与顶级闭源模型(如 Claude Opus 系列)形成正面竞争。GLM-5.3 在硬件成本没有失控的前提下实现智能体任务能力的显著跃迁,说明推理侧优化和训练策略仍是大模型性能提升的关键突破口。对行业而言,另一个信号更具指向性:当模型能力接近甚至触及安全敏感领域时,开源放权不再是默认选项。Z.ai 以“安全能力过强”为由暂缓开放权重,可能成为后续开源模型发布节奏的参考先例,也意味着安全评估正在介入模型发布流程的核心环节。

对用户/开发者/创作者的影响

对开发者来说,GLM-5.3 的 API 已经可用,意味着可以立即在智能体、自动化工作流和工具调用类应用中测试更高性价比的推理效果,尤其是其 agentic 任务表现,适合做复杂任务拆解与多步执行的场景。对企业采购方而言,0.68 美元/任务的定价低于同级模型,可以作为预算有限时的备选方案。

但需要注意的是,目前开放的是 API 而非权重,涉及本地化部署、数据隐私或定制微调需求的团队,需要等到权重开放后才能评估实际可用性。创作者如果依赖开源模型做私有化部署或二次分发,建议暂时保持观望,等待 Z.ai 后续公布开放范围和安全合作机制的具体细节。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

目前公开信息显示,有几个观察点值得跟进:第一,开放权重推迟后是否如期在两周内落地,以及安全合作伙伴名单和权限边界如何划分,这将直接决定开发者能否把模型部署到自有环境。第二,Kimi K3 是否会针对评测结果做迭代或调价,开源头部两强的价格和性能拉锯会影响后续模型定价策略。第三,GLM-5.3 在安全检测上的“强能力”是否被证实,以及这种能力会不会反向推动更多厂商在发布前引入安全分级放权机制,进而改变开源生态的发布常态。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 19131

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注