一句话看懂:智谱AI的GLM-5.3(max)在Artificial Analysis最新评测中拿到60分智力指数,位居全球第8,且推理成本远低于同档位竞品,成为目前性价比最高的顶级推理模型之一。
事件核心:发生了什么
根据Artificial Analysis发布的GLM-5.3(max)评测数据,这款发布于2026年8月的闭源推理模型,在综合智力指数(Intelligence Index v4.1.1)上取得60分,在全部181个可比模型中排名第8,显著高于同类模型35分的中位数。该指数整合了GDPval-AA v2、Terminal-Bench v2.1、GPQA Diamond、Humanity’s Last Exam等9项主流评测。
价格方面,GLM-5.3(max)输入每百万token收费1.40美元,输出每百万token收费4.40美元,均低于同类模型中位数(输入1.75美元、输出10美元)。值得注意的是,其缓存折扣高达81%,命中后输入成本降至0.68美元。模型支持1M token超长上下文,仅支持文本输入输出。该评测共消耗1238.50美元,模型在测试中生成了1.7亿token,输出篇幅属于“非常冗长”一档。
为什么重要
GLM-5.3(max)的意义在于同时实现了“顶级智力”和“可控成本”。过去,高端推理模型的输出定价普遍在每百万token 10美元上下,而GLM-5.3将这一门槛拉低至4.40美元,同时智力排名进入全球前10,直接冲击了Anthropic、OpenAI等厂商在高端推理市场的定价体系。对智谱AI而言,这意味着国产闭源模型在核心智能维度上已具备与国际头部产品正面竞争的实力,而不仅仅是在价格上做文章。
评测中“冗长”的输出风格也值得关注:生成1.7亿token的答题篇幅说明该模型倾向于输出更详细的推理链条,这在复杂任务中可能提升准确率,但也意味着实际吞吐量和延迟表现可能受影响。目前Artificial Analysis尚未公布其输出速度数据,这一点仍需后续观察。
对用户/开发者/创作者的影响
对API开发者来说,GLM-5.3(max)最直接的吸引力在于输出价格仅为同等智力水平模型的不到一半,配合81%的缓存折扣,适合高频调用、长文档处理、批量推理等成本敏感场景。1M token上下文窗口也让它在法律合同审查、金融研报分析、代码库理解等长文本任务中具备实用潜力。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
创作者或企业用户如果依赖AI进行复杂业务推理(如数据分析、财务建模、生成长篇技术文档),可以明显降低单次任务的API支出。文本输入输出限制则意味着涉及图像或视频理解的场景需要等待后续多模态版本。
值得关注的后续
第一,GLM-5.3是否会在智谱AI开放平台全量上线,以及实际部署后的输出速度和稳定性是否与评测一致,这是开发者决定是否迁移工作流的关键。第二,Anthropic、OpenAI等厂商是否会针对这一定价区间调整自家旗舰推理模型的输出价格,可能引发高端API价格的新一轮竞争。第三,智谱AI是否会在开源社区同步发布GLM-5.3的非推理版本或较小参数版本,将影响它在国内开发者生态中的渗透速度。


