一句话看懂:智谱发布 GLM-5.3,不换底座模型,只靠后训练阶段的大规模扩展,就让编程能力比上一代提升约 50%,目前成为开源模型里编程能力最强的选择。
事件核心:发生了什么
8 月 14 日,智谱正式发布 GLM-5.3。与以往迭代不同,这次发布的关键变化不在预训练阶段:底座模型与 GLM-5.2 保持一致,所有能力提升都来自后训练阶段。智谱团队在 IndexShare、SAO 和不断演进的下一代 Slime 框架基础上,把长程任务环境规模扩大了十倍,引入更多样的环境类型,并延长了后训练时间,从而在同一个底座上显著推高了模型的能力上限。
从数据看,GLM-5.3 的进步相当明显:Terminal-Bench 3.0 得分从 4.6 升至 28.3,DeepSWE v1.1 从 46.2 升至 66.9,Agents’ Last Exam 从 23.8 升至 28.5,GDPval-AA v2 达到 1769 分。在 Terminal Bench 3.0 和 Agents’ Last Exam(CLI)两项测试中,GLM-5.3 均拿下开源模型第一。智谱内部评估认为,新版模型的编程体验相比 5.2 提升约 50%,与 Claude Fable 5 的编程和智能体能力已经比较接近。
为什么重要
这次发布传递了一个明确的行业信号:大模型竞争不只有“换更大底座”一条路。智谱选择在同一底座上做大规模后训练扩展,用实际结果证明模型智能上限还远未被榨干,这为整个行业提供了一条更低成本、更高效的迭代路径。
更重要的是,开源模型与闭源旗舰的差距正在编程这个高价值赛道上快速缩小。GLM-5.3 在编程和 Agent 任务上已经赶上闭源第一梯队,这会让“开源模型只能做辅助”的既有印象松动。国内大模型赛道的竞争重心,也在从“谁更会聊天”转向“谁更能干活”——编程能力、工具调用、任务完成度这样的硬指标,正取代对话流畅度成为新一轮比拼的核心。
对用户/开发者/创作者的影响
对开发者来说,最直接的变化是手头可用的开源编程模型又强了一档。GLM-5.3 目前已经上线智谱官方编程工具 ZCode、AutoClaw 和 GLM Coding Plan,Trae、Kouzi、WorkBuddy/CodeBuddy、Qoder 等平台也提供了早期访问入口,插件和工具链生态正在快速铺开。由于模型权重后续会开源,开发者可以基于它搭建本地编程助手、代码审查工具或私有化的 Agent 工作流,不必把所有代码数据都交给云端 API。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对企业和团队来说,模型权重不是发布当天就开放。智谱计划在安全评估和模型加固完成后,于发布两周后放出完整权重,这一安排意味着具备网络安全防御价值的开源模型,在开放方式上会更加谨慎。企业在接入时,需要同时评估模型能力和安全合规节奏。
值得关注的后续
目前公开信息显示,GLM-5.3 的权重将在两周后正式开放,届时可以重点观察三个方向:第一,权重开放后,真实开发者在长期项目中的体验是否和 benchmark 表现一致;第二,字节、阿里、DeepSeek 等开源模型玩家是否会跟进“不换底座、只炼后训”的路线,把竞争焦点从参数量转向后训练质量;第三,以编程能力见长的闭源模型是否会加速更新,拉开新的安全距离。编程智能体的竞争,接下来会更看真实工具链里的执行力和稳定性。
来源:AIbase


