ITCOW牛新网 8月15日消息,智谱 AI 于昨日正式推出 GLM-5.3,这次迭代没有换底座,而是在与 GLM-5.2 完全相同的基座上靠后训练 Scaling 把智能上限再抬一截——数十倍扩容的长程任务环境、更多样的环境类型与超长 RL 时间,换来编程与智能体能力的跨档提升。

智谱GLM-5.3

新模型在内部自建体感评测里较 GLM-5.2 编程能力涨约 50%,公开基准上拿下 Terminal Bench 3.0、Agents’ Last Exam(CLI)等项开源第一。具体分数看,Terminal-Bench 3.0 从 4.6 跳到 28.3,DeepSWE v1.1 从 46.2 到 66.9,Agents’ Last Exam 从 23.8 到 28.5,GDPval-AA v2 拿到 1769 分;白盒代码审查与漏洞发现类安全任务持平 Mythos 5,编程体感超过其他国产模型、整体接近 Claude Fable 5。自研 Z.aiCode Bench 里,High 档位 GLM-5.3 准确率 31.4%,反超 Claude Opus 4.8 最高档的 29.5%,且单任务平均只吐约 5 万 token,Opus 4.8 要烧到 12 万,执行路径更短、token 利用率更优。

智谱GLM-5.3

据ITCOW牛新网了解,后训练侧基于 IndexShare、SAO 与新一代 Slime 框架推进强化学习,智谱明确表示同一基座的智能上界还远没摸顶。即日起 GLM-5.3 接入官方编程工具 ZCode 与效率工具 AutoClaw,GLM Coding Plan 全量用户及订阅开放,TraeWork、TraeCode、扣子、WorkBuddy、CodeBuddy、Qoder、QwenWork、CatPaw、JoyCode、OpenCode 等平台同步给抢先体验;API 随后上线,完整权重在两周安全评估与加固后开源,以保留防御价值、压住潜在攻击面。今日 13:00 GLM Coding Plan 全员额度已重置,用户后台用量统计回满。