Terminal-Bench 3.0
得分从 5.2 的 4.6 跃升至 28.3,开源第一;Agents' Last Exam (CLI) 同榜领先。
模型 · 智谱 GLM-5.3
2026 年 8 月 14 日发布的智谱新旗舰:与 GLM-5.2 同基座,靠更大规模后训练 Scaling 将编程与 Agent 能力再拉高一档,发布当天上线 ZCode、AutoClaw 与 GLM Coding Plan 全量用户,并重置全员额度。
得分从 5.2 的 4.6 跃升至 28.3,开源第一;Agents' Last Exam (CLI) 同榜领先。
长程软件工程得分 46.2 → 66.9,超过 DeepSeek-V4 Pro-0813。
CyberGym 漏洞发现 84.5 分居参评模型之首,ExploitBench 24.4 翻倍至 54.4。
完成安全评估后以 MIT 协议放出完整权重,延续智谱开源节奏。
GLM-5.3 最反直觉的地方是基座模型与 GLM-5.2 完全相同,性能提升 100% 来自后训练扩展:数十倍规模的长程任务环境、更多样的环境类型和超长训练周期。在普遍堆参数的行业节奏下,智谱用这条路线验证了「基座潜力远未触顶」。
官方口径其编程与 Agent 能力已接近 Claude Fable 5;内部自建体感评测(Z.ai Code Bench)较 GLM-5.2 提升 50%。对日常工程的意义:复杂多步 Agent 任务、跨文件重构和持续代码修改场景的成功率明显提高。
按入门价排序,点击平台名查看套餐详情。
| 平台 | 入门价 | GLM-5.3 可用性 |
|---|---|---|
| 智谱 GLM Coding Plan | ¥118/月(年付 ¥94.4) | 8/14 起全量用户可用,发布当天全员额度重置 |
| Z.ai 国际版 | $18/月(年付 $12.6) | 同步上线全量档位,Token 计费 |
| 火山引擎方舟 | ¥9.9/月起 | 暂为 GLM-5.2(限时加量 4 倍),5.3 待官方接入 |
| OpenCode Go | $10/月 | 暂为 GLM-5.2/5.1,模型列表持续更新 |
GLM-5.3 是 5.2 的同基座升级版,编程体感提升 50% 且已上线全量用户,新任务建议直接用 5.3;5.2 仍在各套餐可用,稳定性经过两个月大规模验证,两者共享套餐额度。
官方宣布完整模型权重将在发布后两周内(完成安全评估与加固后)以 MIT 协议开源;API 已随发布同步上线。
与 GLM-5.2 同基座,保持 1M token 上下文窗口,大型代码库整体分析能力不变。
走智谱套餐最低约 ¥94.4/月(年付 Lite);发布当天全员额度重置,是低成本尝鲜的好时点。重度 Agent 使用建议 Pro 档起步。