智谱 GLM 5.3 是什么?全新编程旗舰全面解析
快速回答: GLM 5.3 是智谱 Z.ai 于 2026 年 8 月 14 日发布的最新旗舰模型。它与 GLM 5.2 使用相同基座模型(社区估算约 743–753B 参数 MoE),所有能力提升全部来自大规模后训练——编程能力较 GLM 5.2 提升约 50%,Terminal-Bench 3.0 从 4.6 跃升至 28.3(开源 SOTA),并"涌现"出领先的网络安全能力(CyberGym 84.5,公开最佳成绩)。
核心信息速览
| 项目 | GLM 5.3 |
|---|---|
| 发布时间 | 2026 年 8 月 14 日 |
| 基座模型 | 与 GLM 5.2 相同(约 743–753B MoE,官方未确认精确参数) |
| 提升来源 | 全部来自后训练(更多长程任务环境 + 更多 RL 算力) |
| 编程能力 | Z.ai Code Bench 提升约 50% |
| 上下文窗口 | 1M tokens,最大输出 128K |
| 开源权重 | 发布约两周后(安全评估完成后) |
| 使用方式 | GLM Coding Plan、ZCode,API 逐步开放 |
为什么 GLM 5.3 这么火?
GLM 5.3 发布后迅速成为 AI 圈热门话题,核心原因有三个:
1. 编程与 Agent 能力大幅跃升(最核心)
- 内部 Z.ai Code Bench 较 GLM 5.2 提升约 50%。
- Terminal-Bench 3.0(真实终端复杂任务)从 4.6 跳到 28.3,开源模型第一。
- DeepSWE v1.1 从 46.2 到 66.9,Agents' Last Exam 等也有明显进步。
- 官方称编程与智能体能力接近 Claude Fable 5,且 Token 效率更高(更少输出即可完成任务)。
2. "涌现"的网络安全能力(最意外的亮点)
- CyberGym(白盒漏洞发现)拿到 84.5%,当前公开最佳成绩,超过 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。
- 漏洞利用相关基准提升更显著(部分超过 GLM 5.2 两倍)。
- 与多家安全团队合作,在真实项目中发现 2436 个漏洞(含 1097 个中高危)。官方定位偏防御场景。
3. 开源权重即将放出 + 使用方式变化
- 发布时通过 GLM Coding Plan、ZCode 可用,API 逐步开放。
- 权重计划在发布约两周后开源(安全评估与加固后),目前正是大家等待和讨论的节点。
- 强制开启深度思考(不能禁用),新增
reasoning_effort(low / high / max,默认 max),迁移时需注意参数调整。
GLM 5.3 与 GLM 5.2 有什么区别?
一句话:同一个模型,训练得更狠。 GLM 5.3 没有新基座、没有新架构、没有更大的上下文——所有提升都来自一个月的大规模后训练。
| 对比项 | GLM 5.2 | GLM 5.3 |
|---|---|---|
| 基座模型 | GLM 5.2 基座 | 相同基座 |
| Terminal-Bench 3.0 | 4.6 | 28.3 |
| DeepSWE v1.1 | 46.2 | 66.9 |
| AutomationBench | 26.2 | 48.2 |
| CyberGym | 77.2 | 84.5 |
| 思考模式 | 可关闭 | 强制开启(3 档力度) |
怎么用 GLM 5.3?
目前三种方式:
- GLM Coding Plan(最方便)——所有订阅用户已自动升级到 GLM 5.3,Lite $18/月、Pro $80/月、Max $168/月(年付 7 折)。错峰时段(工作日 14:00–18:00 之外,含周末)消耗 50% 点数。
- ZCode——智谱官方编程 Agent,支持 Goal 模式(长任务自动验证完成),8 月 31 日前有 1.5 倍配额加成。
- API——即将开放,模型 ID
glm-5.3,预计定价与 GLM 5.2 一致($1.4/$4.4 每百万 token)。
什么时候能用上开源权重?
官方口径:发布约两周后,即 8 月底前后,在 HuggingFace 放出权重(安全评估与加固完成后)。由于 GLM 5.3 的网络安全能力是双刃剑,权重发布时间可能根据安全评估进度调整。
常见问题
GLM 5.3 是智谱发布的吗? 是的,由智谱 Z.ai(原智谱 AI)于 2026 年 8 月 14 日发布。
GLM 5.3 有多少参数? 与 GLM 5.2 相同基座,社区估算约 743–753B MoE,官方未公布精确数字。
GLM 5.3 免费吗? GLM Coding Plan 订阅用户可直接使用;错峰时段消耗 50% 点数。权重发布后可以本地部署,无需 API 费用。
GLM 5.3 支持中文吗? 支持,作为国产模型中文场景表现优秀,本地部署潜力大、成本可控。
GLM 5.3 和 Kimi K3 谁更强? Artificial Analysis 独立评测两者均为 60 分(Intelligence Index),并列开源模型最高;GLM 5.3 的 API 价格约为 Kimi K3 的一半。
参考来源
最后更新:2026 年 8 月 18 日




