Z.ai 报告的结果
Terminal-Bench 3.0
Z.ai 报告 GLM 5.3 在 Terminal-Bench 3.0 上为 28.3,上一代旗舰为 4.6——已公布的最大跃升。
GLM 5.3 是智谱 AI 新旗舰大语言模型:100 万 token 上下文、128K 最大输出与顶尖开源编码基准。在 glm5.app 免费 Chat 该模型。
GLM 5.3 是智谱 AI2026 年 8 月官宣的新旗舰大语言模型,基于上一代旗舰底座,并通过大规模长程(long-horizon)后训练进一步强化。
Z.ai 最新的旗舰底座模型:100 万 token 上下文窗口、128K 最大输出,纯文本输入输出。
它沿用上一代旗舰底座,并在真实计算集群、存储、文档与代码库上增加了数十倍的长程后训练;Z.ai 表示编码体验提升约 50%。
GLM 5.3 模型 API 即将上线,因此本页把 Z.ai 已确认的信息(规格与基准)与待定信息(API ID、定价、权重与许可证)分开。
Z.ai 已确认规格与基准。API 访问、定价与开源权重仍待公布。
Z.ai 已确认
官方模型页标注 100 万 token 上下文窗口。
每次响应的官方最大输出 token 数。
文本底座模型;没有文档化视觉或多模态输入。
Z.ai 编程计划订阅已全面上线该模型。
Z.ai 表示模型 API 即将上线,尚未公布具体日期。
待定的官方细节
上一代旗舰 API 约为每 100 万 token 输入 1.40 美元 / 输出 4.40 美元。
上一代旗舰已以 MIT 许可证在 Hugging Face 发布;新权重与许可证尚未公布。
glm5.app 公共 API 的模型 ID 为 `glm-5.3`。
状态依据 Z.ai 截至 2026 年 8 月的公开通信核对;未确认的细节在公布前一律视为未验证。
基准测试 / 02
Z.ai 报告了大幅基准提升,但分数只适用于公布的测试环境与日期;做决定前先复现一个相似的任务。
Z.ai 报告的结果
Z.ai 报告 GLM 5.3 在 Terminal-Bench 3.0 上为 28.3,上一代旗舰为 4.6——已公布的最大跃升。
Z.ai 报告的结果
Z.ai 报告 GLM 5.3 在 DeepSWE v1.1 上为 66.9,上一代旗舰为 46.2。
Z.ai 报告的结果
Z.ai 报告 GLM 5.3 在 Agents' Last Exam 上为 28.5,上一代旗舰为 23.8,覆盖智能体知识与推理。
Z.ai 报告的结果
Z.ai 报告 GLM 5.3 在 CyberGym 上为 84.5,略高于 GPT-5.6 Sol 的 83.6。
能力 / 03
它支持面向智能体与长程工作的标准开发者技术栈,以 100 万 token 上下文应对项目级任务。
多种思考模式让你在推理深度与延迟之间取得平衡,匹配手头的任务。
面向外部集成的强大工具调用支持,由你的应用校验并执行每个请求的动作。
面向交互式聊天与智能体循环的实时流式响应。
智能缓存优化长对话与重复上下文,降低长程会话成本。
JSON 与其他结构化输出格式让系统集成可预期。
可调用外部 MCP 工具与数据源。
发布时间线 / 04
通向 GLM 5.3 的里程碑,以及仍需落地的内容,随 Z.ai 发布官方新闻持续更新。
上一代旗舰面向长程任务发布,支持 100 万 token 上下文窗口与强度控制。
Z.ai 发布官方模型页与基准结果,将其命名为基于上一代旗舰底座的新旗舰。
GLM 编程计划订阅已把该模型全面上线到 Claude Code、Cline 与 OpenCode 等编码工具。
Z.ai 表示 API 即将上线。官方模型 ID、限制与定价公布后会在此更新。
权重与许可证细节预计延续上一代旗舰在 Hugging Face 的 MIT 先例,有待官方确认。
适用人群 / 05
面向进行长程工程、智能体工作流与安全审查的团队。
构建编码助手与 IDE 工作流的开发者,受益于约 50% 的编码体验提升,以及面向整个仓库工作的 100 万 token 上下文。
智能体团队使用思考模式、函数调用、流式与 MCP,构建带清晰停止条件的长期自主工作流。
在白盒代码审查与漏洞发现(CyberGym 84.5)上表现出色。
跨数万行代码与数十个文件工作的团队,用它规划重构、修复 bug 并以极少的干预交付项目。
平台团队在官方 API 上线前追踪 API 定价与限制。
自托管用户关注 Hugging Face 上的开源权重,以便规划硬件、量化与许可证审查,延续 MIT 先例。
今天即可在 glm5.app Chat 中使用,官方模型 API 预计随后上线。
在 glm5.app 打开 GLM 5.3 Chat,描述问题与期望结果,再用你的代码优化回复。
对于今天的编码工具集成,Z.ai 编程计划已经在 Claude Code、Cline 与 OpenCode 等工具中提供该模型。
通过 glm5.app API 调用时,请使用模型 ID `glm-5.3`,Base URL 为 `https://glm5.app/api/v1`。
Integration specimen
官方模型 API 即将由 Z.ai 推出。glm5.app 今天已提供 OpenAI 兼容的 Chat Completions 端点,官方模型 ID 公布后会添加在此。把 API 密钥保留在服务端,先发小规模请求,再逐步扩大。
打开 API 文档curl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'关于 GLM 5.3 发布日期、定价、基准、Hugging Face、参数、权重、编程计划与对比 5.2 的清晰回答。
这款模型是 Z.ai 的新旗舰大语言模型,于 2026 年 8 月官宣。
官方模型页与基准结果已于 2026 年 8 月发布,模型 API 预计即将开放。
Z.ai 报告 Terminal-Bench 3.0 为 28.3(对比 4.6)、DeepSWE v1.1 为 66.9(对比 46.2)、Agents' Last Exam 为 28.5(对比 23.8)、CyberGym 为 84.5,均对比上一代模型。
权重尚未上传 Hugging Face。
参数数量尚未公布;官方页面标注 100 万 token 上下文与 128K 最大输出。
权重预计遵循上一代在 Hugging Face 的发布,采用 MIT 许可证。
GLM 编程计划——Z.ai 面向 Claude Code、Cline、OpenCode 等 AI 编码工具的订阅——已全面上线新模型。
新模型沿用上一代底座,长程后训练大幅增强;编码体验提升约 50%,另有白盒代码审查提升。
Start here
在 glm5.app 免费 Chat GLM 5.3,并在此追踪官方 API、定价与开源动态。