GLM 5 博客

博客

GLM 5 的使用指南、教程、对比评测与最新资讯:如何在本地部署运行、各套餐价格方案、性能基准跑分,以及用好 AI 聊天、图像生成与视频生成的实用技巧与最佳实践,一站掌握。

GLM 5.3 Flash 跑分:厂商自报数据 vs 独立实测

GLM 5.3 Flash 跑分:厂商自报数据 vs 独立实测

GLM 5.3 Flash 跑分解读:Terminal-Bench 2.1 拿 84.3、DeepSWE 63.4、Artificial Analysis 57 分。哪些是第一方数据,哪些经得起推敲。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash 跑 DGX Spark:装得下吗?能跑多快?

GLM 5.3 Flash 跑 DGX Spark:装得下吗?能跑多快?

在 NVIDIA DGX Spark 上跑 GLM 5.3 Flash:328 GB 的 FP8 权重对单台 128 GB。什么装得下、什么必须量化,以及社区实测的 2× Spark 吞吐。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash 接入 OpenRouter:模型 ID、各家价格与 API 配置

GLM 5.3 Flash 接入 OpenRouter:模型 ID、各家价格与 API 配置

GLM 5.3 Flash 在 OpenRouter 上的模型 ID 是 z-ai/glm-5.3-flash,十家 provider 价差 2 倍、上下文差 5 倍。附 curl 与 Python 示例和 provider 锁定规则。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash 参数与体积:320B-A18B、328 GB、MIT 权重

GLM 5.3 Flash 参数与体积:320B-A18B、328 GB、MIT 权重

GLM 5.3 Flash 有 320B 总参数、18B 激活、45 层、288 个专家。完整架构拆解、磁盘真实体积、Hugging Face 与 GitHub 仓库位置,以及 MIT 许可到底允许什么。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash 价格:每 token 真实成本与十家 provider 全对比(2026)

GLM 5.3 Flash 价格:每 token 真实成本与十家 provider 全对比(2026)

GLM 5.3 Flash 定价拆解:标价 $0.15/$0.50、限时 5 折、十家 provider 价差 2 倍。附真实成本算例,以及那个会让预算翻倍的折扣陷阱。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash 在 Reddit 上:社区到底发现了什么

GLM 5.3 Flash 在 Reddit 上:社区到底发现了什么

GLM 5.3 Flash 的 Reddit 讨论:r/LocalLLaMA 如何在官方揭晓前用 tokenizer 指纹认出 Ox Alpha,自部署者踩到什么坑,哪些社区说法经得起一手来源核对。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash vs DeepSeek V4 Flash:两个廉价开源模型怎么选

GLM 5.3 Flash vs DeepSeek V4 Flash:两个廉价开源模型怎么选

GLM 5.3 Flash 与 DeepSeek V4 Flash 全面对比:价格、速度、智能、多模态与自部署。320B-A18B 对 284B-A13B,同为 MIT、同为 1M 上下文。

Aug 27, 2026
GGLM 5 编辑团队
Ox Alpha vs GLM 5.3 Flash:它们是同一个模型,但这些东西变了

Ox Alpha vs GLM 5.3 Flash:它们是同一个模型,但这些东西变了

Ox Alpha 与 GLM 5.3 Flash 是同一份权重、不同的条款。模型 ID、价格、数据政策和可用性在揭晓时全变了——你的代码要改哪几处。

Aug 27, 2026
GGLM 5 编辑团队
GLM 5.3 Flash 是什么?智谱 320B-A18B 原生多模态模型详解

GLM 5.3 Flash 是什么?智谱 320B-A18B 原生多模态模型详解

GLM 5.3 Flash 是 Z.ai 的 320B-A18B 原生多模态 MoE 模型,1M 上下文、MIT 开源权重、$0.15/$0.50 API 定价。它是什么、什么时候该用、什么时候不该用。

Aug 27, 2026
GGLM 5 编辑团队
如何使用 Ox Alpha:第一个任务的实战工作流

如何使用 Ox Alpha:第一个任务的实战工作流

Ox Alpha 怎么用:从选一个安全的第一个任务开始,讲清 reasoning effort 档位、1M 上下文的组织方式、工具调用与结构化输出的取舍,以及一套可重复的小型评测方法。

Aug 23, 2026
AAdmin Jen Editorial Team
如何免费使用 Ox Alpha:3 种访问方式

如何免费使用 Ox Alpha:3 种访问方式

Ox Alpha 免费使用攻略:glm5.app 免密钥浏览器直聊、OpenRouter API 预览期 $0/$0、OpenCode Go 一周免费窗口,三种方式逐步配置教程。

Aug 22, 2026
AAdmin Jen Editorial Team
Ox Alpha 跑分解读:社区成绩到底能信几分

Ox Alpha 跑分解读:社区成绩到底能信几分

Ox Alpha 基准测试现状:官方无跑分,社区 DeepSWE 与 Kingbench 成绩未经独立验证——本文教你如何解读这些跑分数据,并亲自测试这个模型。

Aug 22, 2026
AAdmin Jen Editorial Team
如何在 OpenCode 中使用 Ox Alpha:免费配置指南

如何在 OpenCode 中使用 Ox Alpha:免费配置指南

在 OpenCode 中使用 Ox Alpha:OpenCode Go 已上线 Ox Alpha Free,免费一周、近乎无限次数的智能体编程额度且不占 Go 用量,也可通过 OpenRouter(stealth/ox-alpha)接入自有 API Key,一文讲清免费配置方法。

Aug 22, 2026
AAdmin Jen Editorial Team
Ox Alpha 上 OpenRouter:模型 ID、免费定价与 API 接入

Ox Alpha 上 OpenRouter:模型 ID、免费定价与 API 接入

Ox Alpha OpenRouter 免费接入指南:模型 ID stealth/ox-alpha、$0 预览定价、1M 上下文,附 curl 与 Python API 调用示例,快速上手智能体编程。

Aug 22, 2026
AAdmin Jen Editorial Team
Ox Alpha 在 Reddit:社区怎么说这个隐身模型

Ox Alpha 在 Reddit:社区怎么说这个隐身模型

Ox Alpha Reddit 社区讨论还很少,但方向已经清晰:身份猜测、未经独立验证的社区跑分、免费窗口热度——以及如何区分事实与谣言。

Aug 22, 2026
AAdmin Jen Editorial Team
Ox Alpha 是什么?免费 1M 上下文隐身模型详解

Ox Alpha 是什么?免费 1M 上下文隐身模型详解

Ox Alpha 是什么?免费 1M 上下文隐身模型全解析——官方规格、数据政策、社区传闻、真实使用信号,以及如何在预览期免费试用。

Aug 22, 2026
AAdmin Jen Editorial Team
DeepSeek V4 Pro 替代方案:7 款旗舰模型对比(2026)

DeepSeek V4 Pro 替代方案:7 款旗舰模型对比(2026)

按六维评估框架排名的 DeepSeek V4 Pro 最佳替代方案——GLM 5.2、Kimi K3、GPT-5.6、Claude Opus 4.8、Gemini 2.5 Pro、Llama 4 Maverick、Qwen 3。含定价、适用场景与诚实的取舍分析。

Aug 13, 2026
DeepSeek V4 Pro API 接入:密钥、端点与 Python 快速上手

DeepSeek V4 Pro API 接入:密钥、端点与 Python 快速上手

三步接入 DeepSeek V4 Pro API:在 platform.deepseek.com 获取密钥,指向 OpenAI 兼容端点,运行可复制的 Python 与 curl 示例——含思考模式开关。

Aug 13, 2026
DeepSeek V4 Pro 基准测试:0813 分数与速度解读

DeepSeek V4 Pro 基准测试:0813 分数与速度解读

DeepSeek V4 Pro 基准测试解读:Intelligence Index 53(104 个模型中排名第 2)、83.2 tok/s、1.63 秒 TTFT——0813 数字的含义、来源,以及如何正确阅读而不被误导。

Aug 13, 2026
DeepSeek V4 Pro 上下文窗口:1M token 到底意味着什么

DeepSeek V4 Pro 上下文窗口:1M token 到底意味着什么

DeepSeek V4 Pro 拥有 1M token 上下文窗口。本文讲清 1,048,576 token 在页数和书里意味着什么、长上下文何时值得用、384K 输出上限如何配合,以及带缓存的超长上下文调用真实成本是多少。

Aug 13, 2026
DeepSeek V4 Pro 编程实战:开发者实用指南

DeepSeek V4 Pro 编程实战:开发者实用指南

DeepSeek V4 Pro 编程使用指南:思考模式配置、工具调用、1M token 仓库分析、智能体工作流、KV 缓存成本控制,以及坦诚的能力边界。

Aug 13, 2026
DeepSeek V4 Pro 定价:完整成本拆解(2026)

DeepSeek V4 Pro 定价:完整成本拆解(2026)

DeepSeek V4 Pro 定价全拆解:每 1M token $0.435/$0.87,缓存命中输入低至 $0.003625(-99%),真实负载成本测算、推理冗长税,以及官方涨价通知对你的预算意味着什么。

Aug 13, 2026
DeepSeek V4 Pro 对比 Claude Opus 4.8:开放权重与智能体旗舰的较量

DeepSeek V4 Pro 对比 Claude Opus 4.8:开放权重与智能体旗舰的较量

DeepSeek V4 Pro 对比 Claude Opus 4.8——架构、定价(输出每 M token 约 $0.87 对 $75)、1M 上下文、推理、编程与智能体能力全面比较,附场景化决策框架与第三选项 GLM 5.2。

Aug 13, 2026
DeepSeek V4 Pro vs Gemini 2.5 Pro:开放权重对阵 Google 多模态旗舰

DeepSeek V4 Pro vs Gemini 2.5 Pro:开放权重对阵 Google 多模态旗舰

DeepSeek V4 Pro 与 Gemini 2.5 Pro 在价格、上下文、模态、推理深度与生态上的对比。一个问题决定胜负:你的输入里需要图片、音频或视频吗?

Aug 13, 2026
DeepSeek V4 Pro vs GPT-5:开放权重旗舰还是 OpenAI 最强?

DeepSeek V4 Pro vs GPT-5:开放权重旗舰还是 OpenAI 最强?

DeepSeek V4 Pro 与 GPT-5 全面对比:价格(输出每 1M tokens $0.87 vs $10)、架构、1M 上下文与推理深度——附 2026 年场景化决策框架。

Aug 13, 2026
DeepSeek V4 Pro 是什么?1.6T 推理旗舰全解析

DeepSeek V4 Pro 是什么?1.6T 推理旗舰全解析

DeepSeek V4 Pro 全解析:1.6T/49B MoE 架构、1M token 上下文、默认思考模式、仅文本限制,以及 0813 版本的首发官方定价——还有谁真正适合用它。

Aug 13, 2026
GLM 5.5:发布状态、已知信息与预期规格(2026)

GLM 5.5:发布状态、已知信息与预期规格(2026)

GLM 5.5 发布了吗?没有——截至 2026 年 8 月,Z.AI 零官方公告。这里是经过核实的真实状态,以及你可以期待什么。

Aug 12, 2026
OpenAI Astra 是什么?2,000 美元的数学突破详解

OpenAI Astra 是什么?2,000 美元的数学突破详解

OpenAI Astra 详解:十个新数学成果与约 2,000 美元 token 消耗背后、尚未发布的下一代模型。证明、Lean 证书及其意义。

Aug 5, 2026
DeepSeek V4 Flash 替代方案:8 个备选模型排名(2026)

DeepSeek V4 Flash 替代方案:8 个备选模型排名(2026)

2026 年最好的 DeepSeek V4 Flash 替代方案排名——GLM 5.2、V4 Pro、Gemini 2.5 Flash、GPT-5 Mini、Qwen、Kimi 与 Llama,附大致价格、上下文与适用场景指南。

Aug 3, 2026
DeepSeek V4 Flash API 接入指南:Key、接口地址与 Python 快速上手

DeepSeek V4 Flash API 接入指南:Key、接口地址与 Python 快速上手

几分钟内接入 DeepSeek V4 Flash API:在 platform.deepseek.com 获取 key,调用 OpenAI 兼容接口,运行 Python 与 curl 示例,开启流式输出,并了解计费价格。

Aug 3, 2026