GLM 5 博客

博客

GLM 5 的使用指南、教程、对比评测与最新资讯:如何在本地部署运行、各套餐价格方案、性能基准跑分,以及用好 AI 聊天、图像生成与视频生成的实用技巧与最佳实践,一站掌握。

GLM 5.2 批量处理:高并发 API 工作流实战

GLM 5.2 批量处理:高并发 API 工作流实战

用 GLM 5.2 处理成千上万条请求,需要异步并发、限流处理和成本优化。本文讲解如何构建高效的批量管道,在不触发 API 限制的前提下最大化吞吐量。

Jul 21, 2026
gglm5.app Team
用 Docker 部署 GLM 5.2:自托管与 vLLM API 搭建

用 Docker 部署 GLM 5.2:自托管与 vLLM API 搭建

GLM 5.2 的 MIT 许可允许你在自有 GPU 基础设施上完全自托管。本文介绍如何用 Docker 和 vLLM 容器化部署 GLM 5.2 API 服务,含内存需求与生产环境配置。

Jul 21, 2026
gglm5.app Team
如何用 LangChain 集成 GLM 5.2:完整接入指南

如何用 LangChain 集成 GLM 5.2:完整接入指南

GLM 5.2 可通过 ChatOpenAI 把 base_url 指向 Z.ai API 接入 LangChain。本文讲解如何以 GLM 5.2 为后端模型构建链、智能体与工具调用工作流。

Jul 21, 2026
gglm5.app Team
GLM 5.2 RAG:构建检索增强生成应用

GLM 5.2 RAG:构建检索增强生成应用

GLM 5.2 的 1M token 上下文窗口改变了 RAG 的算账方式——很多场景下你完全可以跳过检索步骤。这里教你用 GLM 5.2 构建全上下文和传统检索式两种 RAG 管线。

Jul 21, 2026
gglm5.app Team
GLM 5.2 流式 API:实时 token 输出指南

GLM 5.2 流式 API:实时 token 输出指南

GLM 5.2 通过标准 OpenAI SSE 格式支持流式输出。本文讲清如何在 Python 和 JavaScript 中实现流式、处理 delta token,并构建实时聊天界面。

Jul 21, 2026
gglm5.app Team
GLM 5.2 函数调用:工具使用、并行调用与智能体工作流

GLM 5.2 函数调用:工具使用、并行调用与智能体工作流

GLM 5.2 支持 OpenAI 兼容的函数调用与并行工具调用。本文讲清如何定义工具、处理响应、构建多步智能体,并跑通真实的智能体循环。

Jul 20, 2026
gglm5.app Team
如何微调 GLM 5.2:硬件需求与真正可行的做法

如何微调 GLM 5.2:硬件需求与真正可行的做法

GLM 5.2 的 MIT 许可允许微调。完整 753B 微调需要 16+ 张 H100;量化版本的 LoRA 在 2–4 张 A100 上可行。本文讲清什么可行、什么不可行。

Jul 20, 2026
gglm5.app Team
如何用 Python 调用 GLM 5.2 API:完整集成指南

如何用 Python 调用 GLM 5.2 API:完整集成指南

GLM 5.2 兼容 OpenAI SDK:改一下 base_url 和模型名,你现有的 Python 代码就能直接跑。含流式输出、函数调用、异步用法的逐步教程。

Jul 20, 2026
gglm5.app Team
GLM 5.2 免费使用指南:2026 年可行的 4 种方法

GLM 5.2 免费使用指南:2026 年可行的 4 种方法

GLM 5.2 权重采用 MIT 许可证,但自托管需要 240GB+ 内存。真正免费的选项是浏览器聊天、NVIDIA NIM 积分和 Cloudflare Workers AI(每天 1 万 neurons)。四种方法如实拆解。

Jul 14, 2026
gglm5.app Team