模型
GLM 5 API 的公开模型 ID、能力、限制与积分费率。
使用 GET /models 获取公开 API 当前接受的准确模型 ID。只有该接口返回的模型才能用于 /chat/completions。
/models返回 GLM 5 当前开放的精选模型列表。
curl https://glm5.app/api/v1/models \
-H "Authorization: Bearer $GLM5_API_KEY"
{
"object": "list",
"data": [
{
"id": "glm-5.3",
"object": "model",
"created": 0,
"owned_by": "glm5"
}
]
}
模型列表
| 模型 | 适用场景 | 工具调用 | 输入 | 输出 |
|---|---|---|---|---|
glm-5.3 | 面向编程、推理与智能体任务的 GLM API 入口 | 是 | 78 积分 / 100 万输入 Token | 245 积分 / 100 万输出 Token |
glm-5.2 | 编程、推理、智能体与长文本任务 | 是 | 78 积分 / 100 万输入 Token | 245 积分 / 100 万输出 Token |
glm-5 | 通用对话与更低成本的 GLM 工作负载 | 是 | 84 积分 / 100 万输入 Token | 278 积分 / 100 万输出 Token |
kimi-k3 | 适合高价值推理任务的高性能备选模型 | 是 | 834 积分 / 100 万输入 Token | 4,167 积分 / 100 万输出 Token |
kimi-k2 | 适合通用对话的高性价比备选模型 | 是 | 84 积分 / 100 万输入 Token | 334 积分 / 100 万输出 Token |
deepseek-r1 | 不支持函数工具的文本推理模型 | 否 | 98 积分 / 100 万输入 Token | 362 积分 / 100 万输出 Token |
deepseek-v4-pro | DeepSeek 高性能推理与工具工作流 | 是 | 126 积分 / 100 万输入 Token | 251 积分 / 100 万输出 Token |
deepseek-v4-flash | 快速、低成本的 DeepSeek V4 对话模型 | 是 | 39 积分 / 100 万输入 Token | 78 积分 / 100 万输出 Token |
费率以每 100 万输入/输出 Token 消耗的积分展示。API 和 Chat 共用同一个 GLM 5 积分余额;美元价格仅作为辅助参考。计费换算、预占、结算与退款规则请查看计费与限制。
GET /models 不返回人为维护的 context_length 或 max_completion_tokens。GLM 5 不设置一个统一的 Token 窗口,不同模型的上下文与输出限制可能不同。
公开模型 ID
调用时请使用 GET /models 返回的模型 ID:
| 模型 ID | 工具调用 | 限制 | 说明 |
|---|---|---|---|
glm-5.3 | 是 | 按模型而定 | 新接入推荐的默认模型 ID。 |
glm-5.2 | 是 | 按模型而定 | 稳定的 GLM 编程与智能体选项。 |
glm-5 | 是 | 按模型而定 | 更低成本的通用 GLM 模型。 |
kimi-k3 | 是 | 按模型而定 | 高价值推理与对话任务的备选模型。 |
kimi-k2 | 是 | 按模型而定 | 高性价比通用对话备选模型。 |
deepseek-r1 | 否 | 按模型而定 | 不支持函数工具的推理文本模型。 |
deepseek-v4-pro | 是 | 按模型而定 | 高性能推理、编程与工具工作流。 |
deepseek-v4-flash | 是 | 按模型而定 | 快速、低成本的 DeepSeek V4 对话模型。 |
如果传入的模型 ID 不在 GET /models 返回结果中,API 会返回 404 model_not_found。
GLM-5.3
glm-5.3 是 GLM 5 公共 API 面向新接入提供的推荐模型 ID,适合编程、结构化推理、智能体工作流、函数调用和较长的技术对话。
{
"model": "glm-5.3",
"messages": [
{"role": "user", "content": "检查这份部署方案是否遗漏回滚步骤。"}
],
"max_completion_tokens": 1200
}
GLM-5.2
glm-5.2 作为稳定 GLM 模型 ID 继续可用,适合现有集成、编程、推理和函数调用工作流。
{
"model": "glm-5.2",
"messages": [
{"role": "user", "content": "总结这份事故报告并列出下一步行动。"}
],
"max_completion_tokens": 1000
}
GLM-5
glm-5 是成本更低的通用 GLM 选项,适合对话、摘要、结构化回答和较轻量的应用任务,并使用与 glm-5.3 相同的文本端点、流式输出和函数调用格式。
Kimi K3 / Kimi K2
kimi-k3 更适合推理密集或高价值文本任务;kimi-k2 更适合通用对话、摘要、抽取和需要工具能力的成本敏感场景。两者都通过同一个 Chat Completions API 调用。
DeepSeek R1
deepseek-r1 用于推理类文本生成,但当前 GLM 5 公共 API 中不支持函数调用。发送 tools 时会返回 400 unsupported_parameter。
DeepSeek V4 Pro / Flash
deepseek-v4-pro 面向更高价值的推理、编程、抽取和工具工作流;deepseek-v4-flash 则面向更快速、低成本的日常对话、摘要和工具型应用。
模型不存在
未知模型 ID 会返回:
{
"error": {
"message": "The requested model was not found.",
"type": "invalid_request_error",
"code": "model_not_found",
"param": null
}
}
HTTP 状态码为 404。