GLM 5.3 Ollama:本地运行指南与硬件要求(权重发布后可用)
快速回答: 目前(8 月 18 日)Ollama 还没有 GLM 5.3——Ollama 模型库中最新的是 glm4、glm-5.1、glm-5.2。因为 GLM 5.3 的权重要等安全评估完成后(预计 8 月底)才开源,届时社区会很快把它打包进 Ollama。GLM 5.3 是约 743–753B 参数的 MoE 模型,本地运行需要多卡 GPU 或量化版。
TL;DR
| 问题 | 答案 |
|---|---|
| Ollama 现在有 GLM 5.3 吗? | ❌ 没有,最新是 GLM 5.2 |
| 什么时候会有? | 权重开源后(预计 8 月底),社区打包通常几天内跟进 |
| 模型多大? | 约 743–753B MoE(与 GLM 5.2 同基座) |
| 硬件要求 | FP16 约需 8× 80GB 显卡;4-bit 量化约 4× 80GB |
| 现在能跑什么? | Ollama 可跑 GLM 5.2 / GLM 5.1 |
Ollama 目前支持到哪一代 GLM?
截至 2026 年 8 月 18 日,Ollama 模型库中的 GLM 系列为:
glm4(GLM-4)glm-5.1glm-5.2(当前最新)
GLM 5.3 尚未上架,原因是权重还没开源。Ollama 这类本地推理工具只能运行已发布的开放权重——GLM 5.3 官方计划在发布(8 月 14 日)约两周后,也就是 8 月底前后,在 HuggingFace 放出权重(需先完成安全评估与加固)。
什么时候能在 Ollama 用 GLM 5.3?
流程大致是:
- 权重开源(预计 8 月底)→ 智谱在 HuggingFace 发布 GLM-5.3 权重。
- 社区打包 → Ollama 仓库跟进
glm-5.3模型(历史上 GLM 5.1/5.2 发布后都是几天内跟上)。 - 你本地拉取 →
ollama pull glm-5.3(具体模型名以发布时为准)。
因为 GLM 5.3 的网络安全能力是双刃剑,官方对权重发布非常谨慎——时间可能因安全评估进度微调,请以 HuggingFace 实际发布为准。
硬件要求:这模型不小
GLM 5.3 与 GLM 5.2 使用相同基座(社区估算约 743–753B 参数 MoE,官方未公布精确数字)。MoE 的好处是每次推理只激活部分参数(计算量可控),但权重文件本身很大:
| 部署方式 | 显存需求 | 典型硬件 |
|---|---|---|
| FP16/BF16 全精度 | ~1.5 TB | 8× H100/A100 80GB |
| 8-bit 量化 | ~750 GB | 8× 80GB(宽松) |
| 4-bit 量化 | ~400–450 GB | 4× A100/H100 80GB |
| CPU + 内存卸载 | 1–2 TB 内存 | 不推荐生产 |
个人单卡(24GB/48GB)大概率跑不动完整版,需要等社区出更小量化版或蒸馏版(参考 GLM 5.2 发布后的社区适配节奏)。
现在就想在 Ollama 用 GLM?先跑 GLM 5.2
等 5.3 期间,Ollama 上可以直接跑 GLM 5.2:
ollama pull glm-5.2
ollama run glm-5.2
GLM 5.2 同样支持 1M 上下文、工具调用,且与 5.3 同基座——本地体验接近,性能弱一档(Terminal-Bench 3.0: 4.6 vs 28.3)。
发布后如何用(预演)
权重发布后,典型 Ollama 用法(模型名以实际为准):
# 拉取(可能需先添加模型源)
ollama pull glm-5.3
# 运行
ollama run glm-5.3
# 或通过 API 调用
curl http://localhost:11434/api/chat -d '{
"model": "glm-5.3",
"messages": [{"role": "user", "content": "用 Python 写个快速排序"}]
}'
注意:GLM 5.3 强制开启思考(reasoning_effort low/high/max),本地推理会输出思考过程 token——与 5.2 的"可关思考"体验不同,长任务时输出量更大。
常见问题
Ollama 有 GLM 5.3 吗? 还没有。Ollama 最新只到 GLM 5.2,GLM 5.3 权重 8 月底才开源。
GLM 5.3 能在单卡上跑吗? 完整版(约 743B MoE)单卡跑不动,需要多卡或等待社区量化版。
GLM 5.3 和 Ollama 上已有的 GLM 5.2 什么关系? 同基座模型,5.3 是 5.2 的"后训练升级版"——更强但更晚开源。
权重什么时候出? 官方计划发布约两周后(预计 8 月底),视安全评估进度可能调整。
没有 GPU 能用 GLM 5.3 吗? 可以先用 GLM Coding Plan 或 ZCode(云端),本地等权重发布后看量化版。
参考来源
最后更新:2026 年 8 月 18 日




