IDE 与客户端接入

把任意 OpenAI 兼容 SDK、IDE 客户端或编程 Agent 指向 GLM 5 的 Base URL,完成连接验证,并用响应里的 X-Request-ID 追踪单条请求的状态、模型、延迟与错误码。

“支持 IDE”具体指什么

GLM5 提供 OpenAI-compatible API。要在 VS Code 或其他 IDE 中使用 GLM5,请选择一个支持自定义 OpenAI-compatible provider 的客户端或 Coding Agent。

这里不代表 GLM5 提供第一方 VS Code 插件

客户端需要同时配置以下三个值:

Base URLhttps://glm5.app/api/v1
API Keysk-glm5-...在 Settings → API Keys 创建
Model IDglm-5.3-flash也可以使用 GET /models 返回的其他模型 ID

配 IDE 前先验证 Key

curl https://glm5.app/api/v1/models \
  -H "Authorization: Bearer $GLM5_API_KEY"

随后再发一个最小 Chat Completions 请求。如果两次请求都成功,但 IDE 仍返回 401,请确认客户端选择的是自定义 Provider,且 Base URL 精确填写为 https://glm5.app/api/v1

OpenAI SDK

import OpenAI from 'openai';

const client = new OpenAI({
  apiKey: process.env.GLM5_API_KEY,
  baseURL: 'https://glm5.app/api/v1',
});

const result = await client.chat.completions.create({
  model: 'glm-5.3-flash',
  messages: [{ role: 'user', content: 'Hello' }],
});

OpenCode

使用 @ai-sdk/openai-compatible,将 baseURL 设置为 GLM5,并通过环境变量提供 Key;只添加你实际要调用的 GLM5 Public Model ID。

Oh My Pi(omp)

对于 omp,在 ~/.omp/agent/models.yml 中定义自定义 Provider:

providers:
  glm5:
    baseUrl: https://glm5.app/api/v1
    api: openai-responses
    apiKey: GLM5_API_KEY
    models:
      - id: glm-5.3-flash
        name: GLM 5.3 Flash
        contextWindow: 1000000
        maxTokens: 8192

在启动 omp 的同一个 Shell 中设置 GLM5_API_KEY,然后运行 omp models glm5 验证 Provider。 如果希望它成为默认模型,在 ~/.omp/agent/config.yml 中将 modelRoles.default 设置为 glm5/glm-5.3-flash

Pi / Continue / 其他客户端

请选择客户端里的 Custom OpenAI-compatible Provider。若某个“OpenAI”内置选项固定调用 api.openai.com 且无法覆盖 Base URL,就不能直接连接 GLM5。

不要只粘贴 Key

即使 Key 正确,发到错误 Base URL 仍可能返回 401。把 Base URL + API Key + Model ID 当成一个完整配置任务。

排障

请求到达 GLM5 后,响应会包含 X-Request-ID。打开 Activity → Logs 搜索该 ID,可以查看状态、模型、Key、Tokens、Credits、延迟与错误码;默认不会保存 Prompt 或 Completion 正文。