如何在 OpenCode 中使用 Ox Alpha:免费配置指南

如何在 OpenCode 中使用 Ox Alpha:免费配置指南

在 OpenCode 中使用 Ox Alpha:OpenCode Go 已上线 Ox Alpha Free,免费一周、近乎无限次数的智能体编程额度且不占 Go 用量,也可通过 OpenRouter(stealth/ox-alpha)接入自有 API Key,一文讲清免费配置方法。

快速回答: Ox Alpha Free 已经上线 OpenCode Go——为期一周、近乎无限次数的免费窗口(官方公告称具备 100T tokens/天的容量),且不计入你的 Go 用量。打开 OpenCode,切换到 Go 模型列表,选中 Ox Alpha Free,即可开始一次智能体编程会话。不需要 API Key,不需要服务商账号,也不需要任何配置文件。如果你更想用自己的 Key,同一个模型也可以经由 OpenRouter 以 stealth/ox-alpha 接入。


如果你用智能体方式写代码,一定感受过那种挤压感:每个能打的模型,要么在几场长会话里烧光你的套餐额度,要么在你写下一行代码之前就要求付费 API Key,要么把 context window 卡得死死的,让多文件任务退化成一连串瞎猜。而一个同时消除这三重摩擦的模型——免费、近乎无限、1M token 上下文——听起来好得不像真的。这正是本周 OpenCode Go 上 Ox Alpha Free 这个条目在提供的东西,所以让我们仔细看看它到底是什么、怎么开启,以及在把它托付给你的代码库之前,那些不能回避的限制。

本指南基于 OpenRouter 官方模型页面、OpenRouter 公开 API 数据以及 OpenCode 官方公告撰写(核对时间:2026 年 8 月 21–22 日)。我们没有跑自己的基准测试;凡出自社区测试的数字,均已明确标注。

OpenCode 公告到底说了什么

Ox Alpha(列表中显示为 「Ox Alpha Free」)于 2026 年 8 月 21 日出现在 OpenCode Go 模型列表中,附带限时活动:未来一周免费,活动期间近乎无限次数使用。公告里有两点细节比标题更值得注意:

  1. 它不计入你的 Go 用量。 Ox Alpha Free 上的会话与你的 Go 套餐额度彼此独立,也就是说这一周里高强度的智能体运行不会挤占你花钱买的额度。
  2. Go 列表宣称零数据留存,同时标注 1M 上下文多模态输入——该模型接受文本、图片和视频输入,返回文本。

这个定位与 OpenRouter 上的模型页面一致:Ox Alpha 是「专为编码、持续性智能体工作和生产负载设计的推理模型」,适合「长周期软件工程、复杂推理,以及把文本与视觉上下文结合的工作流」。它于 2026 年 8 月 20 日在 OpenRouter 上线,预览期价格为 $0 / $0。

第 1 步:打开 OpenCode,找到 Ox Alpha Free

走 OpenCode Go 这条路完全不需要任何配置文件——这正是它最大的吸引力:

  1. 像往常一样从终端启动 OpenCode(opencode)。
  2. 打开模型选择器(和你平时切换已配置模型的流程一样)。
  3. 找到 OpenCode Go 模型列表——Ox Alpha Free 与其他 Go 提供的模型排在一起。
  4. 选中 Ox Alpha Free

UI 标签和菜单位置会因 OpenCode 版本而异,所以别死记截图:你要找的是 Go 列表里那个叫「Ox Alpha Free」的模型。如果你的 OpenCode 没有显示 Go 模型,请确认客户端是最新版本,并且已登录有 Go 权限的账号。

第 2 步:开始一次智能体会话

选中之后,直接开始写代码即可。你实际拿到的是:

  • 1,048,576 token 上下文(1M)——足以容纳整个仓库或超长的多文件改动集。
  • 每次请求最多 131,072 token 输出——既装得下长推理轨迹,也装得下大段编辑。
  • 强制推理,默认 effort 为 max(API 也接受 highlow),所以长周期任务默认就会得到完整的深思熟虑。
  • 工具调用与结构化输出——API 暴露了 toolstool_choiceresponse_format,这正是一个智能体编码循环所需要的一切。

OpenCode 发布的模型监控数据(上线后头约 3 天)显示吞吐约 24 tokens/s(P50)、延迟约 5.81s(P50),3 天内可用性 99.99%。它是个预览模型,所以速度数字请当作方向性参考。

备选路径:通过 OpenRouter Key 接入 Ox Alpha

想自带 Key?同一个模型也可以通过 OpenRouter 以 stealth/ox-alpha 这个 ID 接入,走标准的 OpenCode 接入 OpenRouter 流程:

  1. 获取一个 OpenRouter API Key,并确保它以环境变量的形式对 OpenCode 可用。
  2. 在 OpenCode 配置中把 OpenRouter 配为 provider(模型 ID stealth/ox-alpha)。
  3. 可选:在模型设置里调整推理强度(max / high / low)。
  4. 开始一个会话,确认请求确实路由到了 stealth/ox-alpha

由于模型处于免费预览期,OpenRouter 上的 prompt 和 completion 定价目前都是 $0 / $0——但请记住,无论你从哪里访问,免费窗口都可能随时结束,不作另行通知。要确认你的版本当前正确的 provider 配置语法,OpenCode 官方文档是最合适的去处。

免费窗口与它的边界

关于「免费」有三条实在的提醒:

  1. 窗口只有一周。 公告说「未来一周免费」,OpenRouter 页面也把预览标为「PRICE: Free」。窗口结束之后的价格、配额或可用性,均未披露
  2. 近乎无限不等于无限。 公告引用的是 100T tokens/天的容量。这是一个巨大的上限,但它是预览期的容量数字,并不保证高峰时段每个用户都能获得无限的吞吐。
  3. 它是预览版。 provider 的身份、架构和参数量均未披露。预览期间,性能和表现都可能发生变化。

本周流传的社区测试大致报告:DeepSWE 10 任务子集上约 80%(社区测试数据,未经独立验证;同一小样本中:Fable 65%、GPT-5.6 Sol 52%),以及 Kingbench 87.5% 的说法(社区测试数据,未经独立验证)。OpenRouter 模型页面本身没有发布任何基准分数,独立追踪机构 Artificial Analysis 也未收录该模型(核对时间:2026-08-22)。请把这些都当作方向性信号,而不是排名。

在 OpenCode 里,Ox Alpha 擅长什么

OpenRouter 头两天的用量信号出奇地一致:按 token 量排前五的应用是 Hermes Agent(120B tokens)、Claude Code(108B)、Oh-My-Pi(93.5B)、DeepSeek Harness multimodal-bridge(84.8B)和 ZCode(51.5B)——清一色都是智能体编码或 agent 工具。该窗口内总用量约为 657B prompt tokens 和 7.95B completion tokens。真实用户在用它在做 agent 工作,所以适合的任务是:

  • 长上下文下的仓库级任务——1M 窗口装得下整个 monorepo 和长周期多文件重构,中途无需做摘要压缩。
  • 多步 agent 循环——工具调用加强制推理,正好贴合 OpenCode 的编辑-测试-迭代循环。
  • 带视觉上下文的编码工作流——文本 + 图片 + 视频输入,意味着你可以直接把 UI bug 截图或故障流程的视频喂进循环,而不只是粘贴报错文本。

如果是快速单行修复,一个小而快的模型仍然是更合理的选择;Ox Alpha 的价值在长周期、上下文密集型的工作上。如果你想在把它接进完整的 agent 循环之前先试玩一下,在 glm5.app 上免费试用 Ox Alpha——这是一个指向同一个 stealth/ox-alpha 模型的浏览器聊天入口,连终端都不用开。

免费窗口结束后,怎么选一个免费编码模型

这是大多数配置指南跳过的一节:免费周总会结束,你需要的是一套决策框架,而不是又一份公告。按四个维度给候选模型打分:

  1. 上下文大小及其退化方式。 1M token 窗口的意义不只是容量——它决定了在 agent 开始做摘要之前,你的仓库能装进去多少。要比较的是扣掉工具调用开销之后的有效上下文,而不是标题数字。
  2. 工具调用成熟度。 智能体编码的成败系于 tools / tool_choice 的可靠性和结构化输出。去查 provider 的 API 面是否暴露这些参数,以及模型在长循环里是否真的会跟随工具调用。Ox Alpha 明确暴露了 toolstool_choiceresponse_formatreasoning_effort——这就是你应该要求的最低标准。
  3. 数据政策。 你的 prompt 和 completion 会怎样被处理?OpenCode Go 列表宣称 Ox Alpha Free 零数据留存;而在 OpenRouter 这边,Stealth Model Terms 规定 provider 会留存 prompt 和 completion,但不会用于训练。不同的接入路径,不同的政策——在把专有代码推给任何免费模型之前,先读清楚适用于你这一套配置的那份条款。
  4. 看每个完成任务的真实成本,而不是每 token 成本。 $0/1M tokens 按 token 算无可匹敌,但如果模型需要尝试三次才能成功,这个价格就毫无意义。诚实的问法是:每个合入的功能,总成本(包括你的时间)是多少。预览结束后定价未披露——所以窗口结束时去核对官方页面,别假设今天的 $0 会一直延续。

还有一个值得留意的信号:Ox Alpha 用量最大的应用全是 agent 工具,这说明了社区实际拿它验证过什么。比较模型时,去找同类的真实使用证据——而不是营销式基准。

把它托付给你的代码库之前的提醒

  • provider 是匿名的。 Ox Alpha 是一个隐身模型(stealth model)——由一家「选择在预览期间保持匿名」的第三方 provider 开发并运营。OpenRouter 只负责路由请求,不是它的开发者、所有者或 provider。
  • 不同接入路径,数据处理方式不同。 经由 OpenRouter,prompt 和 completion 会被 provider 留存(根据 Stealth Model Terms,不会用于训练)。经由 OpenCode Go,列表宣称零数据留存。无论哪条路:都不要在预览会话里粘贴 API Key、密钥或敏感客户代码,还指望它是私密的。
  • 一切皆可变化。 定价、配额、可用性,甚至模型的行为,在预览期间都是临时的。如果某个免费窗口关系到你的生产决策,请把「免费」当作一次试用,而不是一个依赖项。

常见问题

Ox Alpha 在 OpenCode 里免费吗? 是的——Ox Alpha Free 在 OpenCode Go 模型列表上,提供一周免费窗口和近乎无限次数的用量(公告称 100T tokens/天),且不计入你的 Go 用量。

免费期有多长? OpenCode 公告说「未来一周免费」(2026 年 8 月 21 日发布);OpenRouter 页面把预览标为 $0 / $0。窗口结束后的定价未披露。

在 OpenCode 里用它需要 API Key 吗? 走 OpenCode Go 路径不需要——只需从 Go 模型列表里选 Ox Alpha Free。如果你走备选路径,可以配一个 OpenRouter Key 和模型 ID stealth/ox-alpha,通过 OpenRouter 接入。

在 OpenCode 里,Ox Alpha 适合什么任务? 长上下文、仓库级的智能体工作:多文件改动、多步 agent 循环,以及把视觉上下文(图片/视频输入)与代码结合的工作流。它的主要用量来自 Hermes Agent、Claude Code、ZCode 这类 agentic 工具。

它会占用我的 OpenCode Go 用量吗? 不会——公告明确说明免费窗口「不计入你的 Go 用量」。

如果这一周的窗口让你对这个模型本身产生了好奇,在 glm5.app 免费开始一次 Ox Alpha 对话,在把任何工作流托付给它之前先亲手试一把。


参考来源

最后更新:2026 年 8 月 22 日

立即开始使用 GLM 5

免费试用 GLM 5 — 推理、编程、智能体和图像生成,一个平台全搞定。

如何在 OpenCode 中使用 Ox Alpha:免费配置指南 - GLM 5