跳转到内容

Go

低成本的开源编程模型订阅服务。

OpenCode Go 是一项每月 10 美元的低成本订阅服务,让你能够稳定地访问流行的开源编程模型。

Go 的工作方式与 OpenCode 中的任何其他提供商(provider)一样。订阅 OpenCode Go 后你将获得 API 密钥。它是 完全可选 的,并非使用 OpenCode 所必需的条件。

它主要面向国际用户,并提供稳定的全球访问。


背景

开源模型现在变得非常强大。在编程任务中,它们的性能已接近专有模型。由于许多提供商都可以提供具有竞争力的服务,它们通常要便宜得多。

然而,获得可靠、低延迟的访问可能很困难。各提供商在质量和可用性方面参差不齐。

为了解决这个问题,我们做了以下几件事:

  1. 我们测试了一组精选的开源模型,并与他们的团队探讨了如何以最佳方式运行它们。
  2. 随后我们与一些提供商合作,以确保正确提供这些服务。
  3. 最后,我们对模型和提供商的组合进行了基准测试(benchmark),得出了一份我们乐于推荐的列表。

OpenCode Go 让你能够以每月 10 美元的价格访问这些模型。


工作原理

OpenCode Go 的工作方式与 OpenCode 中的其他提供商一样。

  1. 登录 OpenCode Zen,订阅 Go,然后复制你的 API 密钥。
  2. 在 TUI 中运行 /connect 命令,选择 OpenCode Go,然后粘贴你的 API 密钥。
  3. 在 TUI 中运行 /models 以查看通过 Go 可用的模型列表。

当前支持的模型列表包括:

  • Grok 4.6
  • GLM-5.3-Flash
  • GLM-5.3
  • GLM-5.2
  • GLM-5.1
  • GPT 5.6 Luna
  • Kimi K3
  • Kimi K2.7 Code
  • Kimi K2.6
  • LongCat-2.0
  • MiMo-V2.5
  • MiMo-V2.5-Pro
  • MiniMax M3
  • MiniMax M2.7
  • Muse Spark 1.3 Contributor (仅限部分地区)
  • Muse Spark 1.2 Contributor (仅限部分地区)
  • Qwen3.8 Max
  • Qwen3.8 Flash
  • Qwen3.7 Max
  • Qwen3.7 Plus
  • Qwen3.6 Plus
  • DeepSeek V4.1 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash Vision Exp
  • Hy4 preview
  • Hy3
  • Union Alpha Free (限时)

随着我们进行测试和添加新模型,该列表可能会发生变化。


可以在哪里使用?

OpenCode Go 适用于 OpenCode 以及其他会产生类似请求的编程 Agent。

我们会监控流量,以识别影响其他用户体验的滥用行为。

你的客户端应当:

  1. 发送典型的编程 Agent 流量。
  2. 使用自身专属的 user agent 标识(例如 my-coding-agent/1.0),而不是通用的 SDK 或 HTTP 库名称。
  3. 为每段对话在 x-opencode-session 请求头中发送稳定的会话 ID,以便我们优化路由和提示词缓存。

已验证的客户端

除 OpenCode 外,以下客户端已通过验证,能够正常使用 OpenCode Go。但我们无法保证它们未来仍能正常使用。

客户端会话支持
Hermes包含 PR #101864 的构建版本会在主要和辅助 OpenCode 请求中发送该请求头。此修复在 v0.21.0 发布后才合并,因此 v0.21.0 本身并不包含该修复。
Claude CodeGo 能识别其原生会话请求头,无需额外封装来添加自定义请求头。
CodexGo 能识别其原生会话请求头。某些版本和代理配置仍会遗漏该请求头;转发请求时请保留会话请求头。
ZCodeGo 能识别其原生会话请求头。我们请求支持 x-opencode-session 的 issue 仍处于开放状态,但已不再需要发送这一特定请求头。
Pi当前构建版本会为 OpenCode 发送会话信息。请更新旧版安装。
jcode请更新至 v0.81.6 或更高版本,其中包含会话请求头修复
Kilo Code CLI包含 PR #13752 的构建版本恢复了 OpenCode 会话请求头。此修复仅适用于 CLI,不适用于 VS Code 扩展。参见 issue #13723

已知存在问题的客户端

在我们调查的版本中,以下客户端缺少会话支持,或支持不完整。相关报告链接可用于跟踪修复进展和临时解决方案。

客户端状态与跟踪
DeepSeek Harness某些模型调用路径会传递会话信息,但其他路径中缺失。我们能识别其原生请求头;剩余工作是在所有适配器中发送该请求头。参见讨论 #5495
GitHub Copilot ChatVS Code issue #334186 已提出自动发送会话请求头的支持请求。
Kimi Codeissue #3506 已提出自动发送会话请求头的支持请求。
MiMo CodeIssue #2317 已有拟议修复 PR #2327,但尚未合并。

使用限制

使用限制以每月美元金额定义。下表列出了每个模型的每月限制和 token 成本。

每个模型都有以下使用限制:5 小时 — 每月限制的 20%;每周 — 50%;每月 — 100%。

例如,如果某个模型的每月限制为 $60,你最多可以使用:

  • 5 小时限制 — $12 的使用额度
  • 每周限制 — $30 的使用额度
  • 每月限制 — $60 的使用额度

Token 价格按每 1M tokens 列示。

模型输入输出缓存读取缓存写入每月限制
GLM-5.3-Flash$0.15$0.50$0.03-$60
GLM-5.3$1.40$4.40$0.26-$15
GLM-5.2$1.40$4.40$0.26-$60
GLM-5.1$1.40$4.40$0.26-$60
Kimi K3$3.00$15.00$0.30-$15
Kimi K2.7 Code$0.95$4.00$0.19-$60
Kimi K2.6$0.95$4.00$0.16-$60
LongCat-2.0$0.30$1.20$0.006-$60
MiMo V2.5$0.14$0.28$0.0028-$60
MiMo V2.5 Pro$0.435$0.87$0.003625-$15
MiniMax M3$0.30$1.20$0.06-$60
MiniMax M2.7$0.30$1.20$0.06$0.375$60
MiniMax M2.5$0.30$1.20$0.06$0.375$60
Muse Spark 1.3 Contributor$0.10$0.20$0.002-$60
Muse Spark 1.2 Contributor$0.10$0.20$0.002-$60
Qwen3.8 Max$2.00$6.00$0.25$2.50$15
Qwen3.8 Flash$0.15$0.47$0.016$0.20$30
Qwen3.7 Max$2.50$7.50$0.50$3.125$30
Qwen3.7 Plus (≤ 256K tokens)$0.40$1.60$0.04$0.50$60
Qwen3.7 Plus (> 256K tokens)$1.20$4.80$0.12$1.50$60
Qwen3.6 Plus (≤ 256K tokens)$0.50$3.00$0.05$0.625$60
Qwen3.6 Plus (> 256K tokens)$2.00$6.00$0.20$2.50$60
DeepSeek V4.1 Flash (Off-Peak)$0.15$0.60$0.003-$15 $60
4x · 9 月 20 日结束
DeepSeek V4.1 Flash (Peak)$0.30$1.20$0.006-$15 $60
4x · 9 月 20 日结束
DeepSeek V4 Pro (Off-Peak)$0.66$1.98$0.022-$15
DeepSeek V4 Pro (Peak)$1.32$3.96$0.044-$15
DeepSeek V4 Flash (Off-Peak)$0.15$0.60$0.003-$30
DeepSeek V4 Flash (Peak)$0.30$1.20$0.006-$30
DeepSeek V4 Flash Vision Exp (Off-Peak)$0.15$0.60$0.003-$15
DeepSeek V4 Flash Vision Exp (Peak)$0.30$1.20$0.006-$15
Hy4 preview$0.834$2.501$0.042-$30
Hy3$0.14$0.58$0.035-$60
Union Alpha FreeFreeFreeFree-无限制
限时
Grok 4.6 (≤ 200K tokens)$2.00$6.00$0.50-$15
Grok 4.6 (> 200K tokens)$4.00$12.00$1.00-$15
GPT 5.6 Luna (≤ 272K tokens)$0.20$1.20$0.02$0.25$15
GPT 5.6 Luna (> 272K tokens)$0.40$1.80$0.04$0.50$15

DeepSeek V4.1 Flash / V4 Pro / V4 Flash / V4 Flash Vision Exp: Peak 时段为周一至周五的 01:00-04:00 和 06:00-10:00 UTC;其他所有时段(包括周末)均为 Off-Peak。了解更多

DeepSeek V4 Flash Vision Exp: 图片会根据尺寸转换为 token,并与文本 token 一起按输入 token 计费。 了解更多

预估请求数

下表根据典型的 Go 使用模式提供了预估请求数:

Model每 5 小时请求数每周请求数每月请求数
GLM-5.3-Flash6,32015,79031,580
GLM-5.32205401,080
GLM-5.28802,1504,300
GLM-5.18802,1504,300
Kimi K3110250490
Kimi K2.7 Code1,3503,3806,750
Kimi K2.61,1502,8805,750
LongCat-2.011,40028,60057,200
MiMo-V2.530,10075,200150,400
MiMo-V2.5-Pro3,2508,15016,300
MiniMax M33,2008,00016,000
MiniMax M2.73,4008,50017,000
Muse Spark 1.3 Contributor45,300113,300226,600
Muse Spark 1.2 Contributor45,300113,300226,600
Qwen3.8 Max160400810
Qwen3.8 Flash5,40013,50027,000
Qwen3.7 Max170420840
Qwen3.7 Plus4,30010,80021,600
Qwen3.6 Plus3,3008,20016,300
DeepSeek V4.1 Flash
4x · 9 月 20 日结束
6,500
26,000
16,250
65,000
32,500
130,000
DeepSeek V4 Pro1,0502,6005,200
DeepSeek V4 Flash13,00032,50065,000
DeepSeek V4 Flash Vision Exp6,50016,25032,500
Hy4 preview1,3503,3806,770
Hy34,30010,75021,500
Union Alpha Free无限制无限制无限制
Grok 4.6169423845
GPT 5.6 Luna2,0505,10010,250

预估值采用以下每次请求的 token 数量;实际使用情况会有所不同。

  • Grok 4.6 — 每次请求 390 个输入 token,32,500 个缓存 token,120 个输出 token
  • GLM-5.3-Flash — 每次请求 1,000 个输入 token,55,000 个缓存 token,200 个输出 token
  • GLM-5.3/5.2/5.1 — 每次请求 700 个输入 token,52,000 个缓存 token,150 个输出 token
  • GPT 5.6 Luna — 每次请求 1,000 个输入 token,50,000 个缓存 token,220 个输出 token
  • Kimi K3 — 每次请求 1,050 个输入 token,76,500 个缓存 token,300 个输出 token
  • Kimi K2.7/K2.6 — 每次请求 870 个输入 token,55,000 个缓存 token,200 个输出 token
  • LongCat-2.0 — 每次请求 920 个输入 token,88,900 个缓存 token,200 个输出 token
  • DeepSeek V4.1 Flash — 每次请求 410 个输入 token,71,300 个缓存 token,310 个输出 token
  • DeepSeek V4 Pro — 每次请求 750 个输入 token,82,000 个缓存 token,290 个输出 token
  • DeepSeek V4 Flash — 每次请求 410 个输入 token,71,300 个缓存 token,310 个输出 token
  • DeepSeek V4 Flash Vision Exp — 每次请求 410 个输入 token,71,300 个缓存 token,310 个输出 token
  • MiMo-V2.5 — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token
  • MiMo-V2.5-Pro — 每次请求 790 个输入 token,86,000 个缓存 token,305 个输出 token
  • MiniMax M3 — 每次请求 510 个输入 token,56,000 个缓存 token,190 个输出 token
  • MiniMax M2.7 — 每次请求 300 个输入 token,55,000 个缓存 token,125 个输出 token
  • Muse Spark 1.3 Contributor — 每次请求 620 个输入 token,71,400 个缓存 token,300 个输出 token
  • Muse Spark 1.2 Contributor — 每次请求 620 个输入 token,71,400 个缓存 token,300 个输出 token
  • Qwen3.8 Max — 每次请求 420 个输入 token,66,000 个缓存 token,200 个输出 token
  • Qwen3.8 Flash — 每次请求 600 个输入 token,58,000 个缓存 token,200 个输出 token
  • Qwen3.7 Max — 每次请求 420 个输入 token,66,000 个缓存 token,200 个输出 token
  • Qwen3.7 Plus — 每次请求 500 个输入 token,57,000 个缓存 token,190 个输出 token
  • Qwen3.6 Plus — 每次请求 500 个输入 token,57,000 个缓存 token,190 个输出 token
  • Hy4 preview — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token
  • Hy3 — 每次请求 830 个输入 token,71,500 个缓存 token,295 个输出 token

你可以在 控制台 中跟踪你当前的使用情况。

使用限制可能会随着我们从早期使用和反馈中学习而发生变化。


超出限制的使用

如果你的 Zen 余额中还有积分,可以在控制台中启用 使用余额(Use balance) 选项。启用后,当你达到使用限制时,Go 会回退使用你的 Zen 余额,而不是拦截请求。


为什么某些模型的使用额度较低

使用 Go 时,你每月支付 $10,包含的每月使用额度因模型而异。

对于大多数模型,我们通过批量折扣和预留 GPU 容量来实现这一目标。然后,我们通过提高每月使用额度,将节省的成本回馈给你。

对于某些模型,我们还没有机会协商折扣或以更低的成本托管它们,这可能是因为模型较新,或者其公开价格已经是折扣价。

对于这些模型,你获得的使用额度仍会略高于直接向模型提供商付费;这就是它们包含的每月使用额度较低的原因。


API 端点

你也可以通过以下 API 端点访问 Go 模型。

模型模型 ID端点AI SDK 包
Grok 4.6grok-4.6https://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GPT 5.6 Lunagpt-5.6-lunahttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
GLM-5.3-Flashglm-5.3-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.3glm-5.3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.2glm-5.2https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
GLM-5.1glm-5.1https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K3kimi-k3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.7 Codekimi-k2.7-codehttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Kimi K2.6kimi-k2.6https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
LongCat-2.0longcat-2.0https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4.1 Flashdeepseek-v4.1-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Prodeepseek-v4-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flashdeepseek-v4-flashhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exphttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5mimo-v2.5https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiMo-V2.5-Promimo-v2.5-prohttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
MiniMax M3minimax-m3https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.7minimax-m2.7https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
MiniMax M2.5minimax-m2.5https://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Muse Spark 1.3 Contributormuse-spark-1.3-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Muse Spark 1.2 Contributormuse-spark-1.2-contributorhttps://opencode.ai/zen/go/v1/responses@ai-sdk/openai
Qwen3.8 Maxqwen3.8-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.8 Flashqwen3.8-flashhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Maxqwen3.7-maxhttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.7 Plusqwen3.7-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Qwen3.6 Plusqwen3.6-plushttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic
Hy4 previewhy4-previewhttps://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Hy3hy3https://opencode.ai/zen/go/v1/chat/completions@ai-sdk/openai-compatible
Union Alpha Freeunion-alphahttps://opencode.ai/zen/go/v1/messages@ai-sdk/anthropic

你的 OpenCode 配置中的 模型 ID 使用 opencode-go/<model-id> 格式。例如,对于 Kimi K3,你将在配置中使用 opencode-go/kimi-k3


模型

你可以从以下地址获取可用模型及其元数据的完整列表:

https://opencode.ai/zen/go/v1/models

隐私保护

模型模型训练数据留存
Grok 4.6不使用30 天
GPT 5.6 Luna不使用30 天
GLM-5.3-Flash不使用0 天
GLM-5.3不使用0 天
GLM-5.2不使用0 天
GLM-5.1不使用0 天
Kimi K3不使用0 天
Kimi K2.7 Code不使用0 天
Kimi K2.6不使用0 天
LongCat-2.0不使用0 天
MiMo-V2.5-Pro不使用0 天
MiMo-V2.5不使用0 天
Qwen3.8 Max不使用0 天
Qwen3.8 Flash不使用0 天
Qwen3.7 Max不使用0 天
Qwen3.7 Plus不使用0 天
Qwen3.6 Plus不使用0 天
MiniMax M3不使用0 天
MiniMax M2.7不使用0 天
Muse Spark 1.3 Contributor非 ZDR
Muse Spark 1.2 Contributor非 ZDR
DeepSeek V4.1 Flash不使用0 天
DeepSeek V4 Pro不使用0 天
DeepSeek V4 Flash不使用0 天
DeepSeek V4 Flash Vision Exp不使用0 天
Hy4 preview不使用0 天
Hy3不使用0 天
Union Alpha Free不使用0 天
  • Grok 4.6: ZDR 会禁用依赖所存储数据的重要 API 功能,包括有状态的 Responses API、Files and Collections 和 Batch API。了解更多
  • GPT 5.6 Luna: 所有 API 功能的使用都会生成滥用监控日志,并最多保留 30 天。了解更多
  • Muse Spark 1.3 Contributor: 以允许使用你的提示词和补全结果训练未来的 Meta 模型为交换,token 价格可获得大幅折扣。仅在 Meta 的地理使用政策允许的地区提供。了解更多
  • Muse Spark 1.2 Contributor: 以允许使用你的提示词和补全结果训练未来的 Meta 模型为交换,token 价格可获得大幅折扣。仅在 Meta 的地理使用政策允许的地区提供。了解更多
  • DeepSeek: ZDR 协议每月续签。当前协议有效期至 2026 年 9 月 30 日。

目标

我们创建 OpenCode Go 的目的是:

  1. 通过低成本订阅让更多人能够 无门槛地 使用 AI 编程。
  2. 为最佳开源编程模型提供 可靠的 访问。
  3. 精选经过 测试和基准评估,适合编程 Agent 使用的模型。
  4. 无锁定(no lock-in),允许你与 OpenCode 一起使用任何其他提供商。