知识库章节 ▾
导航
▸ 从这里开始 按角色类别
- Cursor + Gonka AI — 便宜的 LLM 用于编码
- Claude Code + Gonka AI — 终端的 LLM
- OpenClaw + Gonka AI — 可负担的 AI 代理
- OpenCode:在终端中使用自己的模型
- Continue.dev + Gonka AI — 适用于 VS Code/JetBrains 的 AI
- Cline + Gonka AI — VS Code 中的 AI 代理
- Aider + Gonka AI — 与 AI 结对编程
- LangChain + Gonka AI — 便宜的 AI 应用程序
- n8n + Gonka AI — 通过便宜的 AI 实现自动化
- Open WebUI + Gonka AI — 您的 ChatGPT
- LibreChat + Gonka AI — 开源 ChatGPT
- Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体
- Kilo Code + Gonka AI — VS Code 中的 AI 代理
- Roo Code + Gonka AI — VS Code 中的自主 AI 代理
- LlamaIndex + Gonka AI — 低成本的 RAG 应用程序
- PydanticAI + Gonka — 低成本的类型化 AI 代理
- Vercel AI SDK + Gonka AI — 低成本的 TypeScript AI 应用程序
- TanStack AI + Gonka — 低成本的 TypeScript AI 应用程序
- API 快速入门 — curl, Python, TypeScript
- JoinGonka Gateway - 全面概述
- 管理密钥 — Gonka 上的 SaaS
- 最便宜的AI API:2026年提供商对比
- 如何购买AI token和API密钥:2026年的3种方法
- Cursor Pro 请求限制已用尽 — 解析与廉价替代方案
- Claude Code 更便宜 — 账单解析与切换
- Cline 正在烧钱 — 为什么代理花费如此之多
- OpenClaw 成本高昂 —— 为什么 Agent 会疯狂消耗 Token 以及如何节省
- OpenRouter:廉价替代方案 — 与 JoinGonka Gateway 的对比
- 2026 年最佳编码 AI 模型:对比与定价
- GitHub Copilot 无限制低成本替代方案
- 无积分、无限制的廉价 Windsurf 替代方案
- 2026 年最便宜的 AI 代理 API
- ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — 使用自己的 endpoint 替代点数消耗
- GitHub Copilot BYOK — 使用自己的模型替代配额限制
- Zed + JoinGonka Gateway — 编辑器中的低成本推理
- Pi + JoinGonka Gateway — 基于低成本推理的终端代理
- Codex CLI:使用自己的密钥代替订阅
- DeepSeek Harness:通过 JoinGonka Gateway 连接自有提供商
- MiniMax Code:通过 Gonka 使用自备密钥运行 MiniMax 智能体
- Warp + JoinGonka Gateway — 在您端点上的终端代理
- Trae + JoinGonka Gateway — AI-IDE 中的 Gonka 网络模型
- Cherry Studio + JoinGonka Gateway — 桌面 AI 客户端
- omp (Oh My Pi) + JoinGonka Gateway:带模型角色的代理
- OpenHands + JoinGonka Gateway:专属 endpoint 上的智能体
- qwen-oauth 关闭后的 Qwen Code:通过 JoinGonka Gateway 工作
- Goose + JoinGonka Gateway:您的提供商和密钥到 keyring
- Crush + JoinGonka Gateway:基于 Gonka 网络模型的 Charm 代理
- Zoo Code + JoinGonka Gateway:从 Roo Code 迁移至 Gonka 模型
- Kimi Code CLI:通过 Gonka 使用您自己的密钥连接 Moonshot AI Agent
- Factory Droid + JoinGonka Gateway:在 Gonka 网络模型上使用 BYOK
- MiMo Code + JoinGonka Gateway:Gonka 网络模型上的 Xiaomi 代理
工具
Cherry Studio + JoinGonka Gateway — 桌面 AI 客户端
Cherry Studio 是一款适用于 Windows、macOS 和 Linux 的开源桌面 AI 客户端:提供助手聊天、多模型响应对比、智能体、知识库、翻译以及连接 MCP 服务器的功能。该项目以 AGPL-3.0 许可证发布,在 GitHub 上已获得超过 5 万颗星(2026 年 9 月)。该客户端的核心原则是使用您自己的密钥:由您决定通过哪些提供商进行推理(inference),而应用程序则为您提供统一的操作界面。
除了默认的提供商列表外,Cherry Studio 还支持 Custom Provider——即具有自定义地址的提供商。通过它,您可以连接 JoinGonka Gateway:这是一个与 OpenAI 兼容的 API,可接入去中心化 Gonka 网络的模型,并按网络的实时价格进行计费。注册并验证地址后,您的账户将获得 3M 免费 Token——您可以在首次充值前放心地试用该客户端。
本指南提供了针对当前 V2 系列的逐步配置说明(附带 V1 注意事项)、API Host 字段及其 # 符号规则的解析、模型选择、验证流程及常见错误说明。界面标注基于应用程序的英文版。
安装、版本与密钥
安装。各系统的构建包都在项目的 releases 页面上:Windows 有安装包和便携版,macOS 有 dmg 镜像,Linux 有 AppImage、deb 和 rpm——x64 和 ARM 架构齐全。对话历史和设置都保存在本地,也就是你自己的机器上。
V1 还是 V2。2026 年 8 月推出了 V2 系列,采用全新的数据结构和重新设计的设置界面;上一系列的最后版本是 1.9.13。两个系列都支持自定义服务商,但添加方式和部分文案有所不同——下文会标注这些差异。从 V1 升级到 V2 时,服务商和模型设置会自动迁移,原有 V1 数据会保留,但新数据不会反向同步,两个系列的备份也不兼容。升级前请先阅读 Cherry Studio 文档中的迁移章节。
JoinGonka 密钥。在网关上注册,打开后台的「API 密钥」板块,点击「创建密钥」。密钥以 jg- 开头,且只显示一次——请立即保存。建议为 Cherry Studio 单独创建一个密钥:在「用量」板块中,它的消耗会单独列出一行。
连接:自定义提供商与 API Host 字段
- 点击齿轮图标打开设置,选择 Model Provider 板块(英文文档中称为 Model Services)。
- 在提供商列表下方点击 Add Provider。
- 在 V2 中会弹出 Add Custom Provider 对话框。填写 Provider Name——例如
JoinGonka。在 Endpoint settings 区块中,把 OpenAI 一行填入地址https://gate.joingonka.ai/v1:字段下方会出现一行 Request path,显示最终路径——它必须以/v1/chat/completions结尾。在 API Key 字段中粘贴jg-your-key,然后点击 Add。 - 在 V1 中对话框更简短:提供商名称和 Provider Type——选择
OpenAI。密钥和地址在提供商页面上填写,即 API Key 和 API Host 字段。 - 确认提供商已启用:开关位于其页面右上角。在 V2 中,新增的提供商默认处于关闭状态,关闭状态的提供商下的模型不会出现在选择列表中。
Cherry Studio 如何拼接地址。 API Host 字段接收基础地址,路径由应用自行追加,并在字段下方的 Preview 行中显示结果。两个版本线的规则相同:
| 填入内容 | 请求发往何处 | 说明 |
|---|---|---|
https://gate.joingonka.ai/v1 | https://gate.joingonka.ai/v1/chat/completions | 推荐写法:地址中已包含版本号,只需追加路径 |
https://gate.joingonka.ai | 同一地址 | 地址中没有版本号——Cherry Studio 会自行添加 /v1 |
https://gate.joingonka.ai/v1/ | 同一地址 | 末尾的斜杠会被直接丢弃 |
https://gate.joingonka.ai/v1/chat/completions# | 地址原样,不带 # | 末尾的 # 会关闭版本号和路径的自动补全。对于网关来说这个技巧是多余的——它适用于路径不标准的服务 |
https://gate.joingonka.ai# | https://gate.joingonka.ai/chat/completions | 版本号未被添加,请求绕过了 API——网关会返回 405 |
在较早的说明中还有一条规则:地址末尾的斜杠似乎会关闭 /v1。这条规则在早期版本中生效,直到 1.6 版本线(含)为止,并在 1.7 中被移除:在当前版本中,只有 # 会关闭自动补全。
模型:列表、类型及默认模型
提供商已添加,但在对话中尚不可见:Cherry Studio 的选择列表中仅包含您手动添加的模型。有两种方式。
从服务器获取列表。 在提供商页面点击 Sync models(在 V1 中为 Manage,然后选择 Fetch model list)。Cherry Studio 将向网关发送 GET /v1/models 请求并显示实时网络模型列表;使用 + 按钮添加所需模型。 手动添加。 Add Model 按钮打开表单,其中必填项为 Model ID:标识符需逐字符准确输入。
网络模型的价格相同,因此建议全部添加 — 您将根据模型表现而非预算进行选择:
| 模型 | Model ID | 上下文与回复 | 在 Cherry Studio 中的适用场景 |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K,回复限 32768 tokens | 主力助手模型:处理长文档、大段代码、详尽回答和翻译 — 网络中回复上限最高 |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K,回复限 8192 tokens | 快速日常问答、草拟邮件、短文本修改;适合作为工具模型 |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K,回复限 8192 tokens | Reasoning 模型:回答前进行推理。分析复杂问题、制定计划、逻辑校验;响应较慢,回复配额部分用于推理过程 |
模型类型。 列表中的每个模型都有一个设置按钮,用于标注其能力:Vision, Reasoning, Tool 等。Cherry Studio 会自动标记部分能力,但对于网关模型,建议手动核对。应取消 Vision 勾选:网络模型仅支持文本。如果使用 MCP 工具,则需要开启 Tool — 表中所有模型均支持原生工具调用。Reasoning 适用于 GLM-5.3 Flash,因为它是网络中的推理模型。
默认模型。 在设置的 Default Model 部分,可指定功能角色的模型。建议将 DeepSeek V4 Flash 设置为主要助手模型。对于负责生成对话标题和准备搜索建议的快速模型,Cherry Studio 文档建议选择轻量级模型,而非推理模型 — 在网络模型中,MiniMax M2.7 最合适;不要设置 GLM-5.3 Flash,因为其推理过程是强制性的。翻译任务两者皆可。
检查与诊断
在提供商页面的密钥块中有一个 Model Check(模型检查)按钮(V1 版本中为密钥字段旁边的 Check)。选择一个模型——Cherry Studio 将向其发送一个简短的测试请求,并显示结果以及响应延迟。检查通过后,进入聊天界面,在模型切换器中选择网关模型,然后提出任何问题。
要确保请求确实通过了网关,请打开网关后台,进入“使用情况”部分:“按密钥”块中会显示 Cherry Studio 密钥的请求和最后访问时间,“按模型”块中会显示已选择的模型。V2 版本在 Usage 设置部分还有自己的客户端统计信息:按提供商、模型和密钥分类的令牌和请求。那里的费用仅供参考——Cherry Studio 是根据模型的公开价格估算的,而不是根据 Gonka 网络的价格,因此请查看网关后台以获取准确金额。
如果出现问题,原因几乎总是可以从响应中看出:
| 现象 | 含义 | 解决方法 |
|---|---|---|
401, Invalid API key | 网关未识别该密钥 | 检查密钥是否以 jg- 开头,粘贴时是否没有空格,并在“API 密钥”部分处于活动状态 |
404, Invalid URL (POST …) | 路径中包含多余的段。典型情况是在 API Host 中输入了没有 # 的完整路径,而 Cherry Studio 第二次添加了 /chat/completions | 在字段中保留基础地址 https://gate.joingonka.ai/v1,并对照预览字符串进行检查 |
405 Not Allowed 或返回 HTML | 请求未正确到达 API:地址以 # 结尾,且缺少 /v1 | 删除 # 或添加 /v1 |
429 | 模型过载:在高峰时段,网络中特定模型的容量可能已用尽 | 几秒钟后重试或切换到相邻模型;网络状态可在 状态页面 上查看 |
| 检查通过,但聊天中找不到模型 | 提供商已禁用或模型未添加到其列表中 | 启用提供商并通过 Sync models 或 Add Model 添加模型 |
| 密钥已输入,但聊天仍无响应 | 助手正在使用另一个未配置提供商的默认模型 | 在 Default Model 部分设置网关模型 |
| 对于 GLM-5.3 Flash,响应为空或中断 | 助手设置中的响应限制太小:推理过程包含在同一限制内 | 取消 Max tokens 限制或设置一个充裕的值——从 2000 个令牌起 |
| 模型回复说看不到图片 | 网络模型仅支持文本:网关用文本注释替换了图像 | 取消该模型的 Vision 选项;将图像任务分配给具有视觉功能的模型提供商——在 Cherry Studio 中,不同提供商可以平滑共存 |
费用说明
客户端本身免费使用,您只需为推理付费。通过 JoinGonka Gateway,输入端每百万个令牌收费 $0.0069,输出端每百万个令牌收费 $0.021——所有网络模型价格相同,并从此页面的实时来源获取。聊天消耗的令牌明显少于智能体工具,因此截至 2026 年 9 月,成本规模大致如下:
| 场景 | 消耗量 | 通过网关 |
|---|---|---|
| 十几次对话 | 10-30k 令牌 | 分之几美分 |
| 密集工作日:问题、翻译、文档分析 | 0.5-1M 令牌 | 不到一美分 |
| 月度日常使用 | 15-30M 令牌 | 几十美分 |
关于长对话的重要声明:每次回复时,客户端都会将整个历史记录发送回模型,因此第一百次回复的成本比第一次更高。解决方法是针对新任务开启新对话;在 Cherry Studio 中,这只是一个按钮的事。
| 方式 | 支付方式 | 您获得什么 |
|---|---|---|
| 聊天服务订阅 | 每月固定金额 | 其界面内某个厂商的模型,有套餐限制 |
| Cherry Studio + 厂商密钥 | 按厂商价格按令牌付费 | 本地拥有自己的界面和历史记录;费用随使用量增加 |
| Cherry Studio + JoinGonka Gateway | 按网络价格按令牌付费,从网关余额扣除 | 统一价格使用网络模型,按天、密钥和模型查看使用情况 |
该组合的其他优势
在同一个对话中比较模型。 Cherry Studio 可以同时向多个模型提问:在模型切换器中选择它们,每个模型都会通过单独的请求进行响应。由于网络中所有模型采用统一价格,这是了解在自己的任务中何时满足于 MiniMax M2.7、何时需要 DeepSeek V4 Flash 的长回复、以及何时 GLM-5.3 Flash 的推理能力物有所值(其设置已在 模型综述 中分析)的最快方法。
使用相同密钥的第二个协议。 网关也支持 Anthropic 格式。在 V2 对话的 Endpoint settings 模块中有一个单独的 Anthropic 行:在其中填入 https://gate.joingonka.ai,此时 Request path 行应显示为 /v1/messages。在 V1 中,通过 Provider Type 为 Anthropic 且地址相同的单独提供程序即可实现相同结果。在 V2 的 More options 按钮下还有一个 OpenAI Responses 行,网关同样支持,地址与主要的 OpenAI 行相同。
运行终端代理。 在 Code CLI 页面(文档中称为 Coding Companion)上,Cherry Studio 会安装并运行控制台代理,并从其设置中为它们提供提供程序和模型;该列表中的提供程序根据特定工具所需的协议进行过滤。因此,如果您打算从这里运行 Claude Code,请提前填写 Anthropic 地址。关于如何在没有中介的情况下配置同一代理,请参考 Claude Code + Gonka 指南。
知识库。 在 V2 中,即使没有嵌入模型,它也能通过 BM25 文本搜索工作,而使用嵌入模型时则会启用混合搜索。Gonka 网络模型是生成式的,因此对于混合模式,请使用来自其他提供程序的嵌入模型,例如通过 Ollama 使用本地模型;届时,网关模型将根据找到的片段进行回答。
需要浏览器中的团队共享聊天功能吗? Cherry Studio 是个人桌面客户端。如果需要带有账户功能的共享 Web 界面,请查看 Open WebUI:它可以使用相同的地址和密钥连接到网关。