知识库章节 ▾
导航
▸ 从这里开始 按角色类别
- Cursor + Gonka AI — 便宜的 LLM 用于编码
- Claude Code + Gonka AI — 终端的 LLM
- OpenClaw + Gonka AI — 可负担的 AI 代理
- OpenCode:在终端中使用自己的模型
- Continue.dev + Gonka AI — 适用于 VS Code/JetBrains 的 AI
- Cline + Gonka AI — VS Code 中的 AI 代理
- Aider + Gonka AI — 与 AI 结对编程
- LangChain + Gonka AI — 便宜的 AI 应用程序
- n8n + Gonka AI — 通过便宜的 AI 实现自动化
- Open WebUI + Gonka AI — 您的 ChatGPT
- LibreChat + Gonka AI — 开源 ChatGPT
- Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体
- Kilo Code + Gonka AI — VS Code 中的 AI 代理
- Roo Code + Gonka AI — VS Code 中的自主 AI 代理
- LlamaIndex + Gonka AI — 低成本的 RAG 应用程序
- PydanticAI + Gonka — 低成本的类型化 AI 代理
- Vercel AI SDK + Gonka AI — 低成本的 TypeScript AI 应用程序
- TanStack AI + Gonka — 低成本的 TypeScript AI 应用程序
- API 快速入门 — curl, Python, TypeScript
- JoinGonka Gateway - 全面概述
- 管理密钥 — Gonka 上的 SaaS
- 最便宜的AI API:2026年提供商对比
- 如何购买AI token和API密钥:2026年的3种方法
- Cursor Pro 请求限制已用尽 — 解析与廉价替代方案
- Claude Code 更便宜 — 账单解析与切换
- Cline 正在烧钱 — 为什么代理花费如此之多
- OpenClaw 成本高昂 —— 为什么 Agent 会疯狂消耗 Token 以及如何节省
- OpenRouter:廉价替代方案 — 与 JoinGonka Gateway 的对比
- 2026 年最佳编码 AI 模型:对比与定价
- GitHub Copilot 无限制低成本替代方案
- 无积分、无限制的廉价 Windsurf 替代方案
- 2026 年最便宜的 AI 代理 API
- ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — 使用自己的 endpoint 替代点数消耗
- GitHub Copilot BYOK — 使用自己的模型替代配额限制
- Zed + JoinGonka Gateway — 编辑器中的低成本推理
- Pi + JoinGonka Gateway — 基于低成本推理的终端代理
- Codex CLI:使用自己的密钥代替订阅
- DeepSeek Harness:通过 JoinGonka Gateway 连接自有提供商
- MiniMax Code:通过 Gonka 使用自备密钥运行 MiniMax 智能体
- Warp + JoinGonka Gateway — 在您端点上的终端代理
- Trae + JoinGonka Gateway — AI-IDE 中的 Gonka 网络模型
- Cherry Studio + JoinGonka Gateway — 桌面 AI 客户端
- omp (Oh My Pi) + JoinGonka Gateway:带模型角色的代理
- OpenHands + JoinGonka Gateway:专属 endpoint 上的智能体
- qwen-oauth 关闭后的 Qwen Code:通过 JoinGonka Gateway 工作
- Goose + JoinGonka Gateway:您的提供商和密钥到 keyring
- Crush + JoinGonka Gateway:基于 Gonka 网络模型的 Charm 代理
- Zoo Code + JoinGonka Gateway:从 Roo Code 迁移至 Gonka 模型
- Kimi Code CLI:通过 Gonka 使用您自己的密钥连接 Moonshot AI Agent
- Factory Droid + JoinGonka Gateway:在 Gonka 网络模型上使用 BYOK
- MiMo Code + JoinGonka Gateway:Gonka 网络模型上的 Xiaomi 代理
工具
qwen-oauth 关闭后的 Qwen Code:通过 JoinGonka Gateway 工作
Qwen Code (命令 qwen) 是阿里巴巴 Qwen 团队开发的用于开发的开源终端代理:它可以理解项目、编辑文件、运行命令和测试——从终端、编辑器或脚本中操作。该项目源自 Google Gemini CLI 并独立发展,代码在 Apache-2.0 许可下开源。该代理支持多种协议——OpenAI、Anthropic、Gemini——因此几乎任何模型提供商都可以连接到它。
之前,通过 qwen.ai 账号的免费登录(即 qwen-oauth 授权类型)允许在没有密钥的情况下使用 Qwen Code。2026 年 4 月 15 日,该免费层级已关闭,但默认行为保持不变:如果未选择授权类型,Qwen Code 会默认为此类型,而旧的安装会返回 Qwen OAuth free tier was discontinued on 2026-04-15 字符串。文档建议切换到其他提供商,最简单的方法是通过 OpenAI 兼容的端点。
JoinGonka Gateway 正是这样一个端点:通过它,Qwen Code 可以在去中心化的 Gonka 网络模型(DeepSeek V4 Flash、GLM-5.3 Flash 和 MiniMax M2.7)上运行,价格统一为每百万输入代币 $0.0069,无需订阅。网络中目前没有自有的 Qwen 模型,但代理不需要它:它适用于任何能够调用工具的模型。以下命令和消息已通过 2026 年 9 月 23 日的 Qwen Code 0.24.4 网关实时运行验证。确认地址后,您的账户将收到 3M 免费代币——足够您自己重复整个过程。
快速入门:安装及单条命令
第 1 步:安装 Qwen Code。官方方式见项目 README:
# Linux and macOS: standalone build with its own Node.js
curl -fsSL https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.sh | bash
# Windows (PowerShell)
irm https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.ps1 | iex
# npm (requires Node.js 22 or newer)
npm install -g @qwen-code/qwen-code@latest
# Homebrew
brew install qwen-code脚本会把命令放到 ~/.local/bin/qwen,并在需要时把该路径追加到 shell 配置文件中。重新打开终端并检查:qwen --version。
第 2 步:获取密钥。在 gate.joingonka.ai/register 注册,验证邮箱地址,然后在「API 密钥」板块创建一个以 jg- 为前缀的密钥。
第 3 步:运行安装程序。
npx @joingonka/setup --tool qwen-code安装程序会询问密钥(不会通过命令行参数传递,以免残留在 shell 历史记录中),并编辑 ~/.qwen/settings.json —— Qwen Code 文档推荐用于「单文件」配置的文件:
- 把密钥写入该文件自身的
env块中,命名为JOINGONKA_API_KEY—— 这也是内置/auth命令存放密钥的位置;文件将获得600权限,shell 环境保持不变; - 把网络中的模型添加到
modelProviders.openai列表 —— 包含网关地址、真实的上下文窗口和响应上限;该列表中您其他提供商的条目会保留; - 如果授权类型未选择或仍指向已关闭的
qwen-oauth,会将其切换为openai,并把 DeepSeek V4 Flash 设为默认模型;如果已有效选择了其他类型 ——anthropic、gemini、vertex-ai—— 则在没有--model标志的情况下不会改动; - 保存原文件的副本,不改动注释和其他设置,最后向网关发送实时请求,并告知密钥、地址和模型是否被接受。
以下是仍保留 qwen-oauth 的安装输出示例(已精简):
Configured ~/.qwen/settings.json
Base URL: https://gate.joingonka.ai/v1
Default model: deepseek-ai/DeepSeek-V4-Flash-0731 (replaces qwen-oauth — that free tier was discontinued on 2026-04-15)
Switched Qwen Code to JoinGonka (auth type "openai") — this replaced your previous auth type "qwen-oauth".
To go back: run /auth (and /model) inside Qwen Code, or restore ~/.qwen/settings.json.bak.2026-09-23T04-22-32-159Z.
…
✓ Verified: the gateway accepted the key, base URL and model.通过 --model 标志可以指定其他默认模型:缩写 glm、minimax 或完整标识符;显式指定的模型始终会被写入。无交互模式从环境变量中获取密钥:
JOINGONKA_API_KEY=jg-your-key npx @joingonka/setup --tool qwen-code --model glm --non-interactive通过 QWEN_HOME 变量迁移的目录,安装程序会自动找到。再次运行会更新模型目录,但会保留您选择的网络模型:Kept your current default model。
手动配置:settings.json
安装程序所做的一切都可以手动完成。文件是 ~/.qwen/settings.json(或 $QWEN_HOME/settings.json);Qwen Code 将其作为带注释的 JSON 读取。以下是 Gonka 网络的完整可用配置:
{
"env": { "JOINGONKA_API_KEY": "jg-your-key" },
"modelProviders": {
"openai": [
{ "id": "deepseek-ai/DeepSeek-V4-Flash-0731", "name": "DeepSeek V4 Flash (Gonka)",
"baseUrl": "https://gate.joingonka.ai/v1", "envKey": "JOINGONKA_API_KEY",
"generationConfig": { "contextWindowSize": 380000, "samplingParams": { "max_tokens": 32768 } } },
{ "id": "zai-org/GLM-5.3-Flash", "name": "GLM 5.3 Flash (Gonka)",
"baseUrl": "https://gate.joingonka.ai/v1", "envKey": "JOINGONKA_API_KEY",
"generationConfig": { "contextWindowSize": 390000, "samplingParams": { "max_tokens": 8192 } } },
{ "id": "MiniMaxAI/MiniMax-M2.7", "name": "MiniMax M2.7 (Gonka)",
"baseUrl": "https://gate.joingonka.ai/v1", "envKey": "JOINGONKA_API_KEY",
"generationConfig": { "contextWindowSize": 200000, "samplingParams": { "max_tokens": 8192 } } }
]
},
"security": { "auth": { "selectedType": "openai" } },
"model": { "name": "deepseek-ai/DeepSeek-V4-Flash-0731", "baseUrl": "https://gate.joingonka.ai/v1" }
}| 字段 | 值 | 关键点 |
|---|---|---|
env.JOINGONKA_API_KEY | jg-… 密钥 | 密钥本身。模型条目没有存放密钥的字段——它通过 envKey 引用这个变量 |
baseUrl | https://gate.joingonka.ai/v1 | 末尾带 /v1:/chat/completions 路径由 Qwen Code 自动补全。openai 列表键本身就是 Chat Completions 协议 |
contextWindowSize | 模型窗口 | 没有它,Qwen Code 会根据模型名称估算窗口;它依据这个数字决定何时压缩历史记录 |
samplingParams.max_tokens | 回复上限 | 固定回复上限。没有它,一旦触及上限,Qwen Code 可能会以 64K 起的限额重发请求——高于网络中任何模型的上限 |
security.auth.selectedType | openai | 启动时启用哪个协议;没有该字段,Qwen Code 会退回到封闭的 qwen-oauth |
model.name、model.baseUrl | 默认模型及其地址 | 两者一起明确指向网关条目,即使同 id 的模型在另一个提供商处也有配置 |
密钥放在哪里。 Qwen Code 按顺序查找 envKey 变量的值:shell 环境,然后是找到的第一个 .env(.qwen/.env,或从当前目录向上找到的 .env,之后是 ~/.qwen/.env 和 ~/.env),最后才是文件中的 env 块。由此产生最大的坑:shell 中导出的、值为旧值的 JOINGONKA_API_KEY 会覆盖文件——我们特意测试过,在 settings.json 中密钥正确的情况下仍然得到 401 Invalid API key。当安装程序在环境中看到不同的值时,会发出警告。
还有关于项目的说明:带自有 modelProviders 的项目级 .qwen/settings.json 不会补充主目录中的列表,而是替换它——在这样的项目中,网关模型会从 /model 中消失。完全不要把密钥放进项目文件:它会随文件一起进入仓库。
正在运行的会话无需重启即可接受对 modelProviders 的修改——重新打开 /model 即可。没有编辑器时,/auth → Custom Provider 向导也能做同样的事。
授权与模型:Qwen Code 如何选择工作模型
Qwen Code 有两个独立的选择:授权类型(决定启用哪个协议以及从哪里获取密钥)和模型。类型存储在 security.auth.selectedType 中,安装程序的行为取决于此设置:
selectedType 的值 | 安装程序的操作 |
|---|---|
空或 qwen-oauth | 安装 openai 和 Gonka 网络默认模型;私有套餐不被视为有效选择,但安装程序会提示已替换及恢复方法 |
openai | 保留已选择的模型(网关或其他提供商),仅更新目录 |
anthropic, gemini, vertex-ai | 不做更改:这是工作配置。若使用 --model 标志,它会切换并说明如何恢复原状 |
在会话中,可以通过 /model 命令更改模型。在我们的运行测试中,它显示了所有带有协议标签的网关记录,并在列表下方显示上下文窗口、基础 URL 和密钥的环境变量名称:
Select Model
1. [openai] MiniMax M2.7 (Gonka) (MiniMaxAI/MiniMax-M2.7)
› 2. [openai] DeepSeek V4 Flash (Gonka) (deepseek-ai/DeepSeek-V4-Flash-0731)
3. [openai] GLM 5.3 Flash (Gonka) (zai-org/GLM-5.3-Flash)
Modality: text-only
Context Window: 380,000 tokens
Base URL: https://gate.joingonka.ai/v1
API Key: JOINGONKA_API_KEY/model 的选择会在会话间持久保留。对于单次启动,模型可通过带有标识符的 -m 标志设置:qwen -m zai-org/GLM-5.3-Flash。用于提示词和权限分类的单独轻量级模型通过 /model --fast 设置;只要该模型不存在,此工作就由主模型处理。
如何选择模型。 网络中所有模型的价格相同,因此选择取决于行为模式。这是它们在 Qwen Code 0.24.4 中处理相同任务(读取文件并查找错误)时的表现(核对日期:2026年9月23日):
| 模型 | 上下文 / 回复 | 在 Qwen Code 中的表现 |
|---|---|---|
| DeepSeek V4 Flash | 380K / 32768 | 安装程序的选择:大窗口和网络中最高的回复上限。分两步解决了任务 |
| GLM-5.3 Flash | 390K / 8192 | 推理模型:最准确的回复;推理过程以单独流的形式出现并计入回复限制 |
| MiniMax M2.7 | 200K / 8192 | 分两步在约7秒内给出正确答案;推理过程以单独流的形式出现,且不会进入回复文本 |
GLM-5.3 Flash 的推理。 安装程序为每个模型提供 samplingParams,但在这种情况下,Qwen Code 不会在请求中添加推理级别:/effort 命令无法到达网络模型,GLM-5.3 Flash 始终会进行思考。如果需要切换开关,请直接在模型记录中声明级别:
{
"id": "zai-org/GLM-5.3-Flash",
"capabilities": {
"reasoning": { "profile": "openai-effort", "efforts": ["low", "high"], "defaultEffort": "high" }
},
…
}届时 Qwen Code 将开始发送 reasoning_effort,对于 GLM-5.3 Flash,low 值会完全关闭推理——详细信息请参阅模型概览。在我们使用 "defaultEffort": "low" 的测试中,Qwen Code 发送了 reasoning_effort: "low",模型给出的回复中不包含推理块。
检查:预期发生的情况
最快的验证方式是一次性试运行。在一个空目录中放入 calc.py,其中包含一个实际上做减法的加法函数,然后让它找出 bug:
qwen -p "Read calc.py and tell me in one sentence whether it has a bug."智能体应自行调用读取工具并给出实质回答。GLM-5.3 Flash 是这样回答的(使用 -m zai-org/GLM-5.3-Flash 启动):
Yes, there is a bug: the `add` function subtracts instead of adding (`return a - b`), so `print(add(2, 3))` prints `-1` instead of `5`.在界面中(不带参数的 qwen),顶栏会显示所选模型——API Key | DeepSeek V4 Flash (Gonka)——同样的请求会这样执行:
> Read calc.py and tell me in one sentence whether it has a bug.
✓ Read calc.py, README.md
◆ Yes, calc.py has a bug: the add function returns the difference (a - b) instead of the sum (a + b). …
➜ demo · DeepSeek V4 Flash (Gonka) · 380.0k Context 5.1% used/stats 命令会按模型显示请求数和 token 数,网关控制台的“使用情况”版块也会显示相同的用量。
-p 中的审批模式。不带任何标志时,一次性运行会进入 Ask Permissions 模式:没有人可以确认,因此需要许可的工具——shell 命令、文件编辑和写入——根本不会传给模型。在我们的试运行中,当被要求执行 ls 时,智能体回答说它没有这样的工具。要进行编辑,请添加 --approval-mode auto-edit;要执行命令,请添加 --yolo;后者会伴随 Qwen Code 的警告,提示沙箱未启用。
如果出了问题,诊断通常可以从报错信息中直接读出:
| 看到什么 | 这意味着什么 | 该怎么做 |
|---|---|---|
No auth type is selected. Please configure an auth type … | 未选择授权类型 | 运行安装程序,或像上面的示例一样写入 "selectedType": "openai" |
Qwen OAuth free tier was discontinued on 2026-04-15 … | 设置中仍保留着已关闭的 qwen-oauth | 运行安装程序:它会切换类型并告诉你替换了什么 |
[API Error: 401 Invalid API key] | 网关未接受该密钥 | 检查 env 块,以及 shell 或 .env 中是否存在带有旧值的 JOINGONKA_API_KEY 变量:它的优先级高于文件 |
429 Model "…" is currently overloaded in the Gonka network (rate limit) | 该模型在网络中的空闲容量已用尽 | 过一分钟重试或更换模型;状态可在状态页面查看 |
Request timeout after 151s …,然后是 Retrying provider attempt | 网络在负载下未能在两分半钟内开始响应 | Qwen Code 会自行重试请求;如果拖得太久,请更换模型 |
费用说明
Agent 消耗 Token 的方式与聊天不同:对于你的每一句话,Qwen Code 都会添加系统提示词和工具描述,并且任务需要多个轮次才能完成。在我们的运行测试中,每个 qwen -p 请求在进入主题之前就携带了大约 13,000 个输入 Token,而“读取文件,查找错误”则花费了两个轮次和大约 27,000 个 Token。界面中的工具更多,在回答之后,Qwen Code 会使用相同的模型执行服务请求——例如,后续回复提示:/stats 显示相同任务进行了 4 次请求,消耗约 79,000 个输入 Token。
通过 JoinGonka Gateway,Token 的价格为每百万输入 $0.0069,每百万输出 $0.021——所有网络模型的价格相同,并从实时源填入此页面。
| 场景 | 消耗 | 通过 Gateway |
|---|---|---|
qwen -p 中的单次任务:读取文件,查找错误 | ~27K Token | 几美分 |
| 界面中的相同任务,带有服务请求 | ~79K Token | 几美分 |
| 活跃工作日 | 3-7M Token | 几美分 |
| 活跃开发月 | ~150M Token | 大约一美元 |
右侧列的估算基于 2026 年 9 月的价格。作为对比,在 Qwen Code 中付费的方式如下:
| 方式 | 计费模型 | 限制 |
|---|---|---|
qwen-oauth | 曾经免费 | 2026 年 4 月 15 日关闭 |
| Alibaba Cloud Coding Plan | 固定月费 | 供应商侧配额,独立的 sk-sp-… 密钥 |
| Alibaba Cloud Token Plan | 按 Token 付费,适用于团队和公司 | 区域终端节点和 Alibaba Cloud 密钥 |
| JoinGonka Gateway | 按 Token 付费,预付余额 | 后台可见消耗;无订阅和月度配额 |
服务请求可以在不需要的地方关闭:后续回复提示 —— "ui": { "enableFollowupSuggestions": false },后台自动记忆 —— "memory": { "enableManagedAutoMemory": false, "enableManagedAutoDream": false }。精确的消耗和余额在后台的“使用情况”和“账单”部分中可见。为何默认选择 DeepSeek V4 Flash,详见模型概览。
工作中的注意事项
审批模式。 在 Qwen Code 界面中,它以 Auto 模式启动:项目内的读取、搜索和编辑被立即允许,而 Shell 命令和其他风险操作由分类器评估——即对模型的单独请求。其他模式——Plan、Ask Permissions、Auto-Edit 和 YOLO——可以通过 Shift+Tab(Windows 上为 Tab)或 /approval-mode 命令切换;默认模式由 tools.approvalMode 密钥设置。
后台工作。 默认情况下,Qwen Code 会进行自动记忆:在对话结束后,它会在后台提取关于项目和您的偏好的笔记,并每天清理一次(Dream)——使用相同的模型。在单次运行中,这一点很明显:qwen -p 在回答后可能会再持续运行几分钟,直到后台任务完成等待模型。对于脚本和 CI,请关闭自动记忆(密钥见上文)并设置运行上限:--max-wall-time, --max-session-turns, --max-tool-calls。
图片。 网络模型为纯文本(/model 中显示 Modality: text-only)。对于截图,请使用 /model --vision 命令指定其他供应商的中介模型:它会将图片转换为文本叙述,然后主要模型继续工作。
统计数据。 Qwen Code 默认发送匿名使用统计;使用 "privacy": { "usageStatisticsEnabled": false } 可将其关闭。网关不存储提示词和回答的内容——仅存储消耗汇总。
网络邻居。 网络所服务的模型所属实验室也发布了自己的 Agent:DeepSeek 有 DeepSeek Harness,MiniMax 有 MiniMax Code,Z.ai(GLM 的作者)有 ZCode。它们都使用相同的密钥连接到同一个网关,并消耗同一个余额。
qwen-oauth 关闭后,它需要自己的模型提供商。快捷路径是执行 npx @joingonka/setup --tool qwen-code:安装程序会将 Key 写入 ~/.qwen/settings.json 文件的 env 块,将 DeepSeek V4 Flash、GLM-5.3 Flash 和 MiniMax M2.7 添加到具有真实限额的 modelProviders.openai 中,将 security.auth.selectedType 切换为 openai,并用实时请求验证连接。网络中的所有三个模型均可使用:默认设置为 DeepSeek V4 Flash,GLM-5.3 Flash 和 MiniMax M2.7 可通过 /model 命令选择。验证方式是使用 qwen -p 测试含错误的文件并查看后台的“使用量”部分;按 Gonka 网络统一价格为实际消耗的 token 付费。