知识库章节 ▾
导航
▸ 从这里开始 按角色类别
- Cursor + Gonka AI — 便宜的 LLM 用于编码
- Claude Code + Gonka AI — 终端的 LLM
- OpenClaw + Gonka AI — 可负担的 AI 代理
- OpenCode:在终端中使用自己的模型
- Continue.dev + Gonka AI — 适用于 VS Code/JetBrains 的 AI
- Cline + Gonka AI — VS Code 中的 AI 代理
- Aider + Gonka AI — 与 AI 结对编程
- LangChain + Gonka AI — 便宜的 AI 应用程序
- n8n + Gonka AI — 通过便宜的 AI 实现自动化
- Open WebUI + Gonka AI — 您的 ChatGPT
- LibreChat + Gonka AI — 开源 ChatGPT
- Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体
- Kilo Code + Gonka AI — VS Code 中的 AI 代理
- Roo Code + Gonka AI — VS Code 中的自主 AI 代理
- LlamaIndex + Gonka AI — 低成本的 RAG 应用程序
- PydanticAI + Gonka — 低成本的类型化 AI 代理
- Vercel AI SDK + Gonka AI — 低成本的 TypeScript AI 应用程序
- TanStack AI + Gonka — 低成本的 TypeScript AI 应用程序
- API 快速入门 — curl, Python, TypeScript
- JoinGonka Gateway - 全面概述
- 管理密钥 — Gonka 上的 SaaS
- 最便宜的AI API:2026年提供商对比
- Cursor Pro 请求限制已用尽 — 解析与廉价替代方案
- Claude Code 更便宜 — 账单解析与切换
- Cline 正在烧钱 — 为什么代理花费如此之多
- OpenClaw 成本高昂 —— 为什么 Agent 会疯狂消耗 Token 以及如何节省
- OpenRouter:廉价替代方案 — 与 JoinGonka Gateway 的对比
- 2026 年最佳编码 AI 模型:对比与定价
- GitHub Copilot 无限制低成本替代方案
- 无积分、无限制的廉价 Windsurf 替代方案
- 2026 年最便宜的 AI 代理 API
- ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — 使用自己的 endpoint 替代点数消耗
- GitHub Copilot BYOK — 使用自己的模型替代配额限制
- Zed + JoinGonka Gateway — 编辑器中的低成本推理
- Pi + JoinGonka Gateway — 基于低成本推理的终端代理
- Codex CLI:使用自己的密钥代替订阅
工具
Codex CLI:使用自己的密钥代替订阅
Codex CLI 是一个直接驻留在终端中的 OpenAI 代理助手:它读取项目文件、在沙箱中运行命令、修改代码并解释其所做的操作。它通常通过 ChatGPT 订阅访问 OpenAI 模型,但你可以将其提供商替换为你自己的 — 此时相同的场景将由 Gonka 网络处理。
有一个细微差别使 Codex 在代理工具中显得与众不同:它不是使用常见的 Chat Completions,而是使用 Responses API — OpenAI 的新协议。正因如此,以前无法将其连接到第三方网关。JoinGonka Gateway 自 2026 年 8 月 22 日起开始接受 Responses,下文描述的一切均已通过实时运行验证,而非文档复述。
Codex CLI 是什么以及它与聊天的区别
Codex 不仅仅是编辑器中的建议工具,更是一个独立的执行者。你用语言陈述任务,它自行决定读取哪些文件、执行哪些命令以及进行哪些更改。它拥有大约十几种工具:运行命令、读取文件、维护工作计划、请求用户澄清以及为子任务生成子代理。
两种工作模式。交互式 — 不带参数的 codex,在终端中进行对话并显示每一步。非交互式 — codex exec "task",运行一次直到得出结果:方便在脚本和 CI 中使用。
内置安全性:默认情况下,代理在沙箱中运行并在进行更改前请求确认。控制级别可在配置中设置 — 从“询问所有事项”到具有工作目录写入权限的全自动运行。
另一个特点是对话状态。Codex 不要求服务器记住任何内容:它自己保留整个对话流,并在每一步随请求一并发送。对你而言,这意味着通信不会留存在模型提供商端,更改端点也不会中断正在进行的会话。
与 Claude Code 及其他终端代理的区别恰恰在于协议。Codex 通过 Responses API 与模型通信,其中对话不是描述为简单的消息列表,而是元素流:文本、工具调用、调用结果、推理块。对于工具而言,这提供了更严格的对话模型,而对于你而言,则需要一个理解该协议的端点。
连接:修改一次 config.toml
Codex 将设置存储在 ~/.codex/config.toml 中。你的自定义提供商由 [model_providers.*] 块描述,其中的关键字段是 wire_api:没有它,Codex 将尝试使用 Chat Completions,并无法组装代理循环。
# ~/.codex/config.toml
model_provider = "joingonka"
model = "deepseek-ai/DeepSeek-V4-Flash-0731"
[model_providers.joingonka]
name = "JoinGonka Gateway"
base_url = "https://gate.joingonka.ai/v1"
env_key = "JOINGONKA_API_KEY"
wire_api = "responses"密钥不会写入文件:env_key 指定了 Codex 获取它的环境变量名称。变量名是唯一的,而不是 OPENAI_API_KEY — 因此该设置不会拦截你其他使用 OpenAI 的工具。
export JOINGONKA_API_KEY=jg-your-keymodel 字段设置默认模型,而 model_provider 设置要使用的块。两者都可以在启动时覆盖,因此一个配置可以轻松服务于多个提供商:生产、实验和备用。
密钥在注册后的个人中心发放,在那里也可以查看余额和使用情况。如果你不想触碰全局配置,可以通过 -c 传递相同的块:codex -c model_provider=joingonka …。若要保持多个独立的配置,请通过 CODEX_HOME 变量指定设置目录。
验证:应该发生什么
确保连接正常的最快方法是进行一次性测试运行:
codex exec "用一行回答:17*3等于多少?"在响应头部,Codex 会打印它正在与谁协作:model、provider: joingonka、沙箱模式和会话 ID。如果那里显示了您的提供商并且底部收到了响应,说明连接是活跃的。
接下来,您应该测试 Codex 的核心功能——处理文件。在目录中放入一个带有明显错误的小文件,并要求它找到该错误:
codex exec "读取 calc.py 并用一句话告诉我是否有错误。"代理应该自动调用读取工具、打开文件并给出实质性回答——指出行号。如果发生了这种情况,说明完整的代理循环(请求 → 工具调用 → 结果 → 回答)已通过网关正确构建。
如果出现问题,通常可以直接从消息中读取诊断信息:
| 可见内容 | 含义 | 处理方式 |
|---|---|---|
401 Unauthorized: Invalid API key | Codex 未找到密钥或密钥错误 | 验证 env_key 中的变量确实在当前 shell 中导出,并且其名称与配置匹配 |
404 on /responses | base_url 中缺少后缀 | 地址必须以 /v1 结尾——Codex 会自动追加 /responses |
| 模型有响应,但不调用工具 | 未设置 wire_api,对话使用旧协议 | 在提供商块中添加 wire_api = \"responses\" |
Reconnecting… 1/5 | Codex 正在自动重试请求 | 瞬时网络错误的常规行为;如果重试耗尽,请查看下方的错误文本 |
| 关于 bubblewrap 的警告 | 系统中缺少隔离包 | 不影响操作:Codex 将使用内置副本。为保持整洁,请通过包管理器安装 bubblewrap |
会话中的第一个请求可能需要几秒钟:Codex 会发送一个较大的系统提示词和所有工具的描述,网络节点需要接收任务。随后的响应速度会更快。
如何选择模型
所有网络模型价格统一,因此选择取决于行为而非预算。以下是在 Codex 上通过每个模型运行同一任务(读取文件并查找其中的错误)的实际结果。
| 模型 | 标识符 | 上下文 | 在 Codex 中的表现 |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 响应清晰且切中要点,指明文件和行号。拥有网络中最长的上下文和 32768 token 的响应上限——为大型代码仓库预留了空间 |
| Kimi K2.6 | moonshotai/Kimi-K2.6 | 200K | 三者中表述最简洁,调用工具果断 |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K | 能正确完成任务,但有时会自言自语——在终端中看起来显得冗长 |
默认推荐使用 DeepSeek V4 Flash:代理工作很快会达到上下文上限,而 380K token 使其能够同时处理大量文件。如果需要极致简短的回答,请选择 Kimi K2.6。可以通过修改配置中的 model 行或使用 -c model=… 标志来切换模型,无需编辑文件。
网络模型的最新列表始终可通过 GET https://gate.joingonka.ai/v1/models 获取。
费用说明
代理工具消耗 token 的方式与聊天不同:Codex 会为你每一句话添加系统提示词和所有工具的描述,然后与模型进行多轮对话。在实际运行中,像“读取文件并找到错误”这样的简单任务花费了约 18,000 到 20,000 个 token。这是为自主性支付的正常费用,因此单价非常关键。
通过 JoinGonka Gateway,token 价格为每百万输入 $0.0047,每百万输出 $0.014——所有网络模型价格相同,并从此页面实时获取。
| 场景 | 消耗量 | 通过 Gateway |
|---|---|---|
| 单次任务(读文件、找错误) | ~20K token | 几分之一美分 |
| 一天的活跃工作 | 3-7M token | 约一美分 |
| 一个月的活跃开发 | ~150M token | 几美分 |
作为对比,以下是 Codex 本身及同行竞品的付费方案:
| 方式 | 付费模式 | 限制 |
|---|---|---|
| ChatGPT 订阅 | 固定月费 | 调用次数和刷新窗口的配额限制 |
| 直接使用 OpenAI 密钥 | 按供应商标价付费 | 每百万 token 的价格高出三个数量级 |
| JoinGonka Gateway | 按 token 付费,余额扣除 | 仪表板可见消耗,无请求次数配额 |
支付方式为按实际消耗付费,无需月费,也没有请求次数配额:没有五小时窗口期、“提示词”限制或高峰时段倍数。余额通过加密货币充值,余额及每日消耗可在个人仪表板中查看。详细的经济分析请参阅关于最廉价 AI API 的文章。
工作注意事项
对话历史由 Codex 自身维护。 它在每次请求时发送完整历史,不要求服务器记忆任何内容——我们也不会存储聊天记录。在响应返回后,您的代码和提示词不会留在网关上。
网页搜索功能已启用。 Codex 在每次请求中声明搜索工具,网关会接收它:搜索在我们的侧边执行,结果会被注入到模型的响应中。
工具是本地的,而非云端的。 Codex 在您的计算机上本地执行命令和读取文件,因此对项目的访问不依赖于模型提供商。
沙盒。 在 Linux 上,Codex 使用 bubblewrap 来隔离运行的命令。如果系统中没有它,Codex 会发出警告并使用内置副本——这不会影响功能,但使用标准包管理器安装该包更方便。
如果需要图像处理(如界面截图、照片中的图表),请使用支持视觉的模型工具:Gonka 网络中的模型仅为文本模型。这对代码、命令和文件处理不是限制。
如果您觉得 Codex 不合适,可以使用其他终端代理:API 快速入门展示了如何在几分钟内连接任何兼容工具。