知识库章节 ▾
导航
▸ 从这里开始 按角色类别
- Cursor + Gonka AI — 便宜的 LLM 用于编码
- Claude Code + Gonka AI — 终端的 LLM
- OpenClaw + Gonka AI — 可负担的 AI 代理
- OpenCode:在终端中使用自己的模型
- Continue.dev + Gonka AI — 适用于 VS Code/JetBrains 的 AI
- Cline + Gonka AI — VS Code 中的 AI 代理
- Aider + Gonka AI — 与 AI 结对编程
- LangChain + Gonka AI — 便宜的 AI 应用程序
- n8n + Gonka AI — 通过便宜的 AI 实现自动化
- Open WebUI + Gonka AI — 您的 ChatGPT
- LibreChat + Gonka AI — 开源 ChatGPT
- Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体
- Kilo Code + Gonka AI — VS Code 中的 AI 代理
- Roo Code + Gonka AI — VS Code 中的自主 AI 代理
- LlamaIndex + Gonka AI — 低成本的 RAG 应用程序
- PydanticAI + Gonka — 低成本的类型化 AI 代理
- Vercel AI SDK + Gonka AI — 低成本的 TypeScript AI 应用程序
- TanStack AI + Gonka — 低成本的 TypeScript AI 应用程序
- API 快速入门 — curl, Python, TypeScript
- JoinGonka Gateway - 全面概述
- 管理密钥 — Gonka 上的 SaaS
- 最便宜的AI API:2026年提供商对比
- Cursor Pro 请求限制已用尽 — 解析与廉价替代方案
- Claude Code 更便宜 — 账单解析与切换
- Cline 正在烧钱 — 为什么代理花费如此之多
- OpenClaw 成本高昂 —— 为什么 Agent 会疯狂消耗 Token 以及如何节省
- OpenRouter:廉价替代方案 — 与 JoinGonka Gateway 的对比
- 2026 年最佳编码 AI 模型:对比与定价
- GitHub Copilot 无限制低成本替代方案
- 无积分、无限制的廉价 Windsurf 替代方案
- 2026 年最便宜的 AI 代理 API
- ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — 使用自己的 endpoint 替代点数消耗
- GitHub Copilot BYOK — 使用自己的模型替代配额限制
- Zed + JoinGonka Gateway — 编辑器中的低成本推理
- Pi + JoinGonka Gateway — 基于低成本推理的终端代理
- Codex CLI:使用自己的密钥代替订阅
工具
Kilo Code + Gonka AI — VS Code 中的 AI 代理
Kilo Code 是适用于 VS Code 的开源 AI 代理扩展,它能自主编写和编辑代码,在终端中运行命令,并同时读取和修改数十个文件。该项目结合了 Cline 和 Roo Code 的优点,并作为一个统一的代理平台进行开发:除了 IDE 扩展,还有 JetBrains 和 CLI 版本。其关键特性是模式(agents):Code(编写代码)、Plan(即 Architect——规划架构而不进行修改)、Debug(查找错误原因)和 Ask(回答项目问题)。您还可以创建自己的模式。
问题与任何代理相同——令牌消耗。Kilo Code 将文件上下文、命令输出、历史步骤发送到模型;一个任务很容易消耗 10-100M 令牌。以 Anthropic 的价格(每 1M 令牌 $3-15),这相当于每次会话花费 $30-1500——对于日常工作来说不切实际。
JoinGonka Gateway 将成本降低了数百甚至数千倍:相同的会话只需 $0.01-1.00。由于 Kilo Code 是开源的,并且支持任何 OpenAI 兼容的端点(以及带有自定义 base URL 的 Anthropic 格式),连接我们的网关只需一个设置。这使得 Kilo Code 从一项昂贵的演示转变为日常工具。
步骤 1:安装 Kilo Code 并获取密钥
安装 Kilo Code:在 VS Code 中打开 Extensions (Ctrl+Shift+X),搜索“Kilo Code”并点击 Install。安装完成后,侧边栏会出现 Kilo Code 图标。该扩展程序也适用于没有 Marketplace 的 Open VSX 构建版本。
JoinGonka API 密钥:如果没有账户,请在 gate.joingonka.ai/register 注册,获取 3M 免费 token,并在 Dashboard → API Keys 中创建一个带有 jg- 前缀的密钥。同一个密钥既可用于 OpenAI 格式 (/v1),也可用于 Anthropic 格式 (/v1/messages) —— 余额通用。
步骤 2:配置 Kilo Code (OpenAI Compatible)
最简单的方法是通过一键安装程序进行配置。对于 CLI/文件工具,它会自动设置 JoinGonka 提供程序 (baseUrl, 模型),对于 UI 工具,它会显示现成的插入值:
npx @joingonka/setup --tool kilo安装程序是通用的(如果不加标志,它会提供一个工具列表供选择),会询问您的 jg-… 密钥,并在配置完成后对网关执行实时检查。它不会更改其他设置。如果您更喜欢自行配置,请参阅下方的手动方法。
手动配置(方案 B)
打开 Kilo Code 面板,通过齿轮图标进入提供程序设置。
方法 A — OpenAI Compatible (推荐)。 在扩展程序的现代版本中,打开 Settings (齿轮) → Providers 标签页 → 点击下方的 Custom provider 按钮并填写对话框:
- Provider ID: 任何标识符,例如
joingonka。 - Display name: 例如
JoinGonka Gonka。 - Base URL:
https://gate.joingonka.ai/v1 - API key:
jg-您的密钥 - Models: 添加
MiniMaxAI/MiniMax-M2.7。Kilo 会自动从/v1/models端点拉取模型列表 — 您可以从列表中选择模型,无需手动输入。
点击 Submit — 模型将出现在选择器中。在旧界面 (VSCode Legacy) 中,路径更短:API Provider → OpenAI Compatible,然后填入相同的 Base URL、API Key 和 Model 值。
方法 B — Anthropic 格式。 我们的网关也支持 Anthropic API。选择 API Provider → Anthropic,粘贴 jg-您的密钥,勾选 "Use custom base URL" 并指定 https://gate.joingonka.ai(不需要 /v1 — Kilo 会自动添加 /v1/messages)。
模型及其输出限制(目前全部三个均可用):
| 模型 | 上下文 | 最大输出 |
|---|---|---|
| MiniMaxAI/MiniMax-M2.7 (默认) | 200K | 8192 |
| deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 |
| zai-org/GLM-5.3-Flash | 390K | 8192 |
在自定义提供程序对话框中,可以为每个模型设置 Max Output Tokens 和 Context Window — 根据所选模型从表中填入相应数值。
验证:在 Kilo Code 聊天窗口的 Code 模式下,输入“创建一个包含 hello world 函数的 hello.py 文件”。代理应建议一个差异供批准并创建文件。默认情况下,Kilo Code 在每次操作前都会要求确认 — 您可以通过允许受信任操作的自动执行来放宽此限制。
代理会话成本比较
Kilo Code 是一款代理工具:它不仅能回复,还能完整执行任务 —— 读取文件、编写代码、运行测试、修复 Bug。每一步都是一次 API 调用,token 消耗很快。以下是使用 Anthropic Claude 与我们的 Gonka 网络网关进行典型会话的成本对比:
| 任务 | Tokens | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| 简单的 Bug 修复 | ~5M | $15 — $75 | $0.048 |
| 新功能 (2–3 个文件) | ~20M | $60 — $300 | $0.19 |
| 模块重构 | ~50M | $150 — $750 | $0.48 |
| 完整开发会话 (4小时) | ~100M | $300 — $1,500 | $0.96 |
通过 JoinGonka Gateway,输入成本约为每 1M token $0.0069,输出价格约为输入的三倍 —— 这比 Anthropic 和 OpenAI 便宜成百上千倍。Kilo Code 成为了一款日常工具:您可以为每个 ticket、每个 Bug 和每个功能运行它,无需担心成本。在 Anthropic 的价格体系下,您不得不权衡每一次运行。
模型参数:MiniMax M2.7 拥有 200K token 的上下文窗口和 8192 token 的最大回复长度(DeepSeek V4 Flash 为 380K 和 32768,GLM-5.3 Flash 为 390K 和 8192)。Kilo Code 可能会请求更多,但网关会将输出限制在模型的上限内。对于长生成任务,代理会将工作拆分为多个步骤。
模式和工具调用
Kilo Code 的强大之处在于其模式(旧版扩展中称为 modes,新版中称为 agents),您可以通过下拉菜单、/agents 命令或 Ctrl+. 快捷键进行切换:
- Plan / Architect — 在不触碰文件的情况下讨论和设计解决方案。适合通过 GLM-5.3 Flash 运行 —— 推理模型在回复前会先思考,虽然规划会消耗大量上下文,但在我们的网关上这只需几分钱。
- Code — 默认模式:编写和修改代码,应用 diff,运行命令。
- Debug — 通过日志和堆栈跟踪有针对性地查找 Bug 原因。
- Ask — 在不修改代码的情况下针对代码库回答问题。
新版本中,独立的 Orchestrator 模式已被弃用:具备完整工具访问权限的代理现在可以自行启动子任务 (subagents),无需专门的编排器。同时支持根据您的场景自定义模式。
Tool calling:我们的网关转发原生的 OpenAI function calling 和 Anthropic tool_use,且所选模型(MiniMax M2.7, DeepSeek V4 Flash, GLM-5.3 Flash)均支持工具调用。这意味着 Kilo Code 的代理循环 —— 读取文件、编辑、运行命令、索引代码库 —— 在我们的模型上运行非常稳定,无需脆弱的文本解析。