知识库章节 ▾
导航
▸ 从这里开始 按角色类别
- Cursor + Gonka AI — 便宜的 LLM 用于编码
- Claude Code + Gonka AI — 终端的 LLM
- OpenClaw + Gonka AI — 可负担的 AI 代理
- OpenCode + Gonka AI — 免费的代码 AI
- Continue.dev + Gonka AI — 适用于 VS Code/JetBrains 的 AI
- Cline + Gonka AI — VS Code 中的 AI 代理
- Aider + Gonka AI — 与 AI 结对编程
- LangChain + Gonka AI — 便宜的 AI 应用程序
- n8n + Gonka AI — 通过便宜的 AI 实现自动化
- Open WebUI + Gonka AI — 您的 ChatGPT
- LibreChat + Gonka AI — 开源 ChatGPT
- Hermes Agent + Gonka AI — 廉价自主代理
- Kilo Code + Gonka AI — VS Code 中的 AI 代理
- Roo Code + Gonka AI — VS Code 中的自主 AI 代理
- LlamaIndex + Gonka AI — 低成本的 RAG 应用程序
- PydanticAI + Gonka — 低成本的类型化 AI 代理
- Vercel AI SDK + Gonka AI — 低成本的 TypeScript AI 应用程序
- TanStack AI + Gonka — 低成本的 TypeScript AI 应用程序
- API 快速入门 — curl, Python, TypeScript
- JoinGonka Gateway - 全面概述
- 管理密钥 — Gonka 上的 SaaS
- 最便宜的AI API:2026年提供商对比
- Cursor Pro 请求限制已用尽 — 解析与廉价替代方案
- Claude Code 更便宜 — 账单解析与切换
- Cline 正在烧钱 — 为什么代理花费如此之多
- OpenClaw 成本高昂 —— 为什么 Agent 会疯狂消耗 Token 以及如何节省
- OpenRouter:廉价替代方案 — 与 JoinGonka Gateway 的对比
- 2026 年最佳编码 AI 模型:对比与定价
- GitHub Copilot 无限制低成本替代方案
- 无积分、无限制的廉价 Windsurf 替代方案
- 2026 年最便宜的 AI 代理 API
- ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — 使用自己的 endpoint 替代点数消耗
- GitHub Copilot BYOK — 使用自己的模型替代配额限制
- Zed + JoinGonka Gateway — 编辑器中的低成本推理
- Pi + JoinGonka Gateway — 基于低成本推理的终端代理
工具
ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
2026 年 6 月,Z.ai 发布了 ZCode 3.0 — 一款桌面端智能体开发环境,该公司将其称为“GLM-5.2 官方配套工具(Official Harness)”。该产品迅速受到瞩目:内置智能体核心、通过 /goal 实现自主任务执行、支持多智能体(multi-agent)模式,还能直接通过 Telegram 进行远程会话控制。然而,随之而来的是 GLM Coding Plan 初期订阅用户的各种质疑:配额以 5 小时窗口内的“提示词(prompts)”计算,高峰时段消耗率翻三倍,低级别套餐仅支持单并发请求,且 Hacker News 上不断有用户抱怨在高强度工作后遭到系统封禁。
好消息是:ZCode 官方支持 custom provider — 你可以连接任何兼容 OpenAI 或 Anthropic 的 API,并按实际消耗的 Token 付费,而非购买订阅配额。在本指南中,我们将解析什么是 ZCode 以及 GLM Coding Plan 的运作机制,随后逐步将 ZCode 配置到 JoinGonka Gateway(Gonka 去中心化网络网关,其注册表已添加 GLM-5.2)。结论:使用相同的工具和 open-weight 模型,但在经济模型上,按 Token 计费比中心化 API 便宜数百倍。
什么是 ZCode:来自 Z.ai 的智能体开发环境
ZCode 不仅仅是一个“带聊天侧边栏的编辑器”,而是一个 ADE:你描述目标,智能体负责制定计划、修改文件、运行检查并迭代直至出结果。它作为 macOS 和 Windows 上的桌面应用程序运行(Linux 版本处于 Beta 状态)。
3.0 版本的核心功能:
- ZCode Agent — 原生智能体核心,深度集成 GLM-5.2;此外还支持接入第三方智能体(Claude Code、Codex、Gemini CLI 等);
- Goal 模式 (
/goal) — 长时间自主任务:计划 → 执行 → 分步验证; - Multi-agent — 项目的多智能体并行协同工作;
- 远程控制 — 从 Telegram、WeChat 和 Feishu 启动并控制会话:智能体在你的机器上运行,而你通过手机回答问题。
客户端本身免费,Z.ai 为新用户提供每日 GLM-5.2 Token 配额以供体验。之后,要么选择 GLM Coding Plan 订阅,要么使用你自己的 API Key。这就是需要深入解读的地方,因为订阅机制是该产品讨论度最高的部分。
GLM Coding Plan:价格、限制与配额
GLM Coding Plan 是 Z.ai 的订阅服务,提供 ZCode 及其他二十余种第三方工具的 GLM 模型访问权限。截至发布日期(2026 年 7 月),其基础定价方案如下 — 但促销和价格经常变动,请以官网 z.ai/subscribe 为准:
| 套餐 | 价格,$/月 | 配额 | 并发请求 |
|---|---|---|---|
| Lite | $18 (活动期间约 ~$12.6) | 5小时窗口内的“提示词” + 每周上限 | 1 |
| Pro | $72 | Lite 的 4 倍 | 1 |
| Max | $160 | Lite 的 16 倍 | 最多 30 |
订阅用户抱怨的主要痛点(Hacker News 和 GitHub 讨论串):
- 高峰时段乘数。 在高峰期(14:00—18:00 UTC+8 — 亚洲的晚上,欧洲的早晨/白天),每个请求会根据 ×3 系数扣减配额,非高峰期为 ×2。你必须根据北京时间规划使用量。
- 按“提示词”而非 Token 计算。 剩余配额并不透明;网上有案例称“在 GLM 上消耗了约 17M Token — 结果被封禁四天”。
- Lite 和 Pro 套餐仅支持 1 个并发请求。 对于智能体开发环境,这影响严重:ZCode 自身的多智能体模式以及任何并行的子智能体都会被卡在排队中。
- GLM-5.2 比轻量模型消耗配额更快 — 旗舰模型会以更高的乘数耗尽额度。
结论很简单:对于轻度的个人开发,该订阅模式尚可接受。但如果你的任务越“智能体化”——如并行任务、长时间自主会话、夜间自动跑任务——这种配额模式越像抽奖。替代方案是按实际消耗的 Token 付费,没有配额窗口、乘数或排队限制,消耗多少扣多少。这正是 ZCode 内置的 custom provider 机制所提供的,只需五分钟即可配置完成。
ZCode 中的 BYOK:使用自己的 API Key 和 custom provider
ZCode 正式内置支持 BYOK:文档明确允许添加“任何兼容 OpenAI 或 Anthropic 协议的服务”——包括公共 API、企业通道,甚至是自托管实例。可通过以下三种方式配置:
- 欢迎界面上的 Connect 按钮 → “Set Your API Key”;
- 模型选择器中的 Manage Models;
- 齿轮图标 → Settings → Model Settings → Add Provider。
为提供商设置 OpenAI Base URL 和/或 Anthropic Base URL 以及 API Key——ZCode 会自动拉取可用模型列表。
最容易遇到的三个坑:
- Z.ai 的 Endpoint 不同。 Coding Plan 订阅仅通过 coding-endpoint
https://api.z.ai/api/coding/paas/v4工作;使用订阅 Key 访问通用的/api/paas/v4会报错——这是“已付费但提示 401/429”的经典原因。 - “在 Claude Code 能用 ≠ 在 ZCode 能用”。 ZCode 不读取用于配置 Claude Code 的环境变量(如
ANTHROPIC_BASE_URL):它有自己独立的提供商设置存储。请务必通过 Settings 进行配置。 - “选择器看得到模型 ≠ Key 有额度”。 模型列表是从提供商 API 拉取的,而实际可用性取决于该特定 Key 的余额和限制。
接下来是实操:将 JoinGonka 网关连接到 ZCode,即可按 Token 使用 GLM 堆栈。
在 ZCode 中配置 JoinGonka Gateway:按 Token 使用 GLM
JoinGonka Gateway — 通往去中心化 Gonka 网络的网关,提供两种原生协议:OpenAI 兼容的 /v1/chat/completions 和 Anthropic Messages /v1/messages。经济模型采用按 token 付费:没有 5 小时窗口期、×3 倍高峰乘数或单并发请求限制;消耗情况在 dashboard 中实时可见,网关不存储提示词内容。
步骤指南(使用当前 Custom Provider 界面):
| 步骤 | 操作 |
|---|---|
| 1. 密钥 | 注册 — gate.joingonka.ai/register(新账号获得 10M 免费 token),并在 Keys 部分创建 API Key。详细信息参考 API Quick Start。 |
| 2. 提供商 | ZCode → Settings → Model Settings → Add Provider。名称: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | 你的 jg-… 格式密钥 |
| 5. API 格式 | Chat completions (/chat/completions) |
| 6. 模型 | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000。同样可以添加 moonshotai/Kimi-K2.6 和 MiniMaxAI/MiniMax-M2.7;最新列表可通过 GET /v1/models 获取。 |
在旧版 ZCode 中,此处有两个独立字段:OpenAI Base URL (https://gate.joingonka.ai/v1) 和 Anthropic Base URL (https://gate.joingonka.ai — 客户端会自动添加路径)。
验证:选择创建的模型并向 Agent 提问。如果收到回复,则一切正常;报错 401 — 检查密钥,402 — 检查账户余额。如果 DeepSeek V4 Flash 在 Thought Level 为 Max 时出现 “Model request failed”,请将 Thought Level 改为 High 并重新请求。
提示:命令 npx @joingonka/setup --tool zcode 将打印以下字段的现成值(base URL、密钥、带有当前限制的模型 ID),并实时测试网关是否接受。ZCode 本身仅通过 UI 配置 — 没有可以安全修改的文件,因此必须手动输入数值。
价格对比:Coding Plan、Z.ai API、OpenRouter 与 Gonka
不同渠道的 GLM 推理成本(每 1M tokens 的价格;竞争对手价格定于 2026 年 7 月,JoinGonka 价格通过 API 网关实时更新到页面):
| 渠道 | 输入, $/1M | 输出, $/1M | 计费模式 |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (缓存输入 — $0.26) | $4.40 | 按 token |
| GLM Coding Plan | $18—160/月 | 订阅:基于“Prompt”配额,高峰期 ×3 倍率,并发限制 | |
| OpenRouter (z-ai/glm-5.2) | $0.93 | $3.00 | 按 token;无免费版 GLM-5.2 |
| JoinGonka Gateway | $0.0032 | $0.0097 | 按 token,Gonka 网络 |
两到三个数量级的差异并非市场营销手段,而是不同的经济模式:计算由去中心化网络的参与者执行,他们通过工作本身获利,而非通过数据中心利润。关于其原理及适用范围的详细分析,请见 关于最便宜 AI API 的文章。
关于 GLM-5.2 的诚实声明:网络将在激活时刻设定模型的准确价格(上表显示的是网络模型的当前实时价格)。此页面上的数字会自动更新,无需手动重新计算。
Gonka 网络中的 GLM-5.2:状态与常见问题
zai-org/GLM-5.2-FP8 模型已添加到 Gonka 网络链上注册表中:配置指定了高达 400K Token 的上下文窗口,且该模型属于重量级模型(每个副本需要超过 1TB 的显存)。目前正在推送更新:网络节点正在加载权重。一旦检查变为绿色,该模型将自动出现在网关的模型列表中——Base URL 和密钥保持不变,在 ZCode 中只需在选择器中选择它即可。
关于模型本身:采用 MIT 许可证的开放权重,MoE 架构,约 750B 参数(每个 Token 活跃约 40B),原生窗口高达 1M Token。根据 Z.ai 的数据,在 SWE-bench Pro 上,该模型得分为 62.1,高于 GPT-5.5;在 FrontierSWE 上仅比 Claude Opus 4.8 落后约一个百分点。对于开放权重模型而言,这是编程领域的顶尖水平。
常见问题:
- 为什么启用新模型后会出现 429 错误? — 这是上线阶段:部分节点仍在加载权重。几秒钟后重试请求,负载均衡器会找到可用节点。
- 今天可以使用什么? — Kimi K2.6、MiniMax M2.7 和 DeepSeek V4 Flash:这三款模型均已通过自定义提供程序在 ZCode 中工作,本指南中的配置目前完全可用。
- 隐私如何保障? — 网关不会存储 Prompt 和回复的内容;统计数据中仅包含汇总的消耗数据。
- 什么时候选择 Coding Plan 更划算? — 如果您是个人使用,在 Lite 配额范围内,且不运行并行智能体,那么固定费用的订阅方式既方便又可预测。请根据您的需求计算:在活跃的智能体工作中,通过网络支付 Token 费用要便宜几个数量级;而如果只是每天轻度修改几次代码,则可能感受不到差异。
- 这是否适用于其他工具? — 是的:同样的端点适用于 Claude Code、Cursor、Cline 以及任何兼容 OpenAI/Anthropic 的客户端。