知识库章节 ▾

导航

▸ 从这里开始 按角色

类别

工具 36
词汇表 12

工具

ZCode:使用低成本 GLM 推理替代 GLM Coding Plan

2026 年 6 月,Z.ai 发布了 ZCode 3.0 — 一款桌面端智能体开发环境,该公司将其称为“GLM-5.2 官方配套工具(Official Harness)”。该产品迅速受到瞩目:内置智能体核心、通过 /goal 实现自主任务执行、支持多智能体(multi-agent)模式,还能直接通过 Telegram 进行远程会话控制。然而,随之而来的是 GLM Coding Plan 初期订阅用户的各种质疑:配额以 5 小时窗口内的“提示词(prompts)”计算,高峰时段消耗率翻三倍,低级别套餐仅支持单并发请求,且 Hacker News 上不断有用户抱怨在高强度工作后遭到系统封禁。

好消息是:ZCode 官方支持 custom provider — 你可以连接任何兼容 OpenAI 或 Anthropic 的 API,并按实际消耗的 Token 付费,而非购买订阅配额。在本指南中,我们将解析什么是 ZCode 以及 GLM Coding Plan 的运作机制,随后逐步将 ZCode 配置到 JoinGonka Gateway(Gonka 去中心化网络网关,其注册表已添加 GLM-5.2)。结论:使用相同的工具和 open-weight 模型,但在经济模型上,按 Token 计费比中心化 API 便宜数百倍。

什么是 ZCode:来自 Z.ai 的智能体开发环境

ZCode 不仅仅是一个“带聊天侧边栏的编辑器”,而是一个 ADE:你描述目标,智能体负责制定计划、修改文件、运行检查并迭代直至出结果。它作为 macOS 和 Windows 上的桌面应用程序运行(Linux 版本处于 Beta 状态)。

3.0 版本的核心功能:

  • ZCode Agent — 原生智能体核心,深度集成 GLM-5.2;此外还支持接入第三方智能体(Claude Code、Codex、Gemini CLI 等);
  • Goal 模式 (/goal) — 长时间自主任务:计划 → 执行 → 分步验证;
  • Multi-agent — 项目的多智能体并行协同工作;
  • 远程控制 — 从 Telegram、WeChat 和 Feishu 启动并控制会话:智能体在你的机器上运行,而你通过手机回答问题。

客户端本身免费,Z.ai 为新用户提供每日 GLM-5.2 Token 配额以供体验。之后,要么选择 GLM Coding Plan 订阅,要么使用你自己的 API Key。这就是需要深入解读的地方,因为订阅机制是该产品讨论度最高的部分。

GLM Coding Plan:价格、限制与配额

GLM Coding Plan 是 Z.ai 的订阅服务,提供 ZCode 及其他二十余种第三方工具的 GLM 模型访问权限。截至发布日期(2026 年 7 月),其基础定价方案如下 — 但促销和价格经常变动,请以官网 z.ai/subscribe 为准:

套餐价格,$/月配额并发请求
Lite$18 (活动期间约 ~$12.6)5小时窗口内的“提示词” + 每周上限1
Pro$72Lite 的 4 倍1
Max$160Lite 的 16 倍最多 30

订阅用户抱怨的主要痛点(Hacker News 和 GitHub 讨论串):

  • 高峰时段乘数。 在高峰期(14:00—18:00 UTC+8 — 亚洲的晚上,欧洲的早晨/白天),每个请求会根据 ×3 系数扣减配额,非高峰期为 ×2。你必须根据北京时间规划使用量。
  • 按“提示词”而非 Token 计算。 剩余配额并不透明;网上有案例称“在 GLM 上消耗了约 17M Token — 结果被封禁四天”。
  • Lite 和 Pro 套餐仅支持 1 个并发请求。 对于智能体开发环境,这影响严重:ZCode 自身的多智能体模式以及任何并行的子智能体都会被卡在排队中。
  • GLM-5.2 比轻量模型消耗配额更快 — 旗舰模型会以更高的乘数耗尽额度。

结论很简单:对于轻度的个人开发,该订阅模式尚可接受。但如果你的任务越“智能体化”——如并行任务、长时间自主会话、夜间自动跑任务——这种配额模式越像抽奖。替代方案是按实际消耗的 Token 付费,没有配额窗口、乘数或排队限制,消耗多少扣多少。这正是 ZCode 内置的 custom provider 机制所提供的,只需五分钟即可配置完成。

ZCode 中的 BYOK:使用自己的 API Key 和 custom provider

ZCode 正式内置支持 BYOK:文档明确允许添加“任何兼容 OpenAI 或 Anthropic 协议的服务”——包括公共 API、企业通道,甚至是自托管实例。可通过以下三种方式配置:

  • 欢迎界面上的 Connect 按钮 → “Set Your API Key”;
  • 模型选择器中的 Manage Models
  • 齿轮图标 → Settings → Model Settings → Add Provider

为提供商设置 OpenAI Base URL 和/或 Anthropic Base URL 以及 API Key——ZCode 会自动拉取可用模型列表。

最容易遇到的三个坑:

  • Z.ai 的 Endpoint 不同。 Coding Plan 订阅仅通过 coding-endpoint https://api.z.ai/api/coding/paas/v4 工作;使用订阅 Key 访问通用的 /api/paas/v4 会报错——这是“已付费但提示 401/429”的经典原因。
  • “在 Claude Code 能用 ≠ 在 ZCode 能用”。 ZCode 不读取用于配置 Claude Code 的环境变量(如 ANTHROPIC_BASE_URL):它有自己独立的提供商设置存储。请务必通过 Settings 进行配置。
  • “选择器看得到模型 ≠ Key 有额度”。 模型列表是从提供商 API 拉取的,而实际可用性取决于该特定 Key 的余额和限制。

接下来是实操:将 JoinGonka 网关连接到 ZCode,即可按 Token 使用 GLM 堆栈。

在 ZCode 中配置 JoinGonka Gateway:按 Token 使用 GLM

JoinGonka Gateway — 通往去中心化 Gonka 网络的网关,提供两种原生协议:OpenAI 兼容的 /v1/chat/completions 和 Anthropic Messages /v1/messages。经济模型采用按 token 付费:没有 5 小时窗口期、×3 倍高峰乘数或单并发请求限制;消耗情况在 dashboard 中实时可见,网关不存储提示词内容。

步骤指南(使用当前 Custom Provider 界面):

步骤操作
1. 密钥注册 — gate.joingonka.ai/register(新账号获得 10M 免费 token),并在 Keys 部分创建 API Key。详细信息参考 API Quick Start
2. 提供商ZCode → Settings → Model Settings → Add Provider。名称: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Key你的 jg-… 格式密钥
5. API 格式Chat completions (/chat/completions)
6. 模型Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000。同样可以添加 moonshotai/Kimi-K2.6MiniMaxAI/MiniMax-M2.7;最新列表可通过 GET /v1/models 获取。

在旧版 ZCode 中,此处有两个独立字段:OpenAI Base URL (https://gate.joingonka.ai/v1) 和 Anthropic Base URL (https://gate.joingonka.ai — 客户端会自动添加路径)。

验证:选择创建的模型并向 Agent 提问。如果收到回复,则一切正常;报错 401 — 检查密钥,402 — 检查账户余额。如果 DeepSeek V4 Flash 在 Thought Level 为 Max 时出现 “Model request failed”,请将 Thought Level 改为 High 并重新请求。

提示:命令 npx @joingonka/setup --tool zcode 将打印以下字段的现成值(base URL、密钥、带有当前限制的模型 ID),并实时测试网关是否接受。ZCode 本身仅通过 UI 配置 — 没有可以安全修改的文件,因此必须手动输入数值。

价格对比:Coding Plan、Z.ai API、OpenRouter 与 Gonka

不同渠道的 GLM 推理成本(每 1M tokens 的价格;竞争对手价格定于 2026 年 7 月,JoinGonka 价格通过 API 网关实时更新到页面):

渠道输入, $/1M输出, $/1M计费模式
Z.ai API (GLM-5.2)$1.40 (缓存输入 — $0.26)$4.40按 token
GLM Coding Plan$18—160/月订阅:基于“Prompt”配额,高峰期 ×3 倍率,并发限制
OpenRouter (z-ai/glm-5.2)$0.93$3.00按 token;无免费版 GLM-5.2
JoinGonka Gateway$0.0032$0.0097按 token,Gonka 网络

两到三个数量级的差异并非市场营销手段,而是不同的经济模式:计算由去中心化网络的参与者执行,他们通过工作本身获利,而非通过数据中心利润。关于其原理及适用范围的详细分析,请见 关于最便宜 AI API 的文章

关于 GLM-5.2 的诚实声明:网络将在激活时刻设定模型的准确价格(上表显示的是网络模型的当前实时价格)。此页面上的数字会自动更新,无需手动重新计算。

Gonka 网络中的 GLM-5.2:状态与常见问题

zai-org/GLM-5.2-FP8 模型已添加到 Gonka 网络链上注册表中:配置指定了高达 400K Token 的上下文窗口,且该模型属于重量级模型(每个副本需要超过 1TB 的显存)。目前正在推送更新:网络节点正在加载权重。一旦检查变为绿色,该模型将自动出现在网关的模型列表中——Base URL 和密钥保持不变,在 ZCode 中只需在选择器中选择它即可。

关于模型本身:采用 MIT 许可证的开放权重,MoE 架构,约 750B 参数(每个 Token 活跃约 40B),原生窗口高达 1M Token。根据 Z.ai 的数据,在 SWE-bench Pro 上,该模型得分为 62.1,高于 GPT-5.5;在 FrontierSWE 上仅比 Claude Opus 4.8 落后约一个百分点。对于开放权重模型而言,这是编程领域的顶尖水平。

常见问题:

  • 为什么启用新模型后会出现 429 错误? — 这是上线阶段:部分节点仍在加载权重。几秒钟后重试请求,负载均衡器会找到可用节点。
  • 今天可以使用什么? — Kimi K2.6、MiniMax M2.7 和 DeepSeek V4 Flash:这三款模型均已通过自定义提供程序在 ZCode 中工作,本指南中的配置目前完全可用。
  • 隐私如何保障? — 网关不会存储 Prompt 和回复的内容;统计数据中仅包含汇总的消耗数据。
  • 什么时候选择 Coding Plan 更划算? — 如果您是个人使用,在 Lite 配额范围内,且不运行并行智能体,那么固定费用的订阅方式既方便又可预测。请根据您的需求计算:在活跃的智能体工作中,通过网络支付 Token 费用要便宜几个数量级;而如果只是每天轻度修改几次代码,则可能感受不到差异。
  • 这是否适用于其他工具? — 是的:同样的端点适用于 Claude Code、Cursor、Cline 以及任何兼容 OpenAI/Anthropic 的客户端。
ZCode 3.0 是一款出色的代理式 IDE,但其原生的 GLM Coding Plan 订阅采用配额制:5 小时窗口内的“提示词”、高峰时段 ×3 倍率以及低端套餐下的单次并发请求。代理负载越重,成本就越高且越不可控。官方 BYOK 解决了这一问题:将 JoinGonka Gateway 作为自定义提供商连接,即可按 Gonka 去中心化网络价格支付实际消耗的 Token,价格比中心化 API 低数百倍。GLM-5.2 已加入网络注册表并会自动出现在您的模型选择器中,而 Kimi K2.6、MiniMax M2.7 和 DeepSeek V4 Flash 现已可用。从 10M 免费 Token 开始体验。

想了解更多?

探索其他章节或立即开始赚取 GNK。

获取 10M 免费 token →