知識ベースのセクション ▾

ナビゲーション

▸ ここから始める 役割別

カテゴリー

ツール 52
用語集 12

ツール

ZCode:GLM Coding Planの代わりに使える格安GLM推論

2026年6月、Z.aiはデスクトップ用エージェント型開発環境ZCode 3.0をリリースしました。同社はこれを「GLM-5.2の公式ハーネス」と呼んでいます。この製品は急速に注目を集めました。独自のエージェントコア、/goalによる自律タスク、マルチエージェントモード、そしてTelegramから直接セッションをリモート制御できる機能が特徴です。しかし、レビューの波とともに、GLM Coding Planの初期購読者からは疑問の声も上がっています。クォータが5時間枠での「プロンプト」として計算されること、ピーク時に消費量が3倍になること、下位プランでは並列リクエストが1つに制限されること、そしてHacker Newsでは、集中的に作業した後の突然のブロックに対する不満が寄せられています。

良いニュースとして、ZCodeは公式にcustom providerをサポートしています。これにより、OpenAIまたはAnthropic互換のAPIを接続し、サブスクリプションクォータではなく実際のトークン量に対して支払うことが可能です。このガイドでは、ZCodeとは何か、GLM Coding Planの仕組みを解説し、ステップバイステップでZCodeをJoinGonka Gatewayに設定する方法を説明します。これはZ.ai自身のオープン推論モデル「GLM-5.3 Flash」を提供するGonka分散ネットワークのゲートウェイです。結論:ツールもオープンウェイトモデルもそのままに、中央集権型APIよりも遥かに安価でトークンベースの経済を実現できます。

ZCodeとは:Z.aiによる自律型開発環境

ZCodeは「チャットサイドバー付きのエディタ」ではなく、AIエージェントを中心に開発が進行するADEです。目標を記述すると、エージェントが計画を立て、ファイルを修正し、テストを実行し、結果が出るまで反復処理を行います。macOSおよびWindows上のデスクトップアプリとして動作します(Linux版はベータ版)。

バージョン3.0の主な機能:

  • ZCode Agent — GLM-5.2と深く統合された専用エージェントコア。他のサードパーティエージェント(Claude Code、Codex、Gemini CLIなど)も追加可能。
  • Goalモード (/goal) — 長時間の自律タスク:計画 → 実行 → ステップごとの検証。
  • マルチエージェント — プロジェクトに対する複数のエージェントの並列動作。
  • リモート操作 — Telegram、WeChat、Feishuからのセッション起動・管理:あなたのマシンでエージェントが作業し、開発者はスマホから質問に応答可能。

クライアント自体は無料であり、新規ユーザーにはGLM-5.2の試用クォータが毎日付与されます。それ以降はSubscription Planか独自のAPIキーの利用となります。ここからが製品の最も議論されている部分であり、詳細を知っておく必要があります。

GLM Coding Plan:料金、制限、クォータ

GLM Coding PlanはZ.aiのサブスクで、ZCodeおよび20以上のサードパーティツールでGLMモデルへのアクセスを提供する。公開時点(2026年7月)の基本料金表は以下の通り — ただし価格やキャンペーンは変わるので、最新のz.ai/subscribeページで確認してほしい:

プラン価格, $/月クォータ並列リクエスト
Lite$18(キャンペーンで〜$12.6から)5時間ウィンドウの「プロンプト」+週次上限1
Pro$72Liteの×41
Max$160Liteの×16最大30

購読者が不満を述べている点(Hacker NewsやGitHubのスレッド):

  • ピーク倍率。 ピーク時間帯(14:00—18:00 UTC+8 — アジアの夕方、ヨーロッパの朝〜昼)は各リクエストがクォータを×3の係数で消費し、非ピーク時は×2。消費計画は北京時間で立てる必要がある。
  • クォータが「プロンプト」単位でトークンではない。 残りトークン数は不透明で、「GLMで約17Mトークン消費して4日間ブロックされた」といった話がスレッドに見られる。
  • LiteとProでは並列リクエストが1つ。 エージェント環境ではこれは痛い:ZCode自体のmulti-agentモードや並列サブエージェントはすべてキューで詰まる。
  • GLM-5.2は下位モデルよりクォータ消費が速い — フラッグシップは独自の倍率でリミットを燃やす。

結論はシンプル:落ち着いたソロ開発ならサブスクは正直に機能する。しかし「エージェント的」な使い方 — 並列タスク、長い自律セッション、夜間実行 — になるほど、クォータモデルは宝くじになりがちだ。代替は実際のトークン分の支払い:ウィンドウも倍率も待ち行列もなく、エージェントが使った分だけ引かれる。まさにこのモデルをZCode組み込みのcustom provider機構が提供し、設定は5分で完了する。

ZCodeでのBYOK:自分自身のAPIキーとcustom provider設定

ZCodeにはBYOKのサポートが公式に組み込まれています:ドキュメントでは「OpenAIまたはAnthropicプロトコルと互換性のあるあらゆるサービス」— パブリックAPI、企業チャネル、さらにはセルフホストインスタンスの追加が明示的に許可されています。設定方法は3つあります:

  • ウェルカム画面のConnectボタン → 「Set Your API Key」;
  • モデルセレクターのManage Models;
  • 歯車アイコン → Settings → Model Settings → Add Provider。

プロバイダーにはOpenAI Base URLおよび/またはAnthropic Base URLとAPI Keyを設定します — 利用可能なモデルのリストはZCodeが自動的に取得します。

最もよくつまずく3つの落とし穴:

  • Z.aiのエンドポイントは異なります。Coding Planサブスクリプションはcodingエンドポイントhttps://api.z.ai/api/coding/paas/v4を通じてのみ機能します;汎用の/api/paas/v4にサブスクリプションキーでアクセスするとエラーが返ります — 「プランは支払済みなのに401/429が出る」という典型的な原因です。
  • 「Claude Codeで動く ≠ ZCodeで動く」。Claude Codeの設定に使われるANTHROPIC_BASE_URLのような環境変数をZCodeは読み取りません:ZCodeには独自のプロバイダー設定ストレージがあります。必ずSettings経由で設定してください。
  • 「セレクターにモデルが見える ≠ キーにクォータがある」。モデルリストはプロバイダーのAPIから取得されますが、利用可否は特定のキーの残高と制限に依存します。

次は実践です:ZCodeにJoinGonkaゲートウェイを接続し、トークンでGLMスタックを手に入れましょう。

ZCodeでJoinGonka Gatewayを設定する:トークンベースのGLM

JoinGonka Gateway — デセントラライズドネットワーク Gonka へのゲートウェイであり、OpenAI互換の /v1/chat/completions と Anthropic Messages /v1/messages という2つのネイティブプロトコルを備えています。経済モデルは pay-per-token(トークン課金制)です。5時間ごとの制限、×3のピークマルチプライヤー、同時リクエスト数の制限などは一切ありません。消費量はダッシュボードでリアルタイムに確認でき、ゲートウェイはプロンプトの内容を保持しません。

ステップバイステップ(現在の Custom Provider インターフェース):

ステップアクション
1. キーgate.joingonka.ai/register から登録し(新規アカウントには 3M トークンをプレゼント)、Keys セクションで API キーを作成します。詳細は API Quick Start を参照してください。
2. プロバイダーZCode → Settings → Model Settings → Add Provider。Name: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyjg-… で始まるキー
5. API formatChat completions (/chat/completions)
6. モデルAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000 を入力します。同様に MiniMaxAI/MiniMax-M2.7 や zai-org/GLM-5.3-Flash(Z.ai 独自の推論モデル)も追加可能です。最新のリストと制限は GET /v1/models で確認できます。

古いバージョンの ZCode では、OpenAI Base URL (https://gate.joingonka.ai/v1) と Anthropic Base URL (https://gate.joingonka.ai — パスはクライアントが自動で追加します) という2つのフィールドが用意されています。

確認: 作成したモデルを選択し、エージェントに何か質問してください。回答が返ってくれば成功です。エラー 401 の場合はキーを確認し、402 の場合はアカウント残高を確認してください。DeepSeek V4 Flash で Thought Level を Max に設定した際に「Model request failed」と表示される場合は、Thought Level を High に変更して再度リクエストしてください。

ヒント: コマンド npx @joingonka/setup --tool zcode を実行すると、これらのフィールド(base URL、キー、モデル ID、コンテキストウィンドウや最大応答サイズなどのリアルタイム制限)に必要な設定値が生成され、ゲートウェイがそれを受け入れるかどうかの接続確認も行われます。ZCode 自体は UI 経由でのみ設定可能であり、安全に編集できる設定ファイルは存在しないため、値は手動で入力する必要があります。

価格比較:Coding Plan、Z.ai API、OpenRouter、Gonka

各チャネルにおけるGLMインファレンスのコスト(1Mトークンあたりの価格。競合他社の価格は2026年9月時点のもの、JoinGonkaの価格はゲートウェイAPIからページにライブで反映されます):

チャネル入力, $/1M出力, $/1M課金モデル
Z.ai API (GLM-5.2)$1.40 (キャッシュ入力 — $0.26)$4.40トークン課金
GLM Coding Plan$18—160/月サブスクリプション:「プロンプト」クォータ、ピーク時3倍の倍率、並列数制限あり
OpenRouter (z-ai/glm-5.2)$1.40$4.40トークン課金
OpenRouter (z-ai/glm-5.3-flash)$0.09$0.30トークン課金
JoinGonka Gateway$0.0069$0.021トークン課金、Gonkaネットワーク

2〜3桁の差はマーケティング上の端数処理ではなく、経済構造の違いによるものです。計算はデータセンターの利ざやではなく、作業そのものによって報酬を得る分散型ネットワークの参加者が行っています。仕組みと適用範囲の詳細については、最安のAI APIに関する記事をご覧ください。

JoinGonkaの行はGonkaネットワークにおけるGLM-5.3 Flashの価格です。ネットワーク内の全モデルで統一料金が適用されます。このページの数値は自動的に更新されるため、手動で計算し直す必要はありません。

GonkaネットワークにおけるGLM:GLM-5.3 Flashおよびよくある質問

GonkaネットワークはZ.aiモデルを提供します: zai-org/GLM-5.3-Flashはガバナンス提案 #101によって承認され、MiniMax M2.7およびDeepSeek V4 Flashと並んでゲートウェイから提供されます。本ガイドの初期バージョンで言及したフラッグシップモデルGLM-5.2は実戦配備されず、ネットワークは同ラインナップのより軽量で高速なモデルを選択しました。Base URLとキーは同一です: ZCodeではcustom providerにモデルを追加するだけです。

モデルについて: MITライセンスに基づくオープンウェイト、320Bパラメータ(トークンあたり18Bアクティブ)のMoEアーキテクチャ、ハイブリッドな疎(sparse)かつ線形のアテンションを採用しています。最大の特徴は推論(reasoning)モデルであることです。回答前に推論を行うため、単純な質問でも数百トークンを消費します。ZCodeでの注意点は2つ: モデルの回答長制限を低く設定しすぎないこと(短い返信でも600トークン以上)、高速な修正にはThought Levelを下げること。APIレベルではreasoning_effort: lowです。モデルとその制限に関する詳細は、記事GonkaネットワークにおけるGLM-5.3 Flashをご覧ください。

よくある質問:

  • 新しいモデルで429やキューが発生するのはなぜですか? — モデルはまだネットワークホストの少数で提供されています。ピーク時にはリクエストが空きスロットを待つことがあります。数秒後にリクエストを再試行してください。ロードバランサーがアクティブなノードを見つけます。現在の状態はゲートウェイのステータスページで確認できます。
  • 他に何が利用可能ですか? — GLM-5.3 Flash以外にMiniMax M2.7とDeepSeek V4 Flashが利用可能です。3つすべてのモデルがZCodeで同じcustom providerを通じて動作し、このガイドの構成で完全に機能します。
  • プライバシーはどうですか? — ゲートウェイはプロンプトと回答の内容を保存しません。統計には消費量のみが記録されます。
  • Coding Planの方がお得な場合は? — ソロで作業し、Liteクォータ内に収まり、並列エージェントを実行しない場合は、定額サブスクリプションが便利で予測可能です。自身のプロファイルに合わせて計算してください。エージェント作業が活発な場合、ネットワークを通じたトークン支払いの方が圧倒的に安価です。軽いコード修正を1日数回行う程度であれば、違いを感じない可能性があります。
  • 他のツールでも使えますか? — はい。Claude Code、Cursor、Cline、およびOpenAI/Anthropic互換クライアントで同じエンドポイントが動作します。
ZCode 3.0は注目すべきエージェントIDEですが、標準のGLM Coding Planはクォータ制です。5時間枠での「プロンプト」、ピーク時の×3倍率、下位プランでの単一並列リクエストといった制限があります。エージェントの負荷が高まるほど、コストは予測不可能になります。公式のBYOKが解決策です。JoinGonka Gatewayをcustom providerとして接続すれば、中央集権型APIより数百倍安いGonka分散ネットワークのトークン単価で支払いが可能です。Z.aiのオープンなreasoningモデルであるGLM-5.3 Flashはすでにネットワークで提供されており、MiniMax M2.7やDeepSeek V4 Flashも利用可能です。無料のスタータートークンから始めてください。

もっと知りたいですか?

他のセクションを探索するか、Gonkaを今すぐ獲得し始めましょう。

無料トークンを取得する →