知識ベースのセクション ▾
ナビゲーション
▸ ここから始める 役割別カテゴリー
- Cursor + Gonka AI — コーディングのための安価な LLM
- Claude Code + Gonka AI — ターミナルのための LLM
- OpenClaw + Gonka AI — 利用しやすい AI エージェント
- OpenCode:ターミナルで独自のモデルを
- Continue.dev + Gonka AI — VS Code/JetBrains のための AI
- Cline + Gonka AI — VS Code の AI エージェント
- Aider + Gonka AI — AI とのペアプログラミング
- LangChain + Gonka AI — ごくわずかなコストの AI アプリケーション
- n8n + Gonka AI — 安価な AI による自動化
- Open WebUI + Gonka AI — 独自の ChatGPT
- LibreChat + Gonka AI — オープンソースのChatGPT
- Gonkaネットワーク上のHermes Agent + DeepSeek — 超低コスト自律エージェント
- Kilo Code + Gonka AI — VS Code内のAIエージェント
- Roo Code + Gonka AI — VS Code内の自律型AIエージェント
- LlamaIndex + Gonka AI — 超低コストの RAG アプリケーション
- PydanticAI + Gonka — 超低コストのタイプ付き AI エージェント
- Vercel AI SDK + Gonka AI — TypeScript での超低コスト AI アプリケーション
- TanStack AI + Gonka — TypeScript での超低コスト AI アプリケーション
- APIクイックスタート — curl, Python, TypeScript
- JoinGonka Gateway — 完全な概要
- マネジメントキー — Gonka 上の SaaS
- 最安AI API:2026年プロバイダー比較
- AIトークンとAPIキーの購入方法:2026年の3つの手段
- Cursor Proのクエリ制限が終了 — 原因分析と安価な代替案
- Claude Codeがより安く — 請求額の内訳と切り替え
- Clineのコスト高騰 — なぜエージェントがこれほど消費するのか
- OpenClawは高くつく — なぜエージェントはトークンを浪費するのか、どう節約すべきか
- OpenRouter:安価な代替手段 — JoinGonka Gatewayとの比較
- 2026年コーディングに最適なAIモデル:比較と価格
- GitHub Copilot の低コスト代替ツール:制限なし
- クレジット制限なし!Windsurfの安価な代替手段
- 2026年、AIエージェントのための最も安価なAPI
- ZCode:GLM Coding Planの代わりに使える格安GLM推論
- JetBrains IDE + JoinGonka Gateway — クレジットの代わりに独自endpointを利用
- GitHub Copilot BYOK — クォータの代わりに独自モデルを利用
- Zed + JoinGonka Gateway — エディタ内での安価な推論
- Pi + JoinGonka Gateway — 安価なインファレンス上のターミナルエージェント
- Codex CLI:サブスクリプションの代わりに独自のキーを使用
- DeepSeek Harness: JoinGonka Gateway経由の独自プロバイダー
- MiniMax Code: Gonka経由で独自キーを使うMiniMaxエージェント
- Warp + JoinGonka Gateway — エンドポイントでのターミナルエージェント
- Trae + JoinGonka Gateway — AI-IDEでGonkaネットワークモデルを利用
- Cherry Studio + JoinGonka Gateway — デスクトップAIクライアント
- omp (Oh My Pi) + JoinGonka Gateway: モデルロールを備えたエージェント
- OpenHands + JoinGonka Gateway: カスタムエンドポイント上のエージェント
- qwen-oauth終了後のQwen Code:JoinGonka Gateway経由の利用
- Goose + JoinGonka Gateway: プロバイダーとキーをキーリングで管理
- Crush + JoinGonka Gateway: Gonkaネットワークモデル上のCharmエージェント
- Zoo Code + JoinGonka Gateway: Roo CodeからGonkaモデルへの移行
- Kimi Code CLI: Gonka経由で専用キーを使うMoonshot AIエージェント
- Factory Droid + JoinGonka Gateway: GonkaネットワークモデルでのBYOK
- MiMo Code + JoinGonka Gateway: Gonkaネットワークモデル上のXiaomiエージェント
ツール
ZCode:GLM Coding Planの代わりに使える格安GLM推論
2026年6月、Z.aiはデスクトップ用エージェント型開発環境ZCode 3.0をリリースしました。同社はこれを「GLM-5.2の公式ハーネス」と呼んでいます。この製品は急速に注目を集めました。独自のエージェントコア、/goalによる自律タスク、マルチエージェントモード、そしてTelegramから直接セッションをリモート制御できる機能が特徴です。しかし、レビューの波とともに、GLM Coding Planの初期購読者からは疑問の声も上がっています。クォータが5時間枠での「プロンプト」として計算されること、ピーク時に消費量が3倍になること、下位プランでは並列リクエストが1つに制限されること、そしてHacker Newsでは、集中的に作業した後の突然のブロックに対する不満が寄せられています。
良いニュースとして、ZCodeは公式にcustom providerをサポートしています。これにより、OpenAIまたはAnthropic互換のAPIを接続し、サブスクリプションクォータではなく実際のトークン量に対して支払うことが可能です。このガイドでは、ZCodeとは何か、GLM Coding Planの仕組みを解説し、ステップバイステップでZCodeをJoinGonka Gatewayに設定する方法を説明します。これはZ.ai自身のオープン推論モデル「GLM-5.3 Flash」を提供するGonka分散ネットワークのゲートウェイです。結論:ツールもオープンウェイトモデルもそのままに、中央集権型APIよりも遥かに安価でトークンベースの経済を実現できます。
ZCodeとは:Z.aiによる自律型開発環境
ZCodeは「チャットサイドバー付きのエディタ」ではなく、AIエージェントを中心に開発が進行するADEです。目標を記述すると、エージェントが計画を立て、ファイルを修正し、テストを実行し、結果が出るまで反復処理を行います。macOSおよびWindows上のデスクトップアプリとして動作します(Linux版はベータ版)。
バージョン3.0の主な機能:
- ZCode Agent — GLM-5.2と深く統合された専用エージェントコア。他のサードパーティエージェント(Claude Code、Codex、Gemini CLIなど)も追加可能。
- Goalモード (
/goal) — 長時間の自律タスク:計画 → 実行 → ステップごとの検証。 - マルチエージェント — プロジェクトに対する複数のエージェントの並列動作。
- リモート操作 — Telegram、WeChat、Feishuからのセッション起動・管理:あなたのマシンでエージェントが作業し、開発者はスマホから質問に応答可能。
クライアント自体は無料であり、新規ユーザーにはGLM-5.2の試用クォータが毎日付与されます。それ以降はSubscription Planか独自のAPIキーの利用となります。ここからが製品の最も議論されている部分であり、詳細を知っておく必要があります。
GLM Coding Plan:料金、制限、クォータ
GLM Coding PlanはZ.aiのサブスクで、ZCodeおよび20以上のサードパーティツールでGLMモデルへのアクセスを提供する。公開時点(2026年7月)の基本料金表は以下の通り — ただし価格やキャンペーンは変わるので、最新のz.ai/subscribeページで確認してほしい:
| プラン | 価格, $/月 | クォータ | 並列リクエスト |
|---|---|---|---|
| Lite | $18(キャンペーンで〜$12.6から) | 5時間ウィンドウの「プロンプト」+週次上限 | 1 |
| Pro | $72 | Liteの×4 | 1 |
| Max | $160 | Liteの×16 | 最大30 |
購読者が不満を述べている点(Hacker NewsやGitHubのスレッド):
- ピーク倍率。 ピーク時間帯(14:00—18:00 UTC+8 — アジアの夕方、ヨーロッパの朝〜昼)は各リクエストがクォータを×3の係数で消費し、非ピーク時は×2。消費計画は北京時間で立てる必要がある。
- クォータが「プロンプト」単位でトークンではない。 残りトークン数は不透明で、「GLMで約17Mトークン消費して4日間ブロックされた」といった話がスレッドに見られる。
- LiteとProでは並列リクエストが1つ。 エージェント環境ではこれは痛い:ZCode自体のmulti-agentモードや並列サブエージェントはすべてキューで詰まる。
- GLM-5.2は下位モデルよりクォータ消費が速い — フラッグシップは独自の倍率でリミットを燃やす。
結論はシンプル:落ち着いたソロ開発ならサブスクは正直に機能する。しかし「エージェント的」な使い方 — 並列タスク、長い自律セッション、夜間実行 — になるほど、クォータモデルは宝くじになりがちだ。代替は実際のトークン分の支払い:ウィンドウも倍率も待ち行列もなく、エージェントが使った分だけ引かれる。まさにこのモデルをZCode組み込みのcustom provider機構が提供し、設定は5分で完了する。
ZCodeでのBYOK:自分自身のAPIキーとcustom provider設定
ZCodeにはBYOKのサポートが公式に組み込まれています:ドキュメントでは「OpenAIまたはAnthropicプロトコルと互換性のあるあらゆるサービス」— パブリックAPI、企業チャネル、さらにはセルフホストインスタンスの追加が明示的に許可されています。設定方法は3つあります:
- ウェルカム画面のConnectボタン → 「Set Your API Key」;
- モデルセレクターのManage Models;
- 歯車アイコン → Settings → Model Settings → Add Provider。
プロバイダーにはOpenAI Base URLおよび/またはAnthropic Base URLとAPI Keyを設定します — 利用可能なモデルのリストはZCodeが自動的に取得します。
最もよくつまずく3つの落とし穴:
- Z.aiのエンドポイントは異なります。Coding Planサブスクリプションはcodingエンドポイント
https://api.z.ai/api/coding/paas/v4を通じてのみ機能します;汎用の/api/paas/v4にサブスクリプションキーでアクセスするとエラーが返ります — 「プランは支払済みなのに401/429が出る」という典型的な原因です。 - 「Claude Codeで動く ≠ ZCodeで動く」。Claude Codeの設定に使われる
ANTHROPIC_BASE_URLのような環境変数をZCodeは読み取りません:ZCodeには独自のプロバイダー設定ストレージがあります。必ずSettings経由で設定してください。 - 「セレクターにモデルが見える ≠ キーにクォータがある」。モデルリストはプロバイダーのAPIから取得されますが、利用可否は特定のキーの残高と制限に依存します。
次は実践です:ZCodeにJoinGonkaゲートウェイを接続し、トークンでGLMスタックを手に入れましょう。
ZCodeでJoinGonka Gatewayを設定する:トークンベースのGLM
JoinGonka Gateway — デセントラライズドネットワーク Gonka へのゲートウェイであり、OpenAI互換の /v1/chat/completions と Anthropic Messages /v1/messages という2つのネイティブプロトコルを備えています。経済モデルは pay-per-token(トークン課金制)です。5時間ごとの制限、×3のピークマルチプライヤー、同時リクエスト数の制限などは一切ありません。消費量はダッシュボードでリアルタイムに確認でき、ゲートウェイはプロンプトの内容を保持しません。
ステップバイステップ(現在の Custom Provider インターフェース):
| ステップ | アクション |
|---|---|
| 1. キー | gate.joingonka.ai/register から登録し(新規アカウントには 3M トークンをプレゼント)、Keys セクションで API キーを作成します。詳細は API Quick Start を参照してください。 |
| 2. プロバイダー | ZCode → Settings → Model Settings → Add Provider。Name: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | jg-… で始まるキー |
| 5. API format | Chat completions (/chat/completions) |
| 6. モデル | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000 を入力します。同様に MiniMaxAI/MiniMax-M2.7 や zai-org/GLM-5.3-Flash(Z.ai 独自の推論モデル)も追加可能です。最新のリストと制限は GET /v1/models で確認できます。 |
古いバージョンの ZCode では、OpenAI Base URL (https://gate.joingonka.ai/v1) と Anthropic Base URL (https://gate.joingonka.ai — パスはクライアントが自動で追加します) という2つのフィールドが用意されています。
確認: 作成したモデルを選択し、エージェントに何か質問してください。回答が返ってくれば成功です。エラー 401 の場合はキーを確認し、402 の場合はアカウント残高を確認してください。DeepSeek V4 Flash で Thought Level を Max に設定した際に「Model request failed」と表示される場合は、Thought Level を High に変更して再度リクエストしてください。
ヒント: コマンド npx @joingonka/setup --tool zcode を実行すると、これらのフィールド(base URL、キー、モデル ID、コンテキストウィンドウや最大応答サイズなどのリアルタイム制限)に必要な設定値が生成され、ゲートウェイがそれを受け入れるかどうかの接続確認も行われます。ZCode 自体は UI 経由でのみ設定可能であり、安全に編集できる設定ファイルは存在しないため、値は手動で入力する必要があります。
価格比較:Coding Plan、Z.ai API、OpenRouter、Gonka
各チャネルにおけるGLMインファレンスのコスト(1Mトークンあたりの価格。競合他社の価格は2026年9月時点のもの、JoinGonkaの価格はゲートウェイAPIからページにライブで反映されます):
| チャネル | 入力, $/1M | 出力, $/1M | 課金モデル |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (キャッシュ入力 — $0.26) | $4.40 | トークン課金 |
| GLM Coding Plan | $18—160/月 | サブスクリプション:「プロンプト」クォータ、ピーク時3倍の倍率、並列数制限あり | |
| OpenRouter (z-ai/glm-5.2) | $1.40 | $4.40 | トークン課金 |
| OpenRouter (z-ai/glm-5.3-flash) | $0.09 | $0.30 | トークン課金 |
| JoinGonka Gateway | $0.0069 | $0.021 | トークン課金、Gonkaネットワーク |
2〜3桁の差はマーケティング上の端数処理ではなく、経済構造の違いによるものです。計算はデータセンターの利ざやではなく、作業そのものによって報酬を得る分散型ネットワークの参加者が行っています。仕組みと適用範囲の詳細については、最安のAI APIに関する記事をご覧ください。
JoinGonkaの行はGonkaネットワークにおけるGLM-5.3 Flashの価格です。ネットワーク内の全モデルで統一料金が適用されます。このページの数値は自動的に更新されるため、手動で計算し直す必要はありません。
GonkaネットワークにおけるGLM:GLM-5.3 Flashおよびよくある質問
GonkaネットワークはZ.aiモデルを提供します: zai-org/GLM-5.3-Flashはガバナンス提案 #101によって承認され、MiniMax M2.7およびDeepSeek V4 Flashと並んでゲートウェイから提供されます。本ガイドの初期バージョンで言及したフラッグシップモデルGLM-5.2は実戦配備されず、ネットワークは同ラインナップのより軽量で高速なモデルを選択しました。Base URLとキーは同一です: ZCodeではcustom providerにモデルを追加するだけです。
モデルについて: MITライセンスに基づくオープンウェイト、320Bパラメータ(トークンあたり18Bアクティブ)のMoEアーキテクチャ、ハイブリッドな疎(sparse)かつ線形のアテンションを採用しています。最大の特徴は推論(reasoning)モデルであることです。回答前に推論を行うため、単純な質問でも数百トークンを消費します。ZCodeでの注意点は2つ: モデルの回答長制限を低く設定しすぎないこと(短い返信でも600トークン以上)、高速な修正にはThought Levelを下げること。APIレベルではreasoning_effort: lowです。モデルとその制限に関する詳細は、記事GonkaネットワークにおけるGLM-5.3 Flashをご覧ください。
よくある質問:
- 新しいモデルで429やキューが発生するのはなぜですか? — モデルはまだネットワークホストの少数で提供されています。ピーク時にはリクエストが空きスロットを待つことがあります。数秒後にリクエストを再試行してください。ロードバランサーがアクティブなノードを見つけます。現在の状態はゲートウェイのステータスページで確認できます。
- 他に何が利用可能ですか? — GLM-5.3 Flash以外にMiniMax M2.7とDeepSeek V4 Flashが利用可能です。3つすべてのモデルがZCodeで同じcustom providerを通じて動作し、このガイドの構成で完全に機能します。
- プライバシーはどうですか? — ゲートウェイはプロンプトと回答の内容を保存しません。統計には消費量のみが記録されます。
- Coding Planの方がお得な場合は? — ソロで作業し、Liteクォータ内に収まり、並列エージェントを実行しない場合は、定額サブスクリプションが便利で予測可能です。自身のプロファイルに合わせて計算してください。エージェント作業が活発な場合、ネットワークを通じたトークン支払いの方が圧倒的に安価です。軽いコード修正を1日数回行う程度であれば、違いを感じない可能性があります。
- 他のツールでも使えますか? — はい。Claude Code、Cursor、Cline、およびOpenAI/Anthropic互換クライアントで同じエンドポイントが動作します。