知識ベースのセクション ▾
ナビゲーション
▸ ここから始める 役割別カテゴリー
- Cursor + Gonka AI — コーディングのための安価な LLM
- Claude Code + Gonka AI — ターミナルのための LLM
- OpenClaw + Gonka AI — 利用しやすい AI エージェント
- OpenCode:ターミナルで独自のモデルを
- Continue.dev + Gonka AI — VS Code/JetBrains のための AI
- Cline + Gonka AI — VS Code の AI エージェント
- Aider + Gonka AI — AI とのペアプログラミング
- LangChain + Gonka AI — ごくわずかなコストの AI アプリケーション
- n8n + Gonka AI — 安価な AI による自動化
- Open WebUI + Gonka AI — 独自の ChatGPT
- LibreChat + Gonka AI — オープンソースのChatGPT
- Gonkaネットワーク上のHermes Agent + DeepSeek — 超低コスト自律エージェント
- Kilo Code + Gonka AI — VS Code内のAIエージェント
- Roo Code + Gonka AI — VS Code内の自律型AIエージェント
- LlamaIndex + Gonka AI — 超低コストの RAG アプリケーション
- PydanticAI + Gonka — 超低コストのタイプ付き AI エージェント
- Vercel AI SDK + Gonka AI — TypeScript での超低コスト AI アプリケーション
- TanStack AI + Gonka — TypeScript での超低コスト AI アプリケーション
- APIクイックスタート — curl, Python, TypeScript
- JoinGonka Gateway — 完全な概要
- マネジメントキー — Gonka 上の SaaS
- 最安AI API:2026年プロバイダー比較
- AIトークンとAPIキーの購入方法:2026年の3つの手段
- Cursor Proのクエリ制限が終了 — 原因分析と安価な代替案
- Claude Codeがより安く — 請求額の内訳と切り替え
- Clineのコスト高騰 — なぜエージェントがこれほど消費するのか
- OpenClawは高くつく — なぜエージェントはトークンを浪費するのか、どう節約すべきか
- OpenRouter:安価な代替手段 — JoinGonka Gatewayとの比較
- 2026年コーディングに最適なAIモデル:比較と価格
- GitHub Copilot の低コスト代替ツール:制限なし
- クレジット制限なし!Windsurfの安価な代替手段
- 2026年、AIエージェントのための最も安価なAPI
- ZCode:GLM Coding Planの代わりに使える格安GLM推論
- JetBrains IDE + JoinGonka Gateway — クレジットの代わりに独自endpointを利用
- GitHub Copilot BYOK — クォータの代わりに独自モデルを利用
- Zed + JoinGonka Gateway — エディタ内での安価な推論
- Pi + JoinGonka Gateway — 安価なインファレンス上のターミナルエージェント
- Codex CLI:サブスクリプションの代わりに独自のキーを使用
- DeepSeek Harness: JoinGonka Gateway経由の独自プロバイダー
- MiniMax Code: Gonka経由で独自キーを使うMiniMaxエージェント
- Warp + JoinGonka Gateway — エンドポイントでのターミナルエージェント
- Trae + JoinGonka Gateway — AI-IDEでGonkaネットワークモデルを利用
- Cherry Studio + JoinGonka Gateway — デスクトップAIクライアント
- omp (Oh My Pi) + JoinGonka Gateway: モデルロールを備えたエージェント
- OpenHands + JoinGonka Gateway: カスタムエンドポイント上のエージェント
- qwen-oauth終了後のQwen Code:JoinGonka Gateway経由の利用
- Goose + JoinGonka Gateway: プロバイダーとキーをキーリングで管理
- Crush + JoinGonka Gateway: Gonkaネットワークモデル上のCharmエージェント
- Zoo Code + JoinGonka Gateway: Roo CodeからGonkaモデルへの移行
- Kimi Code CLI: Gonka経由で専用キーを使うMoonshot AIエージェント
- Factory Droid + JoinGonka Gateway: GonkaネットワークモデルでのBYOK
- MiMo Code + JoinGonka Gateway: Gonkaネットワークモデル上のXiaomiエージェント
ツール
Warp + JoinGonka Gateway — エンドポイントでのターミナルエージェント
Warpは、エージェント開発環境へと進化したターミナルです。組み込みのWarp Agentはコマンドの出力を読み取り、ファイルを修正し、ビルドを実行し、リクエストから結果までタスクを管理します。デフォルトでは、Warpが販売するモデルをWarpの料金クレジットを使用して利用しますが、これまでは有料プランでOpenAI、Anthropic、またはGoogleのキーを使用する場合にのみ、独自の推論環境を持ち込むことができました。2026年5月20日、Warpは無料プランでBYOKを公開し、OpenAI Chat Completionsと互換性のあるサービスを接続できるcustom inference endpointを追加しました。
2つ目の方法は、WarpエージェントをJoinGonka Gateway経由で実行するために必要です。このゲートウェイは、分散型ネットワークGonkaのモデルをOpenAI互換APIで提供し、推論コストはネットワークのリアルタイム価格で支払われるため、個人や小規模チームはWarpクレジットを消費せずに済みます。登録とアドレス確認後、アカウントには3Mの無料トークンが付与され、最初のチャージ前にエージェントを自分のタスクで試すことができます。
以下に、開始前に必要なもの、Warpフォームに入力する値、リクエストがゲートウェイを経由していることを確認する方法、ターミナルタスクに適したネットワークモデルの選択、そしてWarpのリクエスト経路に関する重要な注意点(ほとんどのツールとは異なります)を解説します。
必要なもの:キー、Warpプラン、パブリックアドレス
JoinGonkaキー。 ゲートウェイに登録し、管理画面の「APIキー」セクションを開いて「キーを作成」をクリックします。キーはjg-で始まり、一度しか表示されないため、すぐに保存してください。Warp専用のキーを作成しておくと便利です。これにより、「利用状況」セクションでターミナルエージェントの消費量を他のツールとは別に確認できます。
Warpプラン。 独自のエンドポイントは有料プランだけでなく、チーム規模に応じて以下の条件で利用可能です:
| 接続者 | 独自エンドポイントの利用可否 | Warpクレジットの扱い |
|---|---|---|
| 個人開発者または10人以下の企業(Free, Build, Maxプラン) | 可(これらのプランすべてで利用可能) | 独自エンドポイント経由の推論でクレジットは消費されません |
| 10人を超える組織 | BusinessまたはEnterpriseのみ | エージェントのローカル実行時にはplatform creditsが消費されます(Warpインフラ利用料の割引レート)。推論自体はエンドポイントプロバイダーに支払われます |
パブリックHTTPSアドレス。 これはWarpの要件であり、見落としがちですが、エンドポイントへのリクエストはローカルマシン上のアプリケーションではなくWarpのサーバーから送信されるため、アドレスはインターネットからアクセス可能である必要があります。localhost、127.0.0.1およびプライベートネットワークのアドレスはフォームで拒否され、スキームはhttps://のみが許可されます。JoinGonka GatewayはパブリックなHTTPSサービスであるため、Warpのドキュメントがローカルモデルのために推奨しているngrokのようなトンネルは不要です。
アプリの最新バージョン。 独自エンドポイントは2026年5月20日のリリースで安定版に含まれ、APIスキーマ選択フォームは2026年7月31日のリリースで追加されました。フォームにAPI schemaフィールドがない場合は、Warpをアップデートしてください。
接続: Add custom endpoint フォーム
設定はすべてアプリのインターフェース上で完結します。ファイルを手で編集する必要はありません。
- Settings を開き、設定検索で
inference endpointと入力します。Warp がプロバイダーキーと独自エンドポイントのブロックへ移動します(Warp Agent の設定ページにあります)。 - Add custom endpoint をクリックするとフォームが開きます。
- 各フィールドに表の値を入力し、Add endpoint をクリックします。
| フォームのフィールド | 入力する値 | 説明 |
|---|---|---|
| API schema | OpenAI Chat Completions | デフォルトのスキーマです。Warp のドキュメントがアドレスの形式を説明しているのはこのスキーマ向けです。リストには OpenAI Responses と Anthropic Messages もあります |
| Endpoint name | JoinGonka | 任意の名前です。設定画面ではこの名前でエンドポイントが表示されます |
| Endpoint URL | https://gate.joingonka.ai/v1 | /v1 を含めたベースアドレスです。Warp ドキュメントの例と同じ形式です |
| API key | jg-your-key | デバイス上のシステムキーストレージにのみ保存されます |
| Model name | deepseek-ai/DeepSeek-V4-Flash-0731 | ゲートウェイが返す正確なモデル識別子です |
| Model alias (optional) | DeepSeek V4 Flash | モデル切り替え用の短い名前です |
+ Add model ボタンで次の行を追加できます。設定に戻らずに切り替えられるよう、ネットワーク上のモデルをすべて登録しておきましょう:deepseek-ai/DeepSeek-V4-Flash-0731、MiniMaxAI/MiniMax-M2.7、zai-org/GLM-5.3-Flash。最新のリストは常に GET https://gate.joingonka.ai/v1/models で取得できます。識別子は1文字ずつ正確に入力してください。フォームがチェックするのはアドレスの形式と入力の有無だけで、保存時にテストリクエストは行いません。そのため、モデル名のタイプミスはエージェントとの対話中に初めて発覚します。
保存後、モデルはエージェントのモデル切り替えに表示されます。デフォルトモデルが Warp のモデルのままだった場合、アプリが変更を提案してきます。承諾して自分のエンドポイントのモデルを選んでください。重要なポイント:切り替えの Auto オプションは常に Warp のインフラで動作し、独自エンドポイントを設定していても Warp のクレジットを消費します。リクエストをゲートウェイに送るには、切り替えで自分のリスト内の特定のモデルを選ぶ必要があります。
確認:リクエストがゲートウェイ経由で行われているか
切り替えスイッチで自分のエンドポイントのモデルを選択し、エージェントに短いタスクを与えてみてください。たとえば「現在のディレクトリにある最も大きいファイルを5つ表示し、そのコマンドを説明して」といった具合です。エージェントはコマンドを提案し、あなたの許可を得て実行し、出力にコメントを付けるはずです。
次にゲートウェイの管理画面で「使用状況」セクションを開きます。「キー別」ブロックでは、Warp用に発行したキーにリクエスト数と最終アクセス時刻が表示され、「モデル別」ブロックでは選択したモデルが表示されます。カウンターが増えていれば、WarpのクレジットではなくJoinGonka Gateway経由で推論が行われている証拠です。Warp側では、エージェントとの対話画面にトークン消費量がそのまま表示されます。aliasフィールドで設定した短い名前で確認できます。
何かうまくいかない場合、原因はたいていレスポンスから読み取れます:
| 表示される内容 | 意味 | 対処法 |
|---|---|---|
401, Invalid API key | ゲートウェイがキーを認識できなかった | キーがjg-で始まっているか、余分なスペースなく貼り付けられているか、「APIキー」セクションで有効になっているかを確認してください。不安な場合は新しく作成しましょう |
404, Invalid URL (POST …) | パスに余分なセグメントが含まれています。エラーメッセージにはゲートウェイがどのアドレスにリクエストを受け取ったかが表示されます | /v1/chat/completionsになるはずです。/v1が重複していたり、アドレスにフルパスが入っていたりしませんか。Endpoint URLを上の表のとおりに修正してください |
405 Not Allowedまたはレスポンスの代わりにHTMLページが返る | アドレスに/v1が欠けており、リクエストがAPIの外に飛んでいます | アドレスの末尾に/v1を追加してください |
429 | モデルが過負荷です。ピーク時間帯にはネットワーク内の特定モデルの capacity がすべて使い切られていることがあります | 数秒後にもう一度試すか、隣のモデルに切り替えてください。そのために全モデルを最初から登録しておく価値があるのです |
| リクエストは通るがWarpのクレジットが減っていく | 切り替えスイッチでエンドポイントのモデルではなく、AutoまたはWarpのモデルルーターが選択されています | 自分のリストから特定のモデルを選んでください |
| フォームがアドレスを受け付けない | Warpはhttps://と公開ホストを要求します | https://から始まるゲートウェイのアドレスを完全に入力してください |
| モデルが添付画像を「見ない」 | ネットワーク上のモデルはテキスト専用です。ゲートウェイは画像をテキストのマーカーに置き換えます | スクリーンショットを扱うタスクでは視覚対応モデルに切り替え、コマンドやコードにはネットワークのモデルのままを使ってください |
| クラウド実行時にエンドポイントのモデルがない | 自分のエンドポイントはローカルに保存されるため、Cloud Agentsには反映されません | ローカルエージェントでタスクを実行してください |
セッションの最初のレスポンスは数秒遅れることがあります。エージェントがツールの説明を含む大きなシステムプロンプトを送信し、リクエストがまずWarpのサーバーを経由してからネットワークのノードに到達するためです。その後は対話がスムーズになります。
ターミナルエージェントにどのモデルを選択すべきか
ネットワーク内の各モデルの価格は同一であるため、選択基準は予算ではなく動作となります。ターミナルエージェントは大量のデータ(コマンド出力、ログ、ファイル)を読み取り、頻繁にツールを呼び出します。表内のすべてのモデルはネイティブの tool calling に対応しています。
| モデル | 識別子 | コンテキストと回答 | Warpでの利用シーン |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K、回答最大32768トークン | エージェントのデフォルトモデル: 長時間のセッション、巨大なログやdiff、複数ファイルの編集。コンテキストの余裕があり、ネットワーク内で最大の回答制限を持つ |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K、回答最大8192トークン | 高速な短期タスク: コマンドの選択、エラー解析、設定ファイルの修正 |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K、回答最大8192トークン | 推論モデル: 回答前に論理的な思考を行う。複雑なデバッグ、移行計画、未知のコードの解析。回答が遅れ、回答制限の一部が思考プロセスに使用される |
実用的な運用スキーム: 基本モデルとして DeepSeek V4 Flash を使用し、細かな作業には MiniMax M2.7、論理が重要なタスクには GLM-5.3 Flash を使用します。すべてのモデルは既に endpoint に登録されており、alias フィールドの短い名前を使用することで長い識別子に迷うことなく、一瞬で切り替えが可能です。最も人気のあるモデルの詳細については、DeepSeek V4 Flash の概要をご覧ください。
料金について
ターミナル内のエージェントはチャットよりもトークン消費量が多くなります。Warpは各リクエストにシステム指示、対話コンテキスト、ツール説明を追加し、1つのタスクが複数のステップで構成されるためです。そのため、ここでのトークン価格は通常のチャットよりも重要です。
JoinGonka Gateway を通じたトークン料金は、入力100万トークンあたり $0.0069、出力100万トークンあたり $0.021 です。この価格はネットワーク内の全モデル共通で、このページではライブソースから取得されます。2026年9月時点での概算コストは以下の通りです:
| シナリオ | 消費量 | Gateway利用時 |
|---|---|---|
| 1回のタスク: コマンドと出力解析 | 数万トークン | 1セント未満 |
| エージェントを使用したアクティブな作業日 | 3-7M トークン | 数セント |
| 毎日の作業月間 | ~150M トークン | 1〜2ドル程度 |
比較として、Warpエージェントの支払いには3つの方法があります:
| 方法 | 推論の計算元 | 制限事項 |
|---|---|---|
| Warpモデル | Warp(プランのクレジット) | プランの月間クレジット残高 |
| BYOK: OpenAI, Anthropic, Googleキー | モデルベンダー(各価格設定) | ベンダーの100万トークンあたりの価格 |
| カスタム endpoint + JoinGonka Gateway | ゲートウェイ: トークンベース(残高から) | 残高のみ: 管理画面で消費量を確認可能、リクエスト数の制限なし |
Warp自体は、個人および10人以下のチームであれば、カスタム endpoint を経由した利用に対してクレジットを消費しません。支払いはゲートウェイのトークンのみです。残高は管理画面でチャージでき、日別の残高やモデルごとの消費量もそこで確認できます。
リクエストのルートとプライバシー: 知っておくべきこと
ほとんどのツールにおいて、カスタムendpointは「リクエストが自分のマシンからプロバイダーへ直接送信される」ことを意味しますが、Warpは異なります。Warpエージェントの実行部分はWarpサーバー上で動作するため、カスタムendpointは最終的な宛先とキーを変更するだけです。Warpのドキュメントによると、リクエストの経路は以下の通りです:
- アプリケーションは、デバイス上のセキュアストレージからendpointのアドレスとキーを取得し、プロンプトと共にWarpサーバーへ送信します。
- Warp側のエージェントが、システム指示、対話コンテキスト、ツールを含む完全なリクエストを構築し、そのキーを使用してあなたのendpointを呼び出します。
- 応答は同じサーバーを経由してストリームとしてアプリケーションに戻ります。
実務上の影響は以下の通りです:
- キー: デバイス上にのみ保存されます。リクエストのたびにWarpサーバーを経由しますが、Warpの宣言によれば、そこでは保存されず、その場で使用されて破棄されます。
- プロンプトと応答: Warpのバックエンドを経由します。Warpはこれらを学習に使用しないと宣言しており、保存や分析はアカウントのプライバシーおよびテレメトリー設定に従います。Warp自身のモデルに適用されるZDR保証を、カスタムendpointに拡張することはできません。何を保存するかはプロバイダー自身が決定します。
- ゲートウェイ側: JoinGonka Gatewayは対話を保存しません。プロンプトと応答は回答後にゲートウェイに残らず、管理画面にはリクエスト数とトークン数のカウンターのみが表示されます。
- Warpインフラに残るもの: Autoオプション、カスタムモデルルーター、Codebase Context、Active AIのヒント、およびクラウドエージェントには、カスタムendpointの影響は及びません。
もし業務上の理由でサードパーティサーバーを経由するルートが受け入れられない場合は、自分のマシンからendpointへ直接接続するエージェント(例:Codex CLIやAPIクイックスタートにあるツールなど)を使用してください。Warpは発表の中でクライアントサイドのオプションも約束しています。それは、Warpサーバーを経由せずにローカルモデルに接続するRust製の軽量エージェントモジュールをオープンリポジトリで提供し、Agent Client Protocolをサポートするというものです。また、2026年9月2日のリリース以降、endpointの記述はアプリケーションとWarp Agent CLIで共通の形式の構成ファイルに保存されるようになり、キーはファイルには書き込まれずセキュアストレージに保持されます。