知識ベースのセクション ▾

ナビゲーション

▸ ここから始める 役割別

カテゴリー

ツール 52
用語集 12

ツール

Warp + JoinGonka Gateway — エンドポイントでのターミナルエージェント

Warpは、エージェント開発環境へと進化したターミナルです。組み込みのWarp Agentはコマンドの出力を読み取り、ファイルを修正し、ビルドを実行し、リクエストから結果までタスクを管理します。デフォルトでは、Warpが販売するモデルをWarpの料金クレジットを使用して利用しますが、これまでは有料プランでOpenAI、Anthropic、またはGoogleのキーを使用する場合にのみ、独自の推論環境を持ち込むことができました。2026年5月20日、Warpは無料プランでBYOKを公開し、OpenAI Chat Completionsと互換性のあるサービスを接続できるcustom inference endpointを追加しました。

2つ目の方法は、WarpエージェントをJoinGonka Gateway経由で実行するために必要です。このゲートウェイは、分散型ネットワークGonkaのモデルをOpenAI互換APIで提供し、推論コストはネットワークのリアルタイム価格で支払われるため、個人や小規模チームはWarpクレジットを消費せずに済みます。登録とアドレス確認後、アカウントには3Mの無料トークンが付与され、最初のチャージ前にエージェントを自分のタスクで試すことができます。

以下に、開始前に必要なもの、Warpフォームに入力する値、リクエストがゲートウェイを経由していることを確認する方法、ターミナルタスクに適したネットワークモデルの選択、そしてWarpのリクエスト経路に関する重要な注意点(ほとんどのツールとは異なります)を解説します。

必要なもの:キー、Warpプラン、パブリックアドレス

JoinGonkaキー。 ゲートウェイに登録し、管理画面の「APIキー」セクションを開いて「キーを作成」をクリックします。キーはjg-で始まり、一度しか表示されないため、すぐに保存してください。Warp専用のキーを作成しておくと便利です。これにより、「利用状況」セクションでターミナルエージェントの消費量を他のツールとは別に確認できます。

Warpプラン。 独自のエンドポイントは有料プランだけでなく、チーム規模に応じて以下の条件で利用可能です:

接続者独自エンドポイントの利用可否Warpクレジットの扱い
個人開発者または10人以下の企業(Free, Build, Maxプラン)可(これらのプランすべてで利用可能)独自エンドポイント経由の推論でクレジットは消費されません
10人を超える組織BusinessまたはEnterpriseのみエージェントのローカル実行時にはplatform creditsが消費されます(Warpインフラ利用料の割引レート)。推論自体はエンドポイントプロバイダーに支払われます

パブリックHTTPSアドレス。 これはWarpの要件であり、見落としがちですが、エンドポイントへのリクエストはローカルマシン上のアプリケーションではなくWarpのサーバーから送信されるため、アドレスはインターネットからアクセス可能である必要があります。localhost、127.0.0.1およびプライベートネットワークのアドレスはフォームで拒否され、スキームはhttps://のみが許可されます。JoinGonka GatewayはパブリックなHTTPSサービスであるため、Warpのドキュメントがローカルモデルのために推奨しているngrokのようなトンネルは不要です。

アプリの最新バージョン。 独自エンドポイントは2026年5月20日のリリースで安定版に含まれ、APIスキーマ選択フォームは2026年7月31日のリリースで追加されました。フォームにAPI schemaフィールドがない場合は、Warpをアップデートしてください。

接続: Add custom endpoint フォーム

設定はすべてアプリのインターフェース上で完結します。ファイルを手で編集する必要はありません。

  1. Settings を開き、設定検索で inference endpoint と入力します。Warp がプロバイダーキーと独自エンドポイントのブロックへ移動します(Warp Agent の設定ページにあります)。
  2. Add custom endpoint をクリックするとフォームが開きます。
  3. 各フィールドに表の値を入力し、Add endpoint をクリックします。
フォームのフィールド入力する値説明
API schemaOpenAI Chat Completionsデフォルトのスキーマです。Warp のドキュメントがアドレスの形式を説明しているのはこのスキーマ向けです。リストには OpenAI Responses と Anthropic Messages もあります
Endpoint nameJoinGonka任意の名前です。設定画面ではこの名前でエンドポイントが表示されます
Endpoint URLhttps://gate.joingonka.ai/v1/v1 を含めたベースアドレスです。Warp ドキュメントの例と同じ形式です
API keyjg-your-keyデバイス上のシステムキーストレージにのみ保存されます
Model namedeepseek-ai/DeepSeek-V4-Flash-0731ゲートウェイが返す正確なモデル識別子です
Model alias (optional)DeepSeek V4 Flashモデル切り替え用の短い名前です

+ Add model ボタンで次の行を追加できます。設定に戻らずに切り替えられるよう、ネットワーク上のモデルをすべて登録しておきましょう:deepseek-ai/DeepSeek-V4-Flash-0731、MiniMaxAI/MiniMax-M2.7、zai-org/GLM-5.3-Flash。最新のリストは常に GET https://gate.joingonka.ai/v1/models で取得できます。識別子は1文字ずつ正確に入力してください。フォームがチェックするのはアドレスの形式と入力の有無だけで、保存時にテストリクエストは行いません。そのため、モデル名のタイプミスはエージェントとの対話中に初めて発覚します。

保存後、モデルはエージェントのモデル切り替えに表示されます。デフォルトモデルが Warp のモデルのままだった場合、アプリが変更を提案してきます。承諾して自分のエンドポイントのモデルを選んでください。重要なポイント:切り替えの Auto オプションは常に Warp のインフラで動作し、独自エンドポイントを設定していても Warp のクレジットを消費します。リクエストをゲートウェイに送るには、切り替えで自分のリスト内の特定のモデルを選ぶ必要があります。

確認:リクエストがゲートウェイ経由で行われているか

切り替えスイッチで自分のエンドポイントのモデルを選択し、エージェントに短いタスクを与えてみてください。たとえば「現在のディレクトリにある最も大きいファイルを5つ表示し、そのコマンドを説明して」といった具合です。エージェントはコマンドを提案し、あなたの許可を得て実行し、出力にコメントを付けるはずです。

次にゲートウェイの管理画面で「使用状況」セクションを開きます。「キー別」ブロックでは、Warp用に発行したキーにリクエスト数と最終アクセス時刻が表示され、「モデル別」ブロックでは選択したモデルが表示されます。カウンターが増えていれば、WarpのクレジットではなくJoinGonka Gateway経由で推論が行われている証拠です。Warp側では、エージェントとの対話画面にトークン消費量がそのまま表示されます。aliasフィールドで設定した短い名前で確認できます。

何かうまくいかない場合、原因はたいていレスポンスから読み取れます:

表示される内容意味対処法
401, Invalid API keyゲートウェイがキーを認識できなかったキーがjg-で始まっているか、余分なスペースなく貼り付けられているか、「APIキー」セクションで有効になっているかを確認してください。不安な場合は新しく作成しましょう
404, Invalid URL (POST …)パスに余分なセグメントが含まれています。エラーメッセージにはゲートウェイがどのアドレスにリクエストを受け取ったかが表示されます/v1/chat/completionsになるはずです。/v1が重複していたり、アドレスにフルパスが入っていたりしませんか。Endpoint URLを上の表のとおりに修正してください
405 Not Allowedまたはレスポンスの代わりにHTMLページが返るアドレスに/v1が欠けており、リクエストがAPIの外に飛んでいますアドレスの末尾に/v1を追加してください
429モデルが過負荷です。ピーク時間帯にはネットワーク内の特定モデルの capacity がすべて使い切られていることがあります数秒後にもう一度試すか、隣のモデルに切り替えてください。そのために全モデルを最初から登録しておく価値があるのです
リクエストは通るがWarpのクレジットが減っていく切り替えスイッチでエンドポイントのモデルではなく、AutoまたはWarpのモデルルーターが選択されています自分のリストから特定のモデルを選んでください
フォームがアドレスを受け付けないWarpはhttps://と公開ホストを要求しますhttps://から始まるゲートウェイのアドレスを完全に入力してください
モデルが添付画像を「見ない」ネットワーク上のモデルはテキスト専用です。ゲートウェイは画像をテキストのマーカーに置き換えますスクリーンショットを扱うタスクでは視覚対応モデルに切り替え、コマンドやコードにはネットワークのモデルのままを使ってください
クラウド実行時にエンドポイントのモデルがない自分のエンドポイントはローカルに保存されるため、Cloud Agentsには反映されませんローカルエージェントでタスクを実行してください

セッションの最初のレスポンスは数秒遅れることがあります。エージェントがツールの説明を含む大きなシステムプロンプトを送信し、リクエストがまずWarpのサーバーを経由してからネットワークのノードに到達するためです。その後は対話がスムーズになります。

ターミナルエージェントにどのモデルを選択すべきか

ネットワーク内の各モデルの価格は同一であるため、選択基準は予算ではなく動作となります。ターミナルエージェントは大量のデータ(コマンド出力、ログ、ファイル)を読み取り、頻繁にツールを呼び出します。表内のすべてのモデルはネイティブの tool calling に対応しています。

モデル識別子コンテキストと回答Warpでの利用シーン
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K、回答最大32768トークンエージェントのデフォルトモデル: 長時間のセッション、巨大なログやdiff、複数ファイルの編集。コンテキストの余裕があり、ネットワーク内で最大の回答制限を持つ
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K、回答最大8192トークン高速な短期タスク: コマンドの選択、エラー解析、設定ファイルの修正
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K、回答最大8192トークン推論モデル: 回答前に論理的な思考を行う。複雑なデバッグ、移行計画、未知のコードの解析。回答が遅れ、回答制限の一部が思考プロセスに使用される

実用的な運用スキーム: 基本モデルとして DeepSeek V4 Flash を使用し、細かな作業には MiniMax M2.7、論理が重要なタスクには GLM-5.3 Flash を使用します。すべてのモデルは既に endpoint に登録されており、alias フィールドの短い名前を使用することで長い識別子に迷うことなく、一瞬で切り替えが可能です。最も人気のあるモデルの詳細については、DeepSeek V4 Flash の概要をご覧ください。

料金について

ターミナル内のエージェントはチャットよりもトークン消費量が多くなります。Warpは各リクエストにシステム指示、対話コンテキスト、ツール説明を追加し、1つのタスクが複数のステップで構成されるためです。そのため、ここでのトークン価格は通常のチャットよりも重要です。

JoinGonka Gateway を通じたトークン料金は、入力100万トークンあたり $0.0069、出力100万トークンあたり $0.021 です。この価格はネットワーク内の全モデル共通で、このページではライブソースから取得されます。2026年9月時点での概算コストは以下の通りです:

シナリオ消費量Gateway利用時
1回のタスク: コマンドと出力解析数万トークン1セント未満
エージェントを使用したアクティブな作業日3-7M トークン数セント
毎日の作業月間~150M トークン1〜2ドル程度

比較として、Warpエージェントの支払いには3つの方法があります:

方法推論の計算元制限事項
WarpモデルWarp(プランのクレジット)プランの月間クレジット残高
BYOK: OpenAI, Anthropic, Googleキーモデルベンダー(各価格設定)ベンダーの100万トークンあたりの価格
カスタム endpoint + JoinGonka Gatewayゲートウェイ: トークンベース(残高から)残高のみ: 管理画面で消費量を確認可能、リクエスト数の制限なし

Warp自体は、個人および10人以下のチームであれば、カスタム endpoint を経由した利用に対してクレジットを消費しません。支払いはゲートウェイのトークンのみです。残高は管理画面でチャージでき、日別の残高やモデルごとの消費量もそこで確認できます。

リクエストのルートとプライバシー: 知っておくべきこと

ほとんどのツールにおいて、カスタムendpointは「リクエストが自分のマシンからプロバイダーへ直接送信される」ことを意味しますが、Warpは異なります。Warpエージェントの実行部分はWarpサーバー上で動作するため、カスタムendpointは最終的な宛先とキーを変更するだけです。Warpのドキュメントによると、リクエストの経路は以下の通りです:

  1. アプリケーションは、デバイス上のセキュアストレージからendpointのアドレスとキーを取得し、プロンプトと共にWarpサーバーへ送信します。
  2. Warp側のエージェントが、システム指示、対話コンテキスト、ツールを含む完全なリクエストを構築し、そのキーを使用してあなたのendpointを呼び出します。
  3. 応答は同じサーバーを経由してストリームとしてアプリケーションに戻ります。

実務上の影響は以下の通りです:

  • キー: デバイス上にのみ保存されます。リクエストのたびにWarpサーバーを経由しますが、Warpの宣言によれば、そこでは保存されず、その場で使用されて破棄されます。
  • プロンプトと応答: Warpのバックエンドを経由します。Warpはこれらを学習に使用しないと宣言しており、保存や分析はアカウントのプライバシーおよびテレメトリー設定に従います。Warp自身のモデルに適用されるZDR保証を、カスタムendpointに拡張することはできません。何を保存するかはプロバイダー自身が決定します。
  • ゲートウェイ側: JoinGonka Gatewayは対話を保存しません。プロンプトと応答は回答後にゲートウェイに残らず、管理画面にはリクエスト数とトークン数のカウンターのみが表示されます。
  • Warpインフラに残るもの: Autoオプション、カスタムモデルルーター、Codebase Context、Active AIのヒント、およびクラウドエージェントには、カスタムendpointの影響は及びません。

もし業務上の理由でサードパーティサーバーを経由するルートが受け入れられない場合は、自分のマシンからendpointへ直接接続するエージェント(例:Codex CLIやAPIクイックスタートにあるツールなど)を使用してください。Warpは発表の中でクライアントサイドのオプションも約束しています。それは、Warpサーバーを経由せずにローカルモデルに接続するRust製の軽量エージェントモジュールをオープンリポジトリで提供し、Agent Client Protocolをサポートするというものです。また、2026年9月2日のリリース以降、endpointの記述はアプリケーションとWarp Agent CLIで共通の形式の構成ファイルに保存されるようになり、キーはファイルには書き込まれずセキュアストレージに保持されます。

Warpは、Add custom endpointフォームを使用してJoinGonka Gatewayに接続します。設定はOpenAI Chat Completionsスキーマ、アドレスはhttps://gate.joingonka.ai/v1、キーはjg-で始まり、ネットワークモデルIDを使用します。個人ユーザーや10人以下のチームは無料プランでも利用可能で、モデルセレクターでAutoではなくエンドポイントモデルを選択すれば、Warpの推論クレジットは消費されません。Warpの主な特徴はそのルートにあります。リクエストはWarpのサーバーを経由してエンドポイントに送信されるため、アドレスはパブリックである必要があり、プロンプトはWarpのバックエンドを通過します。ターミナルタスクにはDeepSeek V4 Flash、小規模なタスクにはMiniMax M2.7、複雑な論理にはGLM-5.3 Flashを推奨します。

もっと知りたいですか?

他のセクションを探索するか、Gonkaを今すぐ獲得し始めましょう。

キーと無料トークンを取得 →