知識ベースのセクション ▾

ナビゲーション

▸ ここから始める 役割別

カテゴリー

ツール 52
用語集 12

ツール

GitHub Copilot BYOK — クォータの代わりに独自モデルを利用

BYOK (bring your own key) は、GitHub Copilot の公式メカニズムであり、独自のモデルプロバイダーを接続して、組み込みの GPT や Claude ではなく自身の環境でエージェントセッションを実行できます。2026年1月よりあらゆるOpenAI互換エンドポイントがサポートされ、6月23日からは Copilot アプリ自体で有料プラン向けに public preview が開始され、7月14日には JetBrains バージョンでも利用可能になりました。つまり、Copilot をシェルとして利用し、推論(inference)は JoinGonka Gateway を介して実行することで、デセントラライズドネットワーク Gonka の低価格で、サブスクリプションのプレミアムリクエスト枠を消費せずに利用できます。VS Code での BYOK 利用には、Copilot プランや GitHub アカウントへのログインは不要です。

BYOKのメリットと必要となる場面

Copilotサブスクリプションはプレミアムリクエストを月間制限しており、エージェントセッション、リファクタリング、多段階タスクでクォータを急速に消費します。BYOKはこれらの呼び出しを自前のプロバイダーへルーティングし、Copilotのプレミアムクォータを消費せず、自前のプロバイダー価格で課金されます。キーはシステムキーチェーンに保存され、インターフェースが読み取ることはありません。

制限に達した場合や、オープンウェイトモデルを使用したい場合、または推論コストを大幅に抑えたい場合にBYOKは有効です。Gonkaネットワークは、ベンダーのカード価格よりも数百倍安価にオープンソースモデルを提供しています。現在の価格は常に ゲートウェイのリアルタイム価格表 で確認できます。

タイムライン:リリース履歴

時期新機能
2025年11月BYOK の public preview: Anthropic, OpenAI, xAI, Microsoft Foundry 対応。VS Code, JetBrains, Eclipse, Xcode で Agent, Plan, Ask, Edit モードが利用可能に
2026年1月あらゆるOpenAI互換プロバイダー + AWS Bedrock および Google AI Studio のサポート。Responses API を備えたモデル
2026年6月23日GitHub Copilot アプリでの BYOK — 全有料プラン向けに public preview
2026年6月18日VS Code: GitHub ログインおよび Copilot プランなしで BYOK が動作。プロバイダー側で消費され、Copilot のリクエスト枠は消費されません
2026年7月14日JetBrains 用 Copilot でのカスタムOpenAI互換エンドポイント対応 — 全料金プラン対象

JoinGonka Gatewayの接続手順

jg-… キーが必要です。このキーはゲートウェイでの登録時に、スタータープランの 3M 無料トークンと一緒に発行されます。カードは不要です。キーとモデルは各 Copilot クライアントごとに個別に設定します — 以下に3つの方法を紹介します。

VS Code — Custom Endpoint プロバイダー。 これが現行の方法です。以前の「OpenAI Compatible」プロバイダーと github.copilot.chat.customOAIModels 設定は非推奨となりました。

ステップ操作
1. モデルエディターコマンドパレット → Chat: Manage Language Models(またはチャットのモデル一覧の歯車アイコン)
2. プロバイダーAdd Models → Custom Endpoint。グループ名は例えば JoinGonka
3. キーあなたの jg-… を貼り付けます — VS Code はファイルではなく独自の安全なストレージに保存します
4. API タイプChat Completions
5. モデルVS Code が chatLanguageModels.json を開きます — 新しいグループの "models" 配列を以下のブロックに置き換えてファイルを保存してください
6. 選択チャットのモデル一覧からモデルを選択します。表示されない場合は VS Code を再起動してください
"models": [
  {
    "id": "deepseek-ai/DeepSeek-V4-Flash-0731",
    "name": "DeepSeek V4 Flash (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 347232,
    "maxOutputTokens": 32768
  },
  {
    "id": "MiniMaxAI/MiniMax-M2.7",
    "name": "MiniMax M2.7 (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 191808,
    "maxOutputTokens": 8192
  },
  {
    "id": "zai-org/GLM-5.3-Flash",
    "name": "GLM 5.3 Flash (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 381808,
    "maxOutputTokens": 8192
  }
]

maxInputTokens は、モデルのコンテキストウィンドウから応答の上限を差し引いた値です。maxOutputTokens と合わせてウィンドウを定義します。toolCalling: true がないと、エージェント使用時にモデルが一覧に表示されません。

Copilot CLI — 環境変数のみ。 このプロバイダーには設定ファイルがなく、値は copilot を起動するシェルで設定します:

export COPILOT_PROVIDER_BASE_URL=https://gate.joingonka.ai/v1
export COPILOT_PROVIDER_TYPE=openai
export COPILOT_PROVIDER_API_KEY=jg-your-key
export COPILOT_MODEL=deepseek-ai/DeepSeek-V4-Flash-0731
export COPILOT_PROVIDER_MAX_PROMPT_TOKENS=347232
export COPILOT_PROVIDER_MAX_OUTPUT_TOKENS=32768
copilot

COPILOT_PROVIDER_* の名前は Copilot CLI だけが読み取るため、この設定が他のツールに影響することはありません。CLI はモデルに tool calling とストリーミングを要求しますが、ネットワーク上のすべてのモデルがこれに対応しています。

JetBrains — GitHub Copilot プラグイン。 Copilot Chat を開く → モデル一覧 → Manage Models を選択し、OpenAI 互換エンドポイントのプロバイダーを選んで Add Models をクリックし、Base URL https://gate.joingonka.ai/v1、キー jg-…、モデル ID を入力します。Save をクリックし、自分のキーの下にあるモデルにチェックを入れて再度保存すると、組み込みモデルと並んで一覧に表示されます。

ヒント。 npx @joingonka/setup --tool copilot-byok コマンドを実行すると、3つのセクションすべてがあなたのキーと選択したモデルの実際のリミット付きで表示されます — VS Code 用の "models" 配列も含まれ — さらにライブリクエストでゲートウェイがキーとモデルを受け入れるかを検証します。ファイルには何も書き込みません。各 Copilot クライアントはキーを独自のストレージに保存します。

どのモデルを選択すべきか

ネットワークの3つのモデルすべてがストリーミングとtool callingをサポートしています。deepseek-ai/DeepSeek-V4-Flash-0731 — ネットワーク内で最大級のコンテキスト(380Kトークン)と、最大32768トークンという最大の出力容量を持ち、大規模なリポジトリや長時間のエージェントセッションに最適です。MiniMaxAI/MiniMax-M2.7 — 汎用モデルで、出力は最大8192トークンです。zai-org/GLM-5.3-Flash — Z.aiの推論(reasoning)モデルで、ネットワーク最大(390Kトークン)のコンテキストを持ちます。回答前に推論を行い、出力は最大8192トークンです。回答予算の一部が推論に消費されるため、設定で出力制限を下げすぎないようにしてください。

public previewの制限事項について

BYOKはエージェントセッションとチャットをカバーしますが、インライン補完やプロジェクト全体のセマンティック検索は引き続きCopilotモデルを使用し、GitHubアカウントを必要とします。これはプロバイダーの制限ではなく、Copilot自体の制限です。Copilot BusinessおよびEnterpriseでは、ローカルのBYOKは管理者のポリシー(「Bring Your Own Language Model Key」)によって制御されます。インターフェースに項目がない場合は、組織レベルで無効化されています。ゲートウェイを通じたVisionタスクは機能しません。ネットワーク上のモデルはテキスト専用です。ツールがResponses API形式でリクエストを送信する場合、ゲートウェイはそれを受け入れます(POST /v1/responses)。ストリーミングとFunction Toolsも機能します。対話履歴は保存されないため、storeは無視されます。また、previous_response_idはエラーを返します。履歴全体をinputに渡してください。

BYOKを利用することで、制限のあるサブスクリプションであるCopilotを、独自の推論環境をラップするインターフェースに変えることができます。VS Codeでは「Chat: Manage Language Models → Add Models → Custom Endpoint」、Copilot CLIではCOPILOT_PROVIDER_*環境変数、JetBrainsでは「Manage Models → Add Models」を使用します。ゲートウェイ「gate.joingonka.ai/v1」と「jg-」キーを設定すれば、Copilotのクォータを消費することなく、Gonkaネットワークのライブ価格でエージェントセッションを実行できます。まずは無料のスタートアップトークンから始めてください。

もっと知りたいですか?

他のセクションを探索するか、Gonkaを今すぐ獲得し始めましょう。

無料トークンを取得 →