Sezioni dell'archivio conoscenza ▾

Navigazione

▸ Inizia qui Per ruolo

Categorie

Strumenti 52
Glossario 12

Strumenti

GitHub Copilot BYOK — i tuoi modelli invece della quota

BYOK (bring your own key) è il meccanismo ufficiale di GitHub Copilot che consente di collegare il proprio provider di modelli e operare in sessioni agentiche con esso, anziché con GPT e Claude integrati. Da gennaio 2026 è supportato qualsiasi endpoint compatibile con OpenAI, dal 23 giugno BYOK è disponibile nell'applicazione Copilot in public preview per tutti i piani a pagamento, e dal 14 luglio anche nella versione JetBrains. Questo significa che puoi mantenere Copilot come shell ed eseguire l'inference tramite JoinGonka Gateway — ai prezzi della rete decentralizzata Gonka e senza consumare le richieste premium dell'abbonamento. In VS Code, per BYOK non sono necessari né un piano Copilot né l'accesso a un account GitHub.

Cosa offre BYOK e quando ti serve

L'abbonamento a Copilot limita le premium-request mensili: le sessioni di agent, i refactoring e i task a più passaggi consumano la quota più velocemente. BYOK sposta queste chiamate sul tuo provider: il consumo viene fatturato ai prezzi di quest'ultimo e non scala la premium-quota di Copilot. Le chiavi sono salvate nel keychain di sistema e non vengono lette dall'interfaccia.

BYOK è giustificato se raggiungi il limite, desideri modelli con pesi aperti o paghi l'inferenza molto meno: la rete Gonka offre gli stessi modelli open-source a prezzi centinaia di volte inferiori rispetto ai listini dei vendor — i prezzi aggiornati sono sempre nel listino live del gateway.

Cronologia: cosa e quando è stato attivato

QuandoCosa è stato introdotto
Novembre 2025BYOK in public preview: Anthropic, OpenAI, xAI, Microsoft Foundry; modalità Agent, Plan, Ask, Edit in VS Code, JetBrains, Eclipse, Xcode
Gennaio 2026Supporto per qualsiasi provider compatibile con OpenAI + AWS Bedrock e Google AI Studio; modelli con Responses API
23 giugno 2026BYOK nell'applicazione GitHub Copilot — public preview per tutti i piani a pagamento
18 giugno 2026VS Code: BYOK funziona senza login a GitHub e senza piano Copilot; il consumo avviene presso il provider e non scala la quota di richieste Copilot
14 luglio 2026Custom OpenAI-compatible endpoints in Copilot per JetBrains — su tutti i piani

Collegamento di JoinGonka Gateway: passo dopo passo

Ti serve una chiave jg-…, rilasciata al momento della registrazione sul gateway insieme a 3M token gratuiti per iniziare; nessuna carta richiesta. La chiave e il modello si configurano separatamente in ogni client Copilot — qui sotto trovi tre percorsi.

VS Code — provider Custom Endpoint. Questo è il percorso attuale: il vecchio provider «OpenAI Compatible» e l'impostazione github.copilot.chat.customOAIModels sono stati dichiarati obsoleti.

PassoAzione
1. Editor dei modelliPalette dei comandi → Chat: Manage Language Models (o l'ingranaggio nella lista dei modelli della chat)
2. ProviderAdd Models → Custom Endpoint; nome del gruppo, ad esempio JoinGonka
3. ChiaveIncolla la tua jg-… — VS Code la archivia nel proprio storage protetto, non in un file
4. Tipo di APIChat Completions
5. ModelliVS Code aprirà chatLanguageModels.json — sostituisci l'array "models" del nuovo gruppo con il blocco qui sotto e salva il file
6. SelezioneScegli il modello nella lista dei modelli della chat; se non compare, riavvia VS Code
"models": [
  {
    "id": "deepseek-ai/DeepSeek-V4-Flash-0731",
    "name": "DeepSeek V4 Flash (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 347232,
    "maxOutputTokens": 32768
  },
  {
    "id": "MiniMaxAI/MiniMax-M2.7",
    "name": "MiniMax M2.7 (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 191808,
    "maxOutputTokens": 8192
  },
  {
    "id": "zai-org/GLM-5.3-Flash",
    "name": "GLM 5.3 Flash (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 381808,
    "maxOutputTokens": 8192
  }
]

maxInputTokens è la finestra di contesto del modello meno il tetto della risposta: insieme a maxOutputTokens definisce la finestra. Senza toolCalling: true il modello non compare nella lista quando si lavora con gli agenti.

Copilot CLI — solo variabili d'ambiente. Il provider non ha un file di configurazione: i valori si impostano nella shell da cui lanci copilot:

export COPILOT_PROVIDER_BASE_URL=https://gate.joingonka.ai/v1
export COPILOT_PROVIDER_TYPE=openai
export COPILOT_PROVIDER_API_KEY=jg-your-key
export COPILOT_MODEL=deepseek-ai/DeepSeek-V4-Flash-0731
export COPILOT_PROVIDER_MAX_PROMPT_TOKENS=347232
export COPILOT_PROVIDER_MAX_OUTPUT_TOKENS=32768
copilot

I nomi COPILOT_PROVIDER_* vengono letti solo da Copilot CLI, quindi questa configurazione non tocca gli altri tuoi strumenti. Dal modello, la CLI richiede tool calling e streaming: tutte le model della rete ne sono capaci.

JetBrains — plugin GitHub Copilot. Apri Copilot Chat → lista dei modelli → Manage Models, scegli il provider con endpoint compatibile OpenAI, premi Add Models e inserisci il Base URL https://gate.joingonka.ai/v1, la chiave jg-… e l'identificatore del modello. Premi Save, seleziona il modello sotto la tua chiave e salva di nuovo — comparirà nella lista accanto a quelli integrati.

Consiglio. Il comando npx @joingonka/setup --tool copilot-byok stampa tutte e tre le sezioni già con la tua chiave e i limiti reali del modello scelto — incluso l'array "models" pronto per VS Code — e verifica con una richiesta reale che il gateway accetti chiave e modello. Non scrive file: ogni client Copilot conserva la chiave nel proprio storage.

Quale modello di rete scegliere

Tutti e tre i modelli della rete supportano streaming e tool calling. deepseek-ai/DeepSeek-V4-Flash-0731 — uno dei contesti più lunghi della rete (380K token) e l'output più ampio, fino a 32768 token: sceglilo per grandi repository e lunghe sessioni agentiche. MiniMaxAI/MiniMax-M2.7 — universale, output fino a 8192 token. zai-org/GLM-5.3-Flash — modello di reasoning di Z.ai con il contesto più lungo della rete (390K token): ragiona prima di rispondere, output fino a 8192 token; una parte del budget di risposta viene utilizzata per il ragionamento, quindi non impostare limiti di output troppo bassi nelle impostazioni.

Limiti della public preview — onestamente

Il BYOK copre le sessioni agente e la chat; i suggerimenti inline e la ricerca semantica nel progetto rimangono sui modelli Copilot e richiedono un account GitHub: questa è una limitazione di Copilot stesso, non del provider. In Copilot Business e Enterprise, il BYOK locale è gestito dalla politica dell'amministratore («Bring Your Own Language Model Key»): se la voce non è presente nell'interfaccia, è disattivata a livello di organizzazione. Le attività di Vision tramite gateway non funzionano: i modelli di rete sono solo testuali. Se lo strumento invia richieste nel formato Responses API, il gateway le accetta: POST /v1/responses, lo streaming e i function tools funzionano. Non memorizziamo i dialoghi, quindi store viene ignorato e previous_response_id restituirà un errore: trasmetti l'intera cronologia in input.

Il BYOK trasforma Copilot da un abbonamento con limiti a una shell sopra la tua inferenza. In VS Code — Chat: Manage Language Models → Add Models → Custom Endpoint, nella Copilot CLI — variabili COPILOT_PROVIDER_*, in JetBrains — Manage Models → Add Models; indirizzo gate.joingonka.ai/v1 e chiave jg- e le sessioni agente utilizzano i modelli della rete Gonka ai suoi prezzi live, senza intaccare la quota di richieste di Copilot. Inizia con i token gratuiti iniziali.

Vuoi saperne di più?

Esplora altre sezioni o inizia a guadagnare GNK subito.

Ricevi token gratuiti →