Seções da Base de Conhecimento ▾

Navegação

▸ Comece aqui Por funções

Categorias

Ferramentas 52
Glossário 12

Ferramentas

GitHub Copilot BYOK: seus modelos em vez da cota

BYOK (bring your own key) é o mecanismo oficial do GitHub Copilot que permite conectar seu próprio provedor de modelos e trabalhar em sessões de agente usando-o, em vez dos modelos integrados GPT e Claude. Desde janeiro de 2026, é suportado qualquer endpoint compatível com OpenAI; desde 23 de junho, o BYOK está disponível no próprio aplicativo Copilot em public preview em todos os planos pagos, e desde 14 de julho, também na versão para JetBrains. Isso significa que você pode manter o Copilot como uma interface e realizar o inference através do JoinGonka Gateway, com os preços da rede descentralizada Gonka e sem consumir as solicitações premium da sua assinatura. No VS Code, para o BYOK, não são necessários um plano Copilot nem login na conta GitHub.

O que o BYOK oferece e quando você precisa dele

A assinatura do Copilot limita as premium-requests mensais: sessões de agentes, refatorações e tarefas de múltiplos passos consomem a cota mais rapidamente. O BYOK redireciona essas chamadas para o seu provedor: o consumo é tarifado segundo os preços dele e não desconta a premium-quota do Copilot. As chaves são armazenadas no keychain do sistema e a interface não consegue lê-las de volta.

O BYOK é justificado se você atinge seu limite, deseja modelos com pesos abertos ou paga muito menos pela inferência: a rede Gonka oferece os mesmos modelos open-source centenas de vezes mais baratos que os preços dos vendedores — os preços atuais estão sempre na lista de preços em tempo real do gateway.

Cronologia: o que e quando foi incluído

QuandoO que surgiu
Novembro 2025BYOK em public preview: Anthropic, OpenAI, xAI, Microsoft Foundry; modos Agent, Plan, Ask, Edit no VS Code, JetBrains, Eclipse, Xcode
Janeiro 2026Suporte para qualquer provedor compatível com OpenAI + AWS Bedrock e Google AI Studio; modelos com Responses API
23 de junho de 2026BYOK no aplicativo GitHub Copilot — public preview para todos os planos pagos
18 de junho de 2026VS Code: BYOK funciona sem login no GitHub e sem plano Copilot; o consumo ocorre no provedor e não desconta da cota de solicitações do Copilot
14 de julho de 2026Endpoints personalizados compatíveis com OpenAI no Copilot para JetBrains — em todos os planos

Conexão do JoinGonka Gateway: passo a passo

Você vai precisar de uma chave jg-… — ela é entregue no cadastro no gateway junto com 3M tokens gratuitos iniciais, sem precisar de cartão. A chave e o modelo são configurados separadamente em cada cliente Copilot — veja abaixo três caminhos.

VS Code — provedor Custom Endpoint. Este é o caminho atual: o antigo provedor «OpenAI Compatible» e a configuração github.copilot.chat.customOAIModels foram marcados como obsoletos.

PassoAção
1. Editor de modelosPaleta de comandos → Chat: Manage Language Models (ou a engrenagem na lista de modelos do chat)
2. ProvedorAdd Models → Custom Endpoint; o nome do grupo — por exemplo, JoinGonka
3. ChaveCole sua jg-… — o VS Code a guarda no próprio cofre seguro, não em um arquivo
4. Tipo de APIChat Completions
5. ModelosO VS Code vai abrir o chatLanguageModels.json — substitua o array "models" do novo grupo pelo bloco abaixo e salve o arquivo
6. SeleçãoEscolha o modelo na lista de modelos do chat; se ele não aparecer, reinicie o VS Code
"models": [
  {
    "id": "deepseek-ai/DeepSeek-V4-Flash-0731",
    "name": "DeepSeek V4 Flash (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 347232,
    "maxOutputTokens": 32768
  },
  {
    "id": "MiniMaxAI/MiniMax-M2.7",
    "name": "MiniMax M2.7 (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 191808,
    "maxOutputTokens": 8192
  },
  {
    "id": "zai-org/GLM-5.3-Flash",
    "name": "GLM 5.3 Flash (Gonka)",
    "url": "https://gate.joingonka.ai/v1/chat/completions",
    "toolCalling": true,
    "vision": false,
    "maxInputTokens": 381808,
    "maxOutputTokens": 8192
  }
]

maxInputTokens é a janela de contexto do modelo menos o teto de resposta: junto com maxOutputTokens, é o que define a janela. Sem toolCalling: true o modelo não aparece na lista ao trabalhar com agentes.

Copilot CLI — apenas variáveis de ambiente. Esse provedor não tem arquivo de configuração: os valores são definidos no shell de onde você executa o copilot:

export COPILOT_PROVIDER_BASE_URL=https://gate.joingonka.ai/v1
export COPILOT_PROVIDER_TYPE=openai
export COPILOT_PROVIDER_API_KEY=jg-your-key
export COPILOT_MODEL=deepseek-ai/DeepSeek-V4-Flash-0731
export COPILOT_PROVIDER_MAX_PROMPT_TOKENS=347232
export COPILOT_PROVIDER_MAX_OUTPUT_TOKENS=32768
copilot

Os nomes COPILOT_PROVIDER_* são lidos apenas pelo Copilot CLI, então essa configuração não interfere nas suas outras ferramentas. Do modelo, a CLI exige tool calling e streaming — todos os modelos da rede dão conta disso.

JetBrains — plugin do GitHub Copilot. Abra o Copilot Chat → lista de modelos → Manage Models, escolha um provedor com endpoint compatível com OpenAI, clique em Add Models e informe o Base URL https://gate.joingonka.ai/v1, a chave jg-… e o identificador do modelo. Clique em Save, marque o modelo sob a sua chave e salve de novo — ele vai aparecer na lista ao lado dos integrados.

Dica. O comando npx @joingonka/setup --tool copilot-byok imprime as três seções já com a sua chave e os limites reais do modelo escolhido — incluindo o array "models" pronto para o VS Code — e, com uma requisição ao vivo, verifica que o gateway aceita a chave e o modelo. Ele não grava arquivos: cada cliente Copilot guarda a chave no próprio cofre.

Qual modelo de rede escolher

Todos os três modelos da rede suportam streaming e tool calling. deepseek-ai/DeepSeek-V4-Flash-0731 — possui um dos contextos mais longos da rede (380K tokens) e a maior saída, até 32768 tokens: use-o para grandes repositórios e longas sessões de agentes. MiniMaxAI/MiniMax-M2.7 — universal, saída até 8192 tokens. zai-org/GLM-5.3-Flash — modelo de raciocínio da Z.ai com o contexto mais longo da rede (390K tokens): raciocina antes de responder, saída até 8192 tokens; parte do orçamento de resposta vai para o raciocínio, portanto, não reduza o limite de saída nas configurações.

Limitações do public preview — com honestidade

O BYOK cobre sessões de agentes e chat; as sugestões inline e a busca semântica no projeto permanecem nos modelos do Copilot e exigem uma conta GitHub — esta é uma limitação do próprio Copilot, não do provedor. No Copilot Business e Enterprise, o BYOK local é gerenciado por políticas do administrador («Bring Your Own Language Model Key»): se a opção não estiver na interface, ela está desabilitada no nível da organização. Tarefas de visão não funcionam através do gateway: os modelos da rede são textuais. Se uma ferramenta envia solicitações no formato Responses API, o gateway as aceitará: POST /v1/responses, o streaming e as function tools funcionam. Não armazenamos diálogos, portanto, store é ignorado e previous_response_id retornará um erro — passe o histórico completo em input.

O BYOK transforma o Copilot de uma assinatura com limites em uma interface sobre sua inferência. No VS Code — Chat: Manage Language Models → Add Models → Custom Endpoint, no Copilot CLI — variáveis COPILOT_PROVIDER_*, no JetBrains — Manage Models → Add Models; o endereço gate.joingonka.ai/v1 e a chave jg- — e as sessões de agentes usam os modelos da rede Gonka a preços reais de mercado, sem tocar na cota de solicitações do Copilot. Comece com os tokens iniciais gratuitos.

Quer saber mais?

Explore outras seções ou comece a ganhar GNK agora mesmo.

Obter tokens gratuitos →