Seções da Base de Conhecimento ▾
Navegação
▸ Comece aqui Por funçõesCategorias
- Cursor + Gonka AI — LLM barato para codificação
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — agentes AI acessíveis
- OpenCode: seu próprio modelo no terminal
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — agente AI no VS Code
- Aider + Gonka AI — programação em par com AI
- LangChain + Gonka AI — aplicativos AI por uma fração do custo
- n8n + Gonka AI — automação com AI barata
- Open WebUI + Gonka AI — seu próprio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código aberto
- Hermes Agent + DeepSeek na rede Gonka: agente autônomo por centavos
- Kilo Code + Gonka AI — Agente de IA no VS Code
- Roo Code + Gonka AI — Agente de IA autônomo no VS Code
- LlamaIndex + Gonka AI — Aplicações RAG por alguns centavos
- PydanticAI + Gonka — Agentes de IA tipificados por alguns centavos
- Vercel AI SDK + Gonka AI — Aplicações de IA em TypeScript por centavos
- TanStack AI + Gonka — Aplicativos de IA em TypeScript por centavos
- API início rápido — curl, Python, TypeScript
- JoinGonka Gateway — Visão geral completa
- Management Keys — SaaS na Gonka
- A API de IA mais barata: comparativo de provedores 2026
- Como comprar tokens de AI e chave API: 3 formas em 2026
- Limite de solicitações do Cursor Pro esgotado — análise e uma alternativa barata
- Claude Code mais barato — análise de fatura e mudança de serviço
- Cline queima dinheiro — por que o agente gasta tanto
- OpenClaw custa caro — porque o agente queima tokens e como economizar
- OpenRouter: alternativa barata — comparativo com JoinGonka Gateway
- O melhor modelo de IA para codificação em 2026: comparação e preços
- Alternativa barata ao GitHub Copilot sem limites
- Alternativa barata ao Windsurf sem créditos e sem limites
- A API mais barata para agentes de IA em 2026
- ZCode: inferência GLM barata em vez do GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — seu próprio endpoint em vez de créditos
- GitHub Copilot BYOK: seus modelos em vez da cota
- Zed + JoinGonka Gateway — inferência barata no editor
- Pi + JoinGonka Gateway — agente terminal em inferência barata
- Codex CLI: sua própria chave em vez de assinatura
- DeepSeek Harness: seu próprio provedor via JoinGonka Gateway
- MiniMax Code: agente MiniMax com sua própria chave via Gonka
- Warp + JoinGonka Gateway — agente de terminal em seu próprio endpoint
- Trae + JoinGonka Gateway — modelos da rede Gonka no AI-IDE
- Cherry Studio + JoinGonka Gateway — cliente de IA desktop
- omp (Oh My Pi) + JoinGonka Gateway: agente com papéis de modelos
- OpenHands + JoinGonka Gateway: agente em seu próprio endpoint
- Qwen Code após o fim do qwen-oauth: trabalhando via JoinGonka Gateway
- Goose + JoinGonka Gateway: seu próprio provedor e chave no keyring
- Crush + JoinGonka Gateway: agente Charm em modelos da rede Gonka
- Zoo Code + JoinGonka Gateway: migração do Roo Code para modelos Gonka
- Kimi Code CLI: agente Moonshot AI com sua própria chave via Gonka
- Factory Droid + JoinGonka Gateway: BYOK em modelos da rede Gonka
- MiMo Code + JoinGonka Gateway: agente Xiaomi em modelos da rede Gonka
Ferramentas
GitHub Copilot BYOK: seus modelos em vez da cota
BYOK (bring your own key) é o mecanismo oficial do GitHub Copilot que permite conectar seu próprio provedor de modelos e trabalhar em sessões de agente usando-o, em vez dos modelos integrados GPT e Claude. Desde janeiro de 2026, é suportado qualquer endpoint compatível com OpenAI; desde 23 de junho, o BYOK está disponível no próprio aplicativo Copilot em public preview em todos os planos pagos, e desde 14 de julho, também na versão para JetBrains. Isso significa que você pode manter o Copilot como uma interface e realizar o inference através do JoinGonka Gateway, com os preços da rede descentralizada Gonka e sem consumir as solicitações premium da sua assinatura. No VS Code, para o BYOK, não são necessários um plano Copilot nem login na conta GitHub.
O que o BYOK oferece e quando você precisa dele
A assinatura do Copilot limita as premium-requests mensais: sessões de agentes, refatorações e tarefas de múltiplos passos consomem a cota mais rapidamente. O BYOK redireciona essas chamadas para o seu provedor: o consumo é tarifado segundo os preços dele e não desconta a premium-quota do Copilot. As chaves são armazenadas no keychain do sistema e a interface não consegue lê-las de volta.
O BYOK é justificado se você atinge seu limite, deseja modelos com pesos abertos ou paga muito menos pela inferência: a rede Gonka oferece os mesmos modelos open-source centenas de vezes mais baratos que os preços dos vendedores — os preços atuais estão sempre na lista de preços em tempo real do gateway.
Cronologia: o que e quando foi incluído
| Quando | O que surgiu |
|---|---|
| Novembro 2025 | BYOK em public preview: Anthropic, OpenAI, xAI, Microsoft Foundry; modos Agent, Plan, Ask, Edit no VS Code, JetBrains, Eclipse, Xcode |
| Janeiro 2026 | Suporte para qualquer provedor compatível com OpenAI + AWS Bedrock e Google AI Studio; modelos com Responses API |
| 23 de junho de 2026 | BYOK no aplicativo GitHub Copilot — public preview para todos os planos pagos |
| 18 de junho de 2026 | VS Code: BYOK funciona sem login no GitHub e sem plano Copilot; o consumo ocorre no provedor e não desconta da cota de solicitações do Copilot |
| 14 de julho de 2026 | Endpoints personalizados compatíveis com OpenAI no Copilot para JetBrains — em todos os planos |
Conexão do JoinGonka Gateway: passo a passo
Você vai precisar de uma chave jg-… — ela é entregue no cadastro no gateway junto com 3M tokens gratuitos iniciais, sem precisar de cartão. A chave e o modelo são configurados separadamente em cada cliente Copilot — veja abaixo três caminhos.
VS Code — provedor Custom Endpoint. Este é o caminho atual: o antigo provedor «OpenAI Compatible» e a configuração github.copilot.chat.customOAIModels foram marcados como obsoletos.
| Passo | Ação |
|---|---|
| 1. Editor de modelos | Paleta de comandos → Chat: Manage Language Models (ou a engrenagem na lista de modelos do chat) |
| 2. Provedor | Add Models → Custom Endpoint; o nome do grupo — por exemplo, JoinGonka |
| 3. Chave | Cole sua jg-… — o VS Code a guarda no próprio cofre seguro, não em um arquivo |
| 4. Tipo de API | Chat Completions |
| 5. Modelos | O VS Code vai abrir o chatLanguageModels.json — substitua o array "models" do novo grupo pelo bloco abaixo e salve o arquivo |
| 6. Seleção | Escolha o modelo na lista de modelos do chat; se ele não aparecer, reinicie o VS Code |
"models": [
{
"id": "deepseek-ai/DeepSeek-V4-Flash-0731",
"name": "DeepSeek V4 Flash (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 347232,
"maxOutputTokens": 32768
},
{
"id": "MiniMaxAI/MiniMax-M2.7",
"name": "MiniMax M2.7 (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 191808,
"maxOutputTokens": 8192
},
{
"id": "zai-org/GLM-5.3-Flash",
"name": "GLM 5.3 Flash (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 381808,
"maxOutputTokens": 8192
}
]maxInputTokens é a janela de contexto do modelo menos o teto de resposta: junto com maxOutputTokens, é o que define a janela. Sem toolCalling: true o modelo não aparece na lista ao trabalhar com agentes.
Copilot CLI — apenas variáveis de ambiente. Esse provedor não tem arquivo de configuração: os valores são definidos no shell de onde você executa o copilot:
export COPILOT_PROVIDER_BASE_URL=https://gate.joingonka.ai/v1
export COPILOT_PROVIDER_TYPE=openai
export COPILOT_PROVIDER_API_KEY=jg-your-key
export COPILOT_MODEL=deepseek-ai/DeepSeek-V4-Flash-0731
export COPILOT_PROVIDER_MAX_PROMPT_TOKENS=347232
export COPILOT_PROVIDER_MAX_OUTPUT_TOKENS=32768
copilotOs nomes COPILOT_PROVIDER_* são lidos apenas pelo Copilot CLI, então essa configuração não interfere nas suas outras ferramentas. Do modelo, a CLI exige tool calling e streaming — todos os modelos da rede dão conta disso.
JetBrains — plugin do GitHub Copilot. Abra o Copilot Chat → lista de modelos → Manage Models, escolha um provedor com endpoint compatível com OpenAI, clique em Add Models e informe o Base URL https://gate.joingonka.ai/v1, a chave jg-… e o identificador do modelo. Clique em Save, marque o modelo sob a sua chave e salve de novo — ele vai aparecer na lista ao lado dos integrados.
Dica. O comando npx @joingonka/setup --tool copilot-byok imprime as três seções já com a sua chave e os limites reais do modelo escolhido — incluindo o array "models" pronto para o VS Code — e, com uma requisição ao vivo, verifica que o gateway aceita a chave e o modelo. Ele não grava arquivos: cada cliente Copilot guarda a chave no próprio cofre.
Qual modelo de rede escolher
Todos os três modelos da rede suportam streaming e tool calling. deepseek-ai/DeepSeek-V4-Flash-0731 — possui um dos contextos mais longos da rede (380K tokens) e a maior saída, até 32768 tokens: use-o para grandes repositórios e longas sessões de agentes. MiniMaxAI/MiniMax-M2.7 — universal, saída até 8192 tokens. zai-org/GLM-5.3-Flash — modelo de raciocínio da Z.ai com o contexto mais longo da rede (390K tokens): raciocina antes de responder, saída até 8192 tokens; parte do orçamento de resposta vai para o raciocínio, portanto, não reduza o limite de saída nas configurações.
Limitações do public preview — com honestidade
O BYOK cobre sessões de agentes e chat; as sugestões inline e a busca semântica no projeto permanecem nos modelos do Copilot e exigem uma conta GitHub — esta é uma limitação do próprio Copilot, não do provedor. No Copilot Business e Enterprise, o BYOK local é gerenciado por políticas do administrador («Bring Your Own Language Model Key»): se a opção não estiver na interface, ela está desabilitada no nível da organização. Tarefas de visão não funcionam através do gateway: os modelos da rede são textuais. Se uma ferramenta envia solicitações no formato Responses API, o gateway as aceitará: POST /v1/responses, o streaming e as function tools funcionam. Não armazenamos diálogos, portanto, store é ignorado e previous_response_id retornará um erro — passe o histórico completo em input.