Seções da Base de Conhecimento ▾
Navegação
▸ Comece aqui Por funçõesCategorias
- Cursor + Gonka AI — LLM barato para codificação
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — agentes AI acessíveis
- OpenCode: seu próprio modelo no terminal
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — agente AI no VS Code
- Aider + Gonka AI — programação em par com AI
- LangChain + Gonka AI — aplicativos AI por uma fração do custo
- n8n + Gonka AI — automação com AI barata
- Open WebUI + Gonka AI — seu próprio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código aberto
- Hermes Agent + DeepSeek na rede Gonka: agente autônomo por centavos
- Kilo Code + Gonka AI — Agente de IA no VS Code
- Roo Code + Gonka AI — Agente de IA autônomo no VS Code
- LlamaIndex + Gonka AI — Aplicações RAG por alguns centavos
- PydanticAI + Gonka — Agentes de IA tipificados por alguns centavos
- Vercel AI SDK + Gonka AI — Aplicações de IA em TypeScript por centavos
- TanStack AI + Gonka — Aplicativos de IA em TypeScript por centavos
- API início rápido — curl, Python, TypeScript
- JoinGonka Gateway — Visão geral completa
- Management Keys — SaaS na Gonka
- A API de IA mais barata: comparativo de provedores 2026
- Como comprar tokens de AI e chave API: 3 formas em 2026
- Limite de solicitações do Cursor Pro esgotado — análise e uma alternativa barata
- Claude Code mais barato — análise de fatura e mudança de serviço
- Cline queima dinheiro — por que o agente gasta tanto
- OpenClaw custa caro — porque o agente queima tokens e como economizar
- OpenRouter: alternativa barata — comparativo com JoinGonka Gateway
- O melhor modelo de IA para codificação em 2026: comparação e preços
- Alternativa barata ao GitHub Copilot sem limites
- Alternativa barata ao Windsurf sem créditos e sem limites
- A API mais barata para agentes de IA em 2026
- ZCode: inferência GLM barata em vez do GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — seu próprio endpoint em vez de créditos
- GitHub Copilot BYOK: seus modelos em vez da cota
- Zed + JoinGonka Gateway — inferência barata no editor
- Pi + JoinGonka Gateway — agente terminal em inferência barata
- Codex CLI: sua própria chave em vez de assinatura
- DeepSeek Harness: seu próprio provedor via JoinGonka Gateway
- MiniMax Code: agente MiniMax com sua própria chave via Gonka
- Warp + JoinGonka Gateway — agente de terminal em seu próprio endpoint
- Trae + JoinGonka Gateway — modelos da rede Gonka no AI-IDE
- Cherry Studio + JoinGonka Gateway — cliente de IA desktop
- omp (Oh My Pi) + JoinGonka Gateway: agente com papéis de modelos
- OpenHands + JoinGonka Gateway: agente em seu próprio endpoint
- Qwen Code após o fim do qwen-oauth: trabalhando via JoinGonka Gateway
- Goose + JoinGonka Gateway: seu próprio provedor e chave no keyring
- Crush + JoinGonka Gateway: agente Charm em modelos da rede Gonka
- Zoo Code + JoinGonka Gateway: migração do Roo Code para modelos Gonka
- Kimi Code CLI: agente Moonshot AI com sua própria chave via Gonka
- Factory Droid + JoinGonka Gateway: BYOK em modelos da rede Gonka
- MiMo Code + JoinGonka Gateway: agente Xiaomi em modelos da rede Gonka
Ferramentas
Warp + JoinGonka Gateway — agente de terminal em seu próprio endpoint
Warp é um terminal que se transformou em um ambiente de desenvolvimento por agentes: o Warp Agent integrado lê a saída de comandos, edita arquivos, executa builds e conduz a tarefa do pedido ao resultado. Por padrão, o agente trabalha com modelos vendidos pelo próprio Warp — via créditos de plano — e, por muito tempo, trazer sua própria inferência só era possível em planos pagos e via chaves da OpenAI, Anthropic ou Google. Em 20 de maio de 2026, o Warp abriu o BYOK no plano gratuito e adicionou o custom inference endpoint — a conexão de qualquer serviço que fale OpenAI Chat Completions.
Este segundo método é necessário para direcionar o agente do Warp através do JoinGonka Gateway: o gateway fornece modelos da rede descentralizada Gonka via API compatível com OpenAI, a inferência é paga conforme os preços reais da rede e, para usuários individuais ou pequenas equipes, os créditos do Warp não são consumidos. Após o registro e a confirmação do endereço, você receberá 3M de tokens gratuitos — o suficiente para testar o agente em suas tarefas antes da primeira recarga.
Abaixo, detalhamos o que é necessário antes de começar, quais valores inserir no formulário do Warp, como garantir que as solicitações passem pelo gateway, qual modelo de rede escolher para tarefas de terminal e o que é importante saber sobre a rota das solicitações: no Warp, ela funciona de forma diferente da maioria das ferramentas.
O que será necessário: chave, plano do Warp e endereço público
Chave JoinGonka. Registre-se no gateway, abra a seção "API-keys" no painel e clique em "Criar chave". A chave começa com jg- e é exibida apenas uma vez — salve-a imediatamente. É conveniente criar uma chave separada para o Warp: assim, na seção "Uso", o consumo do agente de terminal será visto em uma linha separada, sem se misturar com outras ferramentas.
Plano do Warp. Seu próprio endpoint está disponível não apenas em planos pagos — as condições dependem do tamanho da equipe:
| Quem conecta | O endpoint próprio está disponível? | O que acontece com os créditos do Warp? |
|---|---|---|
| Um desenvolvedor ou empresa de até 10 pessoas (planos Free, Build, Max) | Sim, em qualquer um desses planos | Créditos não são deduzidos por inferência via seu próprio endpoint |
| Organização acima de 10 pessoas | Apenas no Business ou Enterprise | As execuções locais do agente consomem platform credits (taxa de infraestrutura do Warp com desconto); a inferência em si é paga ao provedor do endpoint |
Endereço HTTPS público. Este é um requisito do Warp que pode não ser óbvio: as solicitações para seu endpoint não são enviadas pelo aplicativo em sua máquina, mas pelos servidores do Warp, por isso o endereço deve estar acessível pela Internet. O formulário rejeita localhost, 127.0.0.1 e endereços de redes privadas, e apenas o esquema https:// é aceito. O JoinGonka Gateway é um serviço HTTPS público, portanto, túneis como ngrok, recomendados pela documentação do Warp para modelos locais, não são necessários aqui.
Versão atualizada do aplicativo. O endpoint próprio está incluído na versão estável desde o lançamento de 20 de maio de 2026, e a seleção do esquema de API no formulário apareceu na versão de 31 de julho de 2026. Se o campo API schema não estiver no formulário, atualize o Warp.
Conexão: formulário Add custom endpoint
Toda a configuração é feita na interface do aplicativo — não é preciso editar arquivos à mão.
- Abra Settings e digite
inference endpointna busca de configurações — o Warp vai até o bloco com as chaves dos provedores e os endpoints próprios (ele fica na página de configurações do Warp Agent). - Clique em Add custom endpoint — o formulário vai abrir.
- Preencha os campos com os valores da tabela e clique em Add endpoint.
| Campo do formulário | O que colocar | Explicação |
|---|---|---|
| API schema | OpenAI Chat Completions | Esquema padrão: é justamente para ele que a documentação do Warp descreve o formato do endereço. Na lista também há OpenAI Responses e Anthropic Messages |
| Endpoint name | JoinGonka | Qualquer nome — é por ele que o endpoint aparece nas configurações |
| Endpoint URL | https://gate.joingonka.ai/v1 | Endereço base junto com /v1 — igual ao exemplo da documentação do Warp |
| API key | jg-your-key | Fica armazenada apenas no dispositivo, no cofre de chaves do sistema |
| Model name | deepseek-ai/DeepSeek-V4-Flash-0731 | Identificador exato do modelo, como o gateway o entrega |
| Model alias (optional) | DeepSeek V4 Flash | Nome curto para o seletor de modelos |
O botão + Add model adiciona a próxima linha. Cadastre de uma vez todos os modelos da rede para depois alternar entre eles sem voltar às configurações: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 e zai-org/GLM-5.3-Flash. A lista atualizada é sempre entregue por GET https://gate.joingonka.ai/v1/models. Digite os identificadores caractere por caractere: o formulário só verifica o formato do endereço e se os campos estão preenchidos, não faz nenhuma requisição de teste ao salvar, então um erro de digitação no nome do modelo só vai aparecer já no diálogo com o agente.
Depois de salvar, os modelos aparecem no seletor de modelos do agente. Se o modelo padrão continuava sendo um dos modelos do Warp, o aplicativo pode sugerir trocá-lo — aceite e escolha o modelo do seu endpoint. Um detalhe importante: as opções Auto do seletor sempre rodam na infraestrutura do Warp e consomem os créditos dele, mesmo com o seu endpoint configurado. Para que a requisição vá para o gateway, é preciso que um modelo específico da sua lista esteja selecionado no seletor.
Verificação: se as solicitações estão passando pelo gateway
Selecione o modelo do seu endpoint no seletor e dê ao agente uma tarefa curta, por exemplo: «Mostre os cinco maiores arquivos no diretório atual e explique o comando». O agente deve sugerir o comando, executá-lo com sua permissão e comentar a saída.
Agora abra o painel do gateway, seção «Uso». No bloco «Por chaves», a chave configurada para o Warp mostrará as solicitações e o horário do último acesso; no bloco «Por modelos», aparecerá o modelo escolhido. Se os contadores estiverem aumentando, a inferência está passando pelo JoinGonka Gateway, e não consumindo créditos do Warp. Por sua vez, o Warp mostra o consumo de tokens diretamente no diálogo com o agente — sob os nomes curtos que você definiu no campo alias.
Se algo der errado, a causa geralmente pode ser lida na resposta:
| O que aparece | O que significa | O que fazer |
|---|---|---|
401, Invalid API key | O gateway não reconheceu a chave | Verifique se a chave começa com jg-, se foi inserida sem espaços e se está ativa na seção «API-keys»; em caso de dúvida, crie uma nova |
404, Invalid URL (POST …) | O caminho foi montado com um segmento extra; no texto do erro, o gateway mostra exatamente para onde a solicitação foi enviada | Deve resultar em /v1/chat/completions. Se /v1 duplicou ou o endereço contém o caminho completo, ajuste a Endpoint URL para o formato da tabela acima |
405 Not Allowed ou página HTML em vez de resposta | Falta /v1 no endereço, a solicitação passou por fora da API | Adicione /v1 ao final do endereço |
429 | O modelo está sobrecarregado: nos horários de pico, a capacidade de um modelo específico na rede pode estar esgotada | Tente novamente em alguns segundos ou mude para um modelo próximo — por isso vale a pena cadastrar todos de uma vez |
| As solicitações passam, mas os créditos do Warp diminuem | O modo Auto ou o roteador de modelos do Warp está selecionado no seletor, e não o modelo do endpoint | Selecione o modelo específico da sua lista |
| O formulário não aceita o endereço | O Warp exige https:// e um host público | Insira o endereço completo do gateway, começando com https:// |
| O modelo «não vê» a imagem anexada | Os modelos da rede são baseados em texto: o gateway substitui a imagem por uma nota textual | Para tarefas com capturas de tela, mude para um modelo com visão; para comandos e código, permaneça nos modelos da rede |
| O modelo do endpoint não aparece ao iniciar na nuvem | Seu endpoint é armazenado localmente e não é replicado para Cloud Agents | Execute a tarefa usando o agente local |
A primeira resposta na sessão pode levar alguns segundos para chegar: o agente envia um grande prompt de sistema com a descrição das ferramentas, e a solicitação passa primeiro pelos servidores do Warp e depois pelo nó da rede. Depois disso, o diálogo flui mais rapidamente.
Qual modelo escolher para o agente de terminal
O preço dos modelos da rede é o mesmo, por isso a escolha é sobre o comportamento, não sobre o orçamento. O agente de terminal lê muito (saída de comandos, logs, arquivos) e chama ferramentas constantemente; todos os modelos da tabela suportam tool calling nativo.
| Modelo | Identificador | Contexto e resposta | Quando usar no Warp |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K, resposta até 32768 tokens | Modelo padrão para o agente: sessões longas, logs grandes e diffs, edições em vários arquivos. Reserva de contexto e o maior teto de resposta da rede |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K, resposta até 8192 tokens | Tarefas curtas e rápidas: escolher um comando, analisar um erro, corrigir um arquivo de configuração |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K, resposta até 8192 tokens | Modelo de raciocínio: reflete antes de responder. Depuração confusa, plano de migração, análise de código desconhecido; a resposta chega mais tarde e parte do limite de resposta é destinada ao raciocínio |
Esquema prático: DeepSeek V4 Flash como modelo principal, MiniMax M2.7 para coisas menores, GLM-5.3 Flash quando a tarefa depende da lógica e não do volume. Alternar leva um segundo porque todos os modelos já estão configurados no endpoint, e nomes curtos no campo alias evitam confusão com identificadores longos. Mais detalhes sobre o mais usado na análise do DeepSeek V4 Flash.
Quanto custa
O consumo de tokens do agente no terminal é maior do que no chat: para cada solicitação, o Warp adiciona instruções do sistema, contexto do diálogo e descrição das ferramentas, e cada tarefa consiste em vários passos. Por isso, o preço por token aqui é mais importante do que em uma conversa comum.
Através do JoinGonka Gateway, os tokens custam $0.0069 por milhão na entrada e $0.021 por milhão na saída — o preço é igual para todos os modelos da rede e é carregado nesta página a partir de uma fonte em tempo real. Ordem de grandeza dos preços em setembro de 2026:
| Cenário | Consumo | Via Gateway |
|---|---|---|
| Tarefa única: comando e análise da sua saída | dezenas de milhares de tokens | frações de centavo |
| Dia de trabalho ativo com o agente | 3-7M de tokens | alguns centavos |
| Mês de trabalho diário | ~150M de tokens | cerca de um ou dois dólares |
Para comparação, três formas de pagar o agente Warp:
| Método | Quem contabiliza a inferência | O que limita |
|---|---|---|
| Modelos Warp | Warp, por créditos do plano | Reserva mensal de créditos do plano |
| BYOK: chave OpenAI, Anthropic ou Google | Fornecedor do modelo pela sua tarifa | Preço por milhão de tokens do fornecedor |
| Endpoint próprio + JoinGonka Gateway | Gateway: por tokens, do saldo | Apenas saldo: consumo visível no painel, sem cotas de número de solicitações |
O Warp não cobra créditos de indivíduos e equipes de até 10 pessoas por trabalhar através do próprio endpoint — você paga apenas pelos tokens no gateway. O saldo é recarregado no painel, onde o saldo restante e o consumo por dias e modelos também podem ser vistos.
Rota de solicitações e privacidade: o que é importante saber
Para a maioria das ferramentas, um endpoint próprio significa «as solicitações vão da minha máquina diretamente para o provedor». Com Warp é diferente: a parte de execução do agente funciona nos servidores da Warp, e um endpoint próprio apenas altera o destino final e a chave. De acordo com a documentação da Warp, o caminho da solicitação é o seguinte:
- O aplicativo obtém o endereço do endpoint e a chave de um armazenamento seguro no dispositivo e os envia para os servidores da Warp junto com seu prompt.
- O agente no lado da Warp monta a solicitação completa — instruções do sistema, contexto do diálogo, ferramentas — e chama seu endpoint com essa chave.
- A resposta retorna ao aplicativo via streaming através dos mesmos servidores.
O que isso significa na prática:
- Chave. Armazenada apenas no dispositivo. Passa pelos servidores da Warp a cada solicitação, mas, segundo a Warp, não é salva lá: é usada em tempo real e descartada.
- Prompts e respostas. São transmitidos pelo backend da Warp. A Warp declara que não utiliza esse conteúdo para treinamento, e o armazenamento e a análise estão sujeitos às configurações de privacidade e telemetria da sua conta. A garantia ZDR, que se aplica aos modelos da própria Warp, não pode ser estendida ao seu endpoint próprio: o que o provedor armazena é determinado pelo provedor.
- Lado do gateway. O JoinGonka Gateway não armazena diálogos: os prompts e as respostas não permanecem no gateway após a resposta; no painel, apenas os contadores de solicitações e tokens são visíveis.
- O que permanece na infraestrutura da Warp. As opções Auto, roteadores de modelos personalizados, Codebase Context, sugestões do Active AI e agentes na nuvem — um endpoint próprio não afeta esses elementos.
Se, para suas tarefas, o caminho através de servidores de terceiros for inaceitável, utilize um agente que acesse o endpoint diretamente da sua máquina, como o Codex CLI ou qualquer ferramenta do guia de início rápido da API. A própria Warp promete em seu anúncio uma versão cliente: um módulo de agente leve em Rust em um repositório aberto, que se conectará a modelos locais sem passar pelos servidores da Warp, e suporte ao Agent Client Protocol. E, desde o lançamento de 2 de setembro de 2026, as descrições dos endpoints são armazenadas em um arquivo de configuração em um formato comum para o aplicativo e para o Warp Agent CLI; as chaves não entram neste arquivo e permanecem no armazenamento seguro.
Quer saber mais?
Explore outras seções ou comece a ganhar GNK agora mesmo.
Obter chave e tokens gratuitos →