Seções da Base de Conhecimento ▾

Navegação

▸ Comece aqui Por funções

Categorias

Ferramentas 52
Glossário 12

Ferramentas

Warp + JoinGonka Gateway — agente de terminal em seu próprio endpoint

Warp é um terminal que se transformou em um ambiente de desenvolvimento por agentes: o Warp Agent integrado lê a saída de comandos, edita arquivos, executa builds e conduz a tarefa do pedido ao resultado. Por padrão, o agente trabalha com modelos vendidos pelo próprio Warp — via créditos de plano — e, por muito tempo, trazer sua própria inferência só era possível em planos pagos e via chaves da OpenAI, Anthropic ou Google. Em 20 de maio de 2026, o Warp abriu o BYOK no plano gratuito e adicionou o custom inference endpoint — a conexão de qualquer serviço que fale OpenAI Chat Completions.

Este segundo método é necessário para direcionar o agente do Warp através do JoinGonka Gateway: o gateway fornece modelos da rede descentralizada Gonka via API compatível com OpenAI, a inferência é paga conforme os preços reais da rede e, para usuários individuais ou pequenas equipes, os créditos do Warp não são consumidos. Após o registro e a confirmação do endereço, você receberá 3M de tokens gratuitos — o suficiente para testar o agente em suas tarefas antes da primeira recarga.

Abaixo, detalhamos o que é necessário antes de começar, quais valores inserir no formulário do Warp, como garantir que as solicitações passem pelo gateway, qual modelo de rede escolher para tarefas de terminal e o que é importante saber sobre a rota das solicitações: no Warp, ela funciona de forma diferente da maioria das ferramentas.

O que será necessário: chave, plano do Warp e endereço público

Chave JoinGonka. Registre-se no gateway, abra a seção "API-keys" no painel e clique em "Criar chave". A chave começa com jg- e é exibida apenas uma vez — salve-a imediatamente. É conveniente criar uma chave separada para o Warp: assim, na seção "Uso", o consumo do agente de terminal será visto em uma linha separada, sem se misturar com outras ferramentas.

Plano do Warp. Seu próprio endpoint está disponível não apenas em planos pagos — as condições dependem do tamanho da equipe:

Quem conectaO endpoint próprio está disponível?O que acontece com os créditos do Warp?
Um desenvolvedor ou empresa de até 10 pessoas (planos Free, Build, Max)Sim, em qualquer um desses planosCréditos não são deduzidos por inferência via seu próprio endpoint
Organização acima de 10 pessoasApenas no Business ou EnterpriseAs execuções locais do agente consomem platform credits (taxa de infraestrutura do Warp com desconto); a inferência em si é paga ao provedor do endpoint

Endereço HTTPS público. Este é um requisito do Warp que pode não ser óbvio: as solicitações para seu endpoint não são enviadas pelo aplicativo em sua máquina, mas pelos servidores do Warp, por isso o endereço deve estar acessível pela Internet. O formulário rejeita localhost, 127.0.0.1 e endereços de redes privadas, e apenas o esquema https:// é aceito. O JoinGonka Gateway é um serviço HTTPS público, portanto, túneis como ngrok, recomendados pela documentação do Warp para modelos locais, não são necessários aqui.

Versão atualizada do aplicativo. O endpoint próprio está incluído na versão estável desde o lançamento de 20 de maio de 2026, e a seleção do esquema de API no formulário apareceu na versão de 31 de julho de 2026. Se o campo API schema não estiver no formulário, atualize o Warp.

Conexão: formulário Add custom endpoint

Toda a configuração é feita na interface do aplicativo — não é preciso editar arquivos à mão.

  1. Abra Settings e digite inference endpoint na busca de configurações — o Warp vai até o bloco com as chaves dos provedores e os endpoints próprios (ele fica na página de configurações do Warp Agent).
  2. Clique em Add custom endpoint — o formulário vai abrir.
  3. Preencha os campos com os valores da tabela e clique em Add endpoint.
Campo do formulárioO que colocarExplicação
API schemaOpenAI Chat CompletionsEsquema padrão: é justamente para ele que a documentação do Warp descreve o formato do endereço. Na lista também há OpenAI Responses e Anthropic Messages
Endpoint nameJoinGonkaQualquer nome — é por ele que o endpoint aparece nas configurações
Endpoint URLhttps://gate.joingonka.ai/v1Endereço base junto com /v1 — igual ao exemplo da documentação do Warp
API keyjg-your-keyFica armazenada apenas no dispositivo, no cofre de chaves do sistema
Model namedeepseek-ai/DeepSeek-V4-Flash-0731Identificador exato do modelo, como o gateway o entrega
Model alias (optional)DeepSeek V4 FlashNome curto para o seletor de modelos

O botão + Add model adiciona a próxima linha. Cadastre de uma vez todos os modelos da rede para depois alternar entre eles sem voltar às configurações: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 e zai-org/GLM-5.3-Flash. A lista atualizada é sempre entregue por GET https://gate.joingonka.ai/v1/models. Digite os identificadores caractere por caractere: o formulário só verifica o formato do endereço e se os campos estão preenchidos, não faz nenhuma requisição de teste ao salvar, então um erro de digitação no nome do modelo só vai aparecer já no diálogo com o agente.

Depois de salvar, os modelos aparecem no seletor de modelos do agente. Se o modelo padrão continuava sendo um dos modelos do Warp, o aplicativo pode sugerir trocá-lo — aceite e escolha o modelo do seu endpoint. Um detalhe importante: as opções Auto do seletor sempre rodam na infraestrutura do Warp e consomem os créditos dele, mesmo com o seu endpoint configurado. Para que a requisição vá para o gateway, é preciso que um modelo específico da sua lista esteja selecionado no seletor.

Verificação: se as solicitações estão passando pelo gateway

Selecione o modelo do seu endpoint no seletor e dê ao agente uma tarefa curta, por exemplo: «Mostre os cinco maiores arquivos no diretório atual e explique o comando». O agente deve sugerir o comando, executá-lo com sua permissão e comentar a saída.

Agora abra o painel do gateway, seção «Uso». No bloco «Por chaves», a chave configurada para o Warp mostrará as solicitações e o horário do último acesso; no bloco «Por modelos», aparecerá o modelo escolhido. Se os contadores estiverem aumentando, a inferência está passando pelo JoinGonka Gateway, e não consumindo créditos do Warp. Por sua vez, o Warp mostra o consumo de tokens diretamente no diálogo com o agente — sob os nomes curtos que você definiu no campo alias.

Se algo der errado, a causa geralmente pode ser lida na resposta:

O que apareceO que significaO que fazer
401, Invalid API keyO gateway não reconheceu a chaveVerifique se a chave começa com jg-, se foi inserida sem espaços e se está ativa na seção «API-keys»; em caso de dúvida, crie uma nova
404, Invalid URL (POST …)O caminho foi montado com um segmento extra; no texto do erro, o gateway mostra exatamente para onde a solicitação foi enviadaDeve resultar em /v1/chat/completions. Se /v1 duplicou ou o endereço contém o caminho completo, ajuste a Endpoint URL para o formato da tabela acima
405 Not Allowed ou página HTML em vez de respostaFalta /v1 no endereço, a solicitação passou por fora da APIAdicione /v1 ao final do endereço
429O modelo está sobrecarregado: nos horários de pico, a capacidade de um modelo específico na rede pode estar esgotadaTente novamente em alguns segundos ou mude para um modelo próximo — por isso vale a pena cadastrar todos de uma vez
As solicitações passam, mas os créditos do Warp diminuemO modo Auto ou o roteador de modelos do Warp está selecionado no seletor, e não o modelo do endpointSelecione o modelo específico da sua lista
O formulário não aceita o endereçoO Warp exige https:// e um host públicoInsira o endereço completo do gateway, começando com https://
O modelo «não vê» a imagem anexadaOs modelos da rede são baseados em texto: o gateway substitui a imagem por uma nota textualPara tarefas com capturas de tela, mude para um modelo com visão; para comandos e código, permaneça nos modelos da rede
O modelo do endpoint não aparece ao iniciar na nuvemSeu endpoint é armazenado localmente e não é replicado para Cloud AgentsExecute a tarefa usando o agente local

A primeira resposta na sessão pode levar alguns segundos para chegar: o agente envia um grande prompt de sistema com a descrição das ferramentas, e a solicitação passa primeiro pelos servidores do Warp e depois pelo nó da rede. Depois disso, o diálogo flui mais rapidamente.

Qual modelo escolher para o agente de terminal

O preço dos modelos da rede é o mesmo, por isso a escolha é sobre o comportamento, não sobre o orçamento. O agente de terminal lê muito (saída de comandos, logs, arquivos) e chama ferramentas constantemente; todos os modelos da tabela suportam tool calling nativo.

ModeloIdentificadorContexto e respostaQuando usar no Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, resposta até 32768 tokensModelo padrão para o agente: sessões longas, logs grandes e diffs, edições em vários arquivos. Reserva de contexto e o maior teto de resposta da rede
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, resposta até 8192 tokensTarefas curtas e rápidas: escolher um comando, analisar um erro, corrigir um arquivo de configuração
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, resposta até 8192 tokensModelo de raciocínio: reflete antes de responder. Depuração confusa, plano de migração, análise de código desconhecido; a resposta chega mais tarde e parte do limite de resposta é destinada ao raciocínio

Esquema prático: DeepSeek V4 Flash como modelo principal, MiniMax M2.7 para coisas menores, GLM-5.3 Flash quando a tarefa depende da lógica e não do volume. Alternar leva um segundo porque todos os modelos já estão configurados no endpoint, e nomes curtos no campo alias evitam confusão com identificadores longos. Mais detalhes sobre o mais usado na análise do DeepSeek V4 Flash.

Quanto custa

O consumo de tokens do agente no terminal é maior do que no chat: para cada solicitação, o Warp adiciona instruções do sistema, contexto do diálogo e descrição das ferramentas, e cada tarefa consiste em vários passos. Por isso, o preço por token aqui é mais importante do que em uma conversa comum.

Através do JoinGonka Gateway, os tokens custam $0.0069 por milhão na entrada e $0.021 por milhão na saída — o preço é igual para todos os modelos da rede e é carregado nesta página a partir de uma fonte em tempo real. Ordem de grandeza dos preços em setembro de 2026:

CenárioConsumoVia Gateway
Tarefa única: comando e análise da sua saídadezenas de milhares de tokensfrações de centavo
Dia de trabalho ativo com o agente3-7M de tokensalguns centavos
Mês de trabalho diário~150M de tokenscerca de um ou dois dólares

Para comparação, três formas de pagar o agente Warp:

MétodoQuem contabiliza a inferênciaO que limita
Modelos WarpWarp, por créditos do planoReserva mensal de créditos do plano
BYOK: chave OpenAI, Anthropic ou GoogleFornecedor do modelo pela sua tarifaPreço por milhão de tokens do fornecedor
Endpoint próprio + JoinGonka GatewayGateway: por tokens, do saldoApenas saldo: consumo visível no painel, sem cotas de número de solicitações

O Warp não cobra créditos de indivíduos e equipes de até 10 pessoas por trabalhar através do próprio endpoint — você paga apenas pelos tokens no gateway. O saldo é recarregado no painel, onde o saldo restante e o consumo por dias e modelos também podem ser vistos.

Rota de solicitações e privacidade: o que é importante saber

Para a maioria das ferramentas, um endpoint próprio significa «as solicitações vão da minha máquina diretamente para o provedor». Com Warp é diferente: a parte de execução do agente funciona nos servidores da Warp, e um endpoint próprio apenas altera o destino final e a chave. De acordo com a documentação da Warp, o caminho da solicitação é o seguinte:

  1. O aplicativo obtém o endereço do endpoint e a chave de um armazenamento seguro no dispositivo e os envia para os servidores da Warp junto com seu prompt.
  2. O agente no lado da Warp monta a solicitação completa — instruções do sistema, contexto do diálogo, ferramentas — e chama seu endpoint com essa chave.
  3. A resposta retorna ao aplicativo via streaming através dos mesmos servidores.

O que isso significa na prática:

  • Chave. Armazenada apenas no dispositivo. Passa pelos servidores da Warp a cada solicitação, mas, segundo a Warp, não é salva lá: é usada em tempo real e descartada.
  • Prompts e respostas. São transmitidos pelo backend da Warp. A Warp declara que não utiliza esse conteúdo para treinamento, e o armazenamento e a análise estão sujeitos às configurações de privacidade e telemetria da sua conta. A garantia ZDR, que se aplica aos modelos da própria Warp, não pode ser estendida ao seu endpoint próprio: o que o provedor armazena é determinado pelo provedor.
  • Lado do gateway. O JoinGonka Gateway não armazena diálogos: os prompts e as respostas não permanecem no gateway após a resposta; no painel, apenas os contadores de solicitações e tokens são visíveis.
  • O que permanece na infraestrutura da Warp. As opções Auto, roteadores de modelos personalizados, Codebase Context, sugestões do Active AI e agentes na nuvem — um endpoint próprio não afeta esses elementos.

Se, para suas tarefas, o caminho através de servidores de terceiros for inaceitável, utilize um agente que acesse o endpoint diretamente da sua máquina, como o Codex CLI ou qualquer ferramenta do guia de início rápido da API. A própria Warp promete em seu anúncio uma versão cliente: um módulo de agente leve em Rust em um repositório aberto, que se conectará a modelos locais sem passar pelos servidores da Warp, e suporte ao Agent Client Protocol. E, desde o lançamento de 2 de setembro de 2026, as descrições dos endpoints são armazenadas em um arquivo de configuração em um formato comum para o aplicativo e para o Warp Agent CLI; as chaves não entram neste arquivo e permanecem no armazenamento seguro.

O Warp se conecta ao JoinGonka Gateway através do formulário Add custom endpoint: esquema OpenAI Chat Completions, endereço https://gate.joingonka.ai/v1, chave jg- e identificadores de modelos da rede. Para usuários individuais e equipes de até 10 pessoas, isso está disponível mesmo no plano gratuito, e os créditos de Warp para inferência não são consumidos se o modelo endpoint for selecionado no interruptor em vez de Auto. A principal característica do Warp é a rota: as solicitações para o endpoint são enviadas por seus servidores, portanto, o endereço deve ser público e os prompts passam pelo backend do Warp em trânsito. Para tarefas de terminal, use o DeepSeek V4 Flash; para coisas pequenas, MiniMax M2.7; e para lógica complexa, GLM-5.3 Flash.

Quer saber mais?

Explore outras seções ou comece a ganhar GNK agora mesmo.

Obter chave e tokens gratuitos →