Seções da Base de Conhecimento ▾
Navegação
▸ Comece aqui Por funçõesCategorias
- Cursor + Gonka AI — LLM barato para codificação
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — agentes AI acessíveis
- OpenCode: seu próprio modelo no terminal
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — agente AI no VS Code
- Aider + Gonka AI — programação em par com AI
- LangChain + Gonka AI — aplicativos AI por uma fração do custo
- n8n + Gonka AI — automação com AI barata
- Open WebUI + Gonka AI — seu próprio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código aberto
- Hermes Agent + DeepSeek na rede Gonka: agente autônomo por centavos
- Kilo Code + Gonka AI — Agente de IA no VS Code
- Roo Code + Gonka AI — Agente de IA autônomo no VS Code
- LlamaIndex + Gonka AI — Aplicações RAG por alguns centavos
- PydanticAI + Gonka — Agentes de IA tipificados por alguns centavos
- Vercel AI SDK + Gonka AI — Aplicações de IA em TypeScript por centavos
- TanStack AI + Gonka — Aplicativos de IA em TypeScript por centavos
- API início rápido — curl, Python, TypeScript
- JoinGonka Gateway — Visão geral completa
- Management Keys — SaaS na Gonka
- A API de IA mais barata: comparativo de provedores 2026
- Limite de solicitações do Cursor Pro esgotado — análise e uma alternativa barata
- Claude Code mais barato — análise de fatura e mudança de serviço
- Cline queima dinheiro — por que o agente gasta tanto
- OpenClaw custa caro — porque o agente queima tokens e como economizar
- OpenRouter: alternativa barata — comparativo com JoinGonka Gateway
- O melhor modelo de IA para codificação em 2026: comparação e preços
- Alternativa barata ao GitHub Copilot sem limites
- Alternativa barata ao Windsurf sem créditos e sem limites
- A API mais barata para agentes de IA em 2026
- ZCode: inferência GLM barata em vez do GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — seu próprio endpoint em vez de créditos
- GitHub Copilot BYOK: seus modelos em vez da cota
- Zed + JoinGonka Gateway — inferência barata no editor
- Pi + JoinGonka Gateway — agente terminal em inferência barata
- Codex CLI: sua própria chave em vez de assinatura
Ferramentas
Hermes Agent + DeepSeek na rede Gonka: agente autônomo por centavos
Hermes Agent é um agente de IA de código aberto com autoaprendizagem da Nous Research (licença MIT). Não é apenas um chat: é um CLI terminal completo com memória, habilidades (skills), agendador de tarefas e gateway para Telegram, Discord, Slack e WhatsApp. O agente cria habilidades a partir da experiência, pesquisa em diálogos passados e constrói um modelo de usuário entre as sessões. Pode rodar em uma VPS de $5 ou em um cluster de GPU.
O problema do Hermes é o mesmo de qualquer ferramenta de agente: o consumo de tokens. O agente lê arquivos, roda ciclos de tool-calling, comprime o contexto, gerencia a memória — no trabalho ativo, dezenas de milhões de tokens são consumidos facilmente. Em modelos da Anthropic ou OpenAI ($3-15 por 1M), isso se transforma em dezenas e centenas de dólares por dia de trabalho autônomo.
O Hermes suporta por padrão qualquer provedor: Nous Portal, OpenRouter, OpenAI, Anthropic — ou seu próprio endpoint. Esse é o ponto de entrada para o JoinGonka Gateway: nosso gateway compatível com OpenAI fornece inferência da rede descentralizada Gonka por um preço a partir de $0.0069 por 1M de tokens — centenas e milhares de vezes mais barato. O Hermes torna-se uma ferramenta verdadeiramente cotidiana, e não uma demonstração cara.
Passo 1: Instale o Hermes e obtenha a chave
Instalação do Hermes (Linux, macOS, WSL2). O instalador oficial baixará automaticamente Python, Node.js, ripgrep e ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Após a instalação, reinicie o seu shell e verifique se ele executa:
source ~/.bashrc # ou ~/.zshrc
hermes # CLI interativaAPI-key do JoinGonka: se ainda não tiver uma, registre-se em gate.joingonka.ai/register, verifique seu endereço de e-mail — 3M de tokens gratuitos serão creditados em sua conta — e crie uma chave com o prefixo jg- no Dashboard. Uma chave e um saldo funcionam para todos os modelos imediatamente.
Passo 2: Conectar Gonka como provedor customizado
O Hermes funciona com qualquer endpoint compatível com OpenAI: se o servidor responde a /v1/chat/completions, o Hermes pode ser direcionado para ele. O Gateway JoinGonka é exatamente assim. Existem três formas de configurar.
Método 1: nosso instalador (um comando, recomendado). Configura o provedor no arquivo de configuração do Hermes, define o DeepSeek V4 Flash como modelo padrão e verifica através de uma requisição ao vivo se o gateway aceita a chave e o modelo:
npx @joingonka/setup --tool hermesMétodo 2: assistente de configuração. Execute no terminal fora de uma sessão ativa:
hermes modelNa lista de provedores, selecione «Custom endpoint (self-hosted / VLLM / etc.)» e insira três valores:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-sua-chave - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
Método 3: edição do arquivo de configuração. O Hermes armazena as configurações de modelos em ~/.hermes/config.yaml, que é a única fonte da verdade. Adicione a seção:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-sua-chave⚠️ A chave deve ficar apenas em model.api_key. A documentação do Hermes permite OPENAI_API_KEY em ~/.hermes/.env, mas para um endpoint customizado isso não funciona: o Hermes lê a chave apenas de model.api_key, e se você usar a chave no arquivo .env, o gateway responderá com 401 Invalid API key. Testado no Hermes v0.20.4.
Verificação: inicie o hermes e escreva «Crie um arquivo hello.py com uma função hello world». O agente deve criar o arquivo e mostrar o resultado. O estado da configuração atual pode ser visto através de hermes config show | grep '^model\.' e hermes status.
Alternância imediata: dentro da sessão, use o comando /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Já /model custom sem nome selecionará automaticamente o modelo do endpoint, caso haja apenas um.
Comparação de custos de sessões autônomas
Hermes é uma ferramenta de agente com memória e habilidades. Ele não responde com uma única réplica: lê arquivos, escreve código, executa comandos, comprime o contexto e realiza longas tarefas em segundo plano através de um agendador. Cada ação é uma chamada de API, e em um dia de trabalho autônomo acumulam-se dezenas de milhões de tokens. Vamos comparar o custo de sessões típicas:
| Tarefa | Tokens | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Tarefa única com tool-calling | ~5M | $15 — $75 | $0.048 |
| Agente em segundo plano (várias horas) | ~20M | $60 — $300 | $0.19 |
| Desenvolvimento autônomo de uma funcionalidade | ~50M | $150 — $750 | $0.48 |
| 24 horas de trabalho via gateway (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
Com o JoinGonka Gateway, o Hermes pode ser mantido em funcionamento 24 horas por dia: relatórios noturnos, auditorias semanais, tarefas em segundo plano via cron-scheduler, sem se preocupar com a conta. Com os preços da Anthropic, cada execução teria que ser calculada manualmente. O saldo inicial ao se registrar é suficiente para testar o agente em uma tarefa real e ver seu próprio consumo antes da primeira recarga.
Seleção de modelo e tool calling
Através do Gateway, o usuário tem acesso imediato a três modelos Gonka — todos eles suportam tool calling nativo (OpenAI function calling), portanto as habilidades e ferramentas do Hermes funcionam de forma confiável, sem a necessidade de fazer parsing de respostas de texto:
| Model name (para config) | Contexto | Resposta máx. | Quando escolher |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Padrão para Hermes: um dos contextos mais longos da rede e um limite de resposta quatro vezes maior — o agente mantém cadeias longas de tool-calling e arquivos grandes em uma única passagem |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Versátil e equilibrado para tarefas curtas e edições rápidas |
zai-org/GLM-5.3-Flash | 390K | 8192 | Modelo de reasoning com o contexto mais longo da rede: raciocina antes de responder — para lógica complexa; parte da resposta é dedicada ao raciocínio, então não diminua o limite de resposta |
Sobre os limites de tokens no Hermes. No config.yaml, o campo context_length é a janela de contexto completa (entrada + saída), e max_tokens é o limite apenas para a duração da resposta. É melhor não definir nenhum dos dois: o Hermes determinará automaticamente os valores corretos fornecidos pelo provedor. Se definir max_tokens manualmente, mantenha-o dentro dos limites do modelo: através do Gateway, isso é 32768 para o DeepSeek V4 Flash e 8192 para o MiniMax M2.7 e GLM-5.3 Flash. Você pode trocar de modelo a qualquer momento com o comando hermes model ou diretamente na sessão através do /model.
Ferramentas de terminal similares na nossa base de conhecimento: Claude Code, Cline.
Quer saber mais?
Explore outras seções ou comece a ganhar GNK agora mesmo.
Obtenha saldo inicial gratuitamente →