Seções da Base de Conhecimento ▾
Navegação
▸ Comece aqui Por funçõesCategorias
- Cursor + Gonka AI — LLM barato para codificação
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — agentes AI acessíveis
- OpenCode + Gonka AI — AI grátis para código
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — agente AI no VS Code
- Aider + Gonka AI — programação em par com AI
- LangChain + Gonka AI — aplicativos AI por uma fração do custo
- n8n + Gonka AI — automação com AI barata
- Open WebUI + Gonka AI — seu próprio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código aberto
- Hermes Agent + Gonka AI — Agente autônomo por centavos
- Kilo Code + Gonka AI — Agente de IA no VS Code
- Roo Code + Gonka AI — Agente de IA autônomo no VS Code
- LlamaIndex + Gonka AI — Aplicações RAG por alguns centavos
- PydanticAI + Gonka — Agentes de IA tipificados por alguns centavos
- Vercel AI SDK + Gonka AI — Aplicações de IA em TypeScript por centavos
- TanStack AI + Gonka — Aplicativos de IA em TypeScript por centavos
- API início rápido — curl, Python, TypeScript
- JoinGonka Gateway — Visão geral completa
- Management Keys — SaaS na Gonka
- A API de IA mais barata: comparativo de provedores 2026
- Limite de solicitações do Cursor Pro esgotado — análise e uma alternativa barata
- Claude Code mais barato — análise de fatura e mudança de serviço
- Cline queima dinheiro — por que o agente gasta tanto
- OpenClaw custa caro — porque o agente queima tokens e como economizar
- OpenRouter: alternativa barata — comparativo com JoinGonka Gateway
- O melhor modelo de IA para codificação em 2026: comparação e preços
- Alternativa barata ao GitHub Copilot sem limites
- Alternativa barata ao Windsurf sem créditos e sem limites
- A API mais barata para agentes de IA em 2026
- ZCode: inferência GLM barata em vez do GLM Coding Plan
Ferramentas
Hermes Agent + Gonka AI — Agente autônomo por centavos
O Hermes Agent é um agente de AI de código aberto com autoaprendizado da Nous Research (licença MIT). Não é apenas um chat: é um CLI terminal completo com memória, habilidades (skills), agendador de tarefas e gateway para Telegram, Discord, Slack e WhatsApp. O agente cria habilidades a partir da experiência, pesquisa em diálogos passados e constrói um modelo de usuário entre as sessões. É executado em qualquer lugar, desde um VPS de $5 até um cluster de GPU.
O problema do Hermes é o mesmo de qualquer ferramenta de agente: o consumo de tokens. O agente lê arquivos, roda ciclos de tool-calling, comprime o contexto, mantém a memória — no uso ativo, dezena de milhões de tokens são consumidos facilmente. Em modelos da Anthropic ou OpenAI ($3-15 por 1M), isso se transforma em dezenas e centenas de dólares por dia de trabalho autônomo.
O Hermes, por padrão, suporta qualquer provedor: Nous Portal, OpenRouter, OpenAI, Anthropic — ou seu próprio endpoint. Este é o ponto de entrada para o JoinGonka Gateway: nosso gateway compatível com OpenAI fornece inferência da rede descentralizada Gonka por um preço a partir de $0.003 por 1M de tokens — centenas e milhares de vezes mais barato. O Hermes torna-se uma ferramenta verdadeiramente cotidiana, e não uma demonstração cara.
Passo 1: Instale o Hermes e obtenha a chave
Instalação do Hermes (Linux, macOS, WSL2). O instalador oficial puxará Python, Node.js, ripgrep e ffmpeg automaticamente:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Após a instalação, reinicie o shell e verifique a execução:
source ~/.bashrc # ou ~/.zshrc
hermes # CLI interativoChave API JoinGonka: se ainda não tiver uma — registre-se em gate.joingonka.ai/register, obtenha 10M de tokens gratuitos e crie uma chave com o prefixo jg- no Dashboard. Uma única chave e um único saldo funcionam para todos os modelos.
Passo 2: Conectar Gonka como provedor customizado
O Hermes funciona com qualquer endpoint compatível com OpenAI: se o servidor responde a /v1/chat/completions, o Hermes pode ser direcionado para ele. O Gateway da JoinGonka é exatamente assim. Existem duas formas de configurar.
Método 1: assistente de configuração (recomendado). Execute no terminal fora de uma sessão ativa:
hermes modelNa lista de providers, escolha «Custom endpoint (self-hosted / VLLM / etc.)» e insira três valores:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-sua-chave - Model name:
MiniMaxAI/MiniMax-M2.7
Método 2: edição do config. O Hermes armazena os ajustes de modelos em ~/.hermes/config.yaml — essa é a única fonte da verdade. Adicione a seção:
# ~/.hermes/config.yaml
model:
provider: custom
default: MiniMaxAI/MiniMax-M2.7
base_url: https://gate.joingonka.ai/v1
api_key: jg-sua-chaveVerificação: execute hermes e escreva «Crie um arquivo hello.py com uma função hello world». O agente deve criar o arquivo e mostrar o resultado. O estado da configuração atual pode ser visto via hermes config show | grep '^model\.' e hermes status.
Alternância em tempo real: dentro da sessão com o comando /model custom:MiniMaxAI/MiniMax-M2.7. E /model custom sem nome puxará o modelo do endpoint automaticamente caso haja apenas um.
Comparação de custos de sessões autônomas
Hermes — uma ferramenta de agente com memória e habilidades. Ele não responde com apenas uma réplica: lê arquivos, escreve código, executa comandos, comprime o contexto e conduz tarefas de fundo de longa duração através de um agendador. Cada ação é uma chamada de API e, em um dia de operação autônoma, dezenas de milhões de tokens são acumulados. Comparemos o custo de sessões típicas:
| Tarefa | Tokens | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Tarefa única com tool-calling | ~5M | $15 — $75 | $0.024 |
| Agente de fundo (várias horas) | ~20M | $60 — $300 | $0.096 |
| Desenvolvimento autônomo de funcionalidade | ~50M | $150 — $750 | $0.24 |
| 24h de operação via gateway (Telegram + cron) | ~150M | $450 — $2,250 | $0.72 |
Com o JoinGonka Gateway, o Hermes pode ser mantido em execução 24 horas por dia: relatórios noturnos, auditorias semanais, tarefas de fundo via agendador cron — sem se preocupar com a fatura. Pelos preços da Anthropic, cada execução teria que ser calculada manualmente. 10M de tokens gratuitos no registro são suficientes para dezenas de sessões completas.
Seleção de modelo e tool calling
Através do Gateway, o usuário tem acesso imediato a dois modelos Gonka — ambos suportam tool calling nativo (OpenAI function calling), portanto, as habilidades e ferramentas do Hermes funcionam de forma confiável, sem a necessidade de processar respostas de texto:
| Nome do modelo (para config) | Contexto | Máx. resposta | Quando escolher |
|---|---|---|---|
moonshotai/Kimi-K2.6 | 200K | 8192 | Padrão — raciocínio forte, codificação e cenários de agentes |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Contexto longo, cadeias longas de tool-calling |
Sobre os limites de tokens no Hermes. No config.yaml, o campo context_length é a janela de contexto total (entrada + saída), e max_tokens é o limite apenas para o tamanho da resposta. É recomendável não definir nenhum: o Hermes determinará os valores corretos fornecidos pelo provedor por conta própria. Se você definir o max_tokens manualmente, mantenha-o dentro dos limites do modelo — para ambos os modelos, o máximo via Gateway é 8192. Você pode trocar de modelo a qualquer momento com o comando hermes model ou diretamente na sessão através de /model.
Ferramentas de terminal similares em nossa base de conhecimento: Claude Code, Cline.
Quer saber mais?
Explore outras seções ou comece a ganhar GNK agora mesmo.
Obtenha 10M de tokens grátis →