Seções da Base de Conhecimento ▾

Navegação

▸ Comece aqui Por funções

Categorias

Ferramentas 37
Glossário 12

Ferramentas

Hermes Agent + DeepSeek na rede Gonka: agente autônomo por centavos

Hermes Agent é um agente de IA de código aberto com autoaprendizagem da Nous Research (licença MIT). Não é apenas um chat: é um CLI terminal completo com memória, habilidades (skills), agendador de tarefas e gateway para Telegram, Discord, Slack e WhatsApp. O agente cria habilidades a partir da experiência, pesquisa em diálogos passados e constrói um modelo de usuário entre as sessões. Pode rodar em uma VPS de $5 ou em um cluster de GPU.

O problema do Hermes é o mesmo de qualquer ferramenta de agente: o consumo de tokens. O agente lê arquivos, roda ciclos de tool-calling, comprime o contexto, gerencia a memória — no trabalho ativo, dezenas de milhões de tokens são consumidos facilmente. Em modelos da Anthropic ou OpenAI ($3-15 por 1M), isso se transforma em dezenas e centenas de dólares por dia de trabalho autônomo.

O Hermes suporta por padrão qualquer provedor: Nous Portal, OpenRouter, OpenAI, Anthropic — ou seu próprio endpoint. Esse é o ponto de entrada para o JoinGonka Gateway: nosso gateway compatível com OpenAI fornece inferência da rede descentralizada Gonka por um preço a partir de $0.0069 por 1M de tokens — centenas e milhares de vezes mais barato. O Hermes torna-se uma ferramenta verdadeiramente cotidiana, e não uma demonstração cara.

Passo 1: Instale o Hermes e obtenha a chave

Instalação do Hermes (Linux, macOS, WSL2). O instalador oficial baixará automaticamente Python, Node.js, ripgrep e ffmpeg:

# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Após a instalação, reinicie o seu shell e verifique se ele executa:

source ~/.bashrc   # ou ~/.zshrc
hermes             # CLI interativa

API-key do JoinGonka: se ainda não tiver uma, registre-se em gate.joingonka.ai/register, verifique seu endereço de e-mail — 3M de tokens gratuitos serão creditados em sua conta — e crie uma chave com o prefixo jg- no Dashboard. Uma chave e um saldo funcionam para todos os modelos imediatamente.

Passo 2: Conectar Gonka como provedor customizado

O Hermes funciona com qualquer endpoint compatível com OpenAI: se o servidor responde a /v1/chat/completions, o Hermes pode ser direcionado para ele. O Gateway JoinGonka é exatamente assim. Existem três formas de configurar.

Método 1: nosso instalador (um comando, recomendado). Configura o provedor no arquivo de configuração do Hermes, define o DeepSeek V4 Flash como modelo padrão e verifica através de uma requisição ao vivo se o gateway aceita a chave e o modelo:

npx @joingonka/setup --tool hermes

Método 2: assistente de configuração. Execute no terminal fora de uma sessão ativa:

hermes model

Na lista de provedores, selecione «Custom endpoint (self-hosted / VLLM / etc.)» e insira três valores:

  • API base URL: https://gate.joingonka.ai/v1
  • API key: jg-sua-chave
  • Model name: deepseek-ai/DeepSeek-V4-Flash-0731

Método 3: edição do arquivo de configuração. O Hermes armazena as configurações de modelos em ~/.hermes/config.yaml, que é a única fonte da verdade. Adicione a seção:

# ~/.hermes/config.yaml
model:
  provider: custom
  model: deepseek-ai/DeepSeek-V4-Flash-0731
  base_url: https://gate.joingonka.ai/v1
  api_key: jg-sua-chave

⚠️ A chave deve ficar apenas em model.api_key. A documentação do Hermes permite OPENAI_API_KEY em ~/.hermes/.env, mas para um endpoint customizado isso não funciona: o Hermes lê a chave apenas de model.api_key, e se você usar a chave no arquivo .env, o gateway responderá com 401 Invalid API key. Testado no Hermes v0.20.4.

Verificação: inicie o hermes e escreva «Crie um arquivo hello.py com uma função hello world». O agente deve criar o arquivo e mostrar o resultado. O estado da configuração atual pode ser visto através de hermes config show | grep '^model\.' e hermes status.

Alternância imediata: dentro da sessão, use o comando /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Já /model custom sem nome selecionará automaticamente o modelo do endpoint, caso haja apenas um.

Comparação de custos de sessões autônomas

Hermes é uma ferramenta de agente com memória e habilidades. Ele não responde com uma única réplica: lê arquivos, escreve código, executa comandos, comprime o contexto e realiza longas tarefas em segundo plano através de um agendador. Cada ação é uma chamada de API, e em um dia de trabalho autônomo acumulam-se dezenas de milhões de tokens. Vamos comparar o custo de sessões típicas:

TarefaTokensAnthropic ClaudeJoinGonka Gonka
Tarefa única com tool-calling~5M$15 — $75$0.048
Agente em segundo plano (várias horas)~20M$60 — $300$0.19
Desenvolvimento autônomo de uma funcionalidade~50M$150 — $750$0.48
24 horas de trabalho via gateway (Telegram + cron)~150M$450 — $2,250$1.44

Com o JoinGonka Gateway, o Hermes pode ser mantido em funcionamento 24 horas por dia: relatórios noturnos, auditorias semanais, tarefas em segundo plano via cron-scheduler, sem se preocupar com a conta. Com os preços da Anthropic, cada execução teria que ser calculada manualmente. O saldo inicial ao se registrar é suficiente para testar o agente em uma tarefa real e ver seu próprio consumo antes da primeira recarga.

Seleção de modelo e tool calling

Através do Gateway, o usuário tem acesso imediato a três modelos Gonka — todos eles suportam tool calling nativo (OpenAI function calling), portanto as habilidades e ferramentas do Hermes funcionam de forma confiável, sem a necessidade de fazer parsing de respostas de texto:

Model name (para config)ContextoResposta máx.Quando escolher
deepseek-ai/DeepSeek-V4-Flash-0731380K32768Padrão para Hermes: um dos contextos mais longos da rede e um limite de resposta quatro vezes maior — o agente mantém cadeias longas de tool-calling e arquivos grandes em uma única passagem
MiniMaxAI/MiniMax-M2.7200K8192Versátil e equilibrado para tarefas curtas e edições rápidas
zai-org/GLM-5.3-Flash390K8192Modelo de reasoning com o contexto mais longo da rede: raciocina antes de responder — para lógica complexa; parte da resposta é dedicada ao raciocínio, então não diminua o limite de resposta

Sobre os limites de tokens no Hermes. No config.yaml, o campo context_length é a janela de contexto completa (entrada + saída), e max_tokens é o limite apenas para a duração da resposta. É melhor não definir nenhum dos dois: o Hermes determinará automaticamente os valores corretos fornecidos pelo provedor. Se definir max_tokens manualmente, mantenha-o dentro dos limites do modelo: através do Gateway, isso é 32768 para o DeepSeek V4 Flash e 8192 para o MiniMax M2.7 e GLM-5.3 Flash. Você pode trocar de modelo a qualquer momento com o comando hermes model ou diretamente na sessão através do /model.

Ferramentas de terminal similares na nossa base de conhecimento: Claude Code, Cline.

Hermes Agent + Gonka = agente de IA autônomo Nous Research por centavos. 24 horas de trabalho em segundo plano custam $1.44 em vez de $450-2,250 no Anthropic. Configuração: npx @joingonka/setup --tool hermes (ou provedor custom com a base_url do nosso gateway manualmente), tool calling nativo, três modelos à escolha: DeepSeek V4 Flash com contexto de 380K, MiniMax M2.7 e GLM-5.3 Flash. Saldo inicial após a confirmação do endereço — pronto para a primeira tarefa real.

Quer saber mais?

Explore outras seções ou comece a ganhar GNK agora mesmo.

Obtenha saldo inicial gratuitamente →