Secciones de la base de conocimientos ▾

Navegación

▸ Empiece aquí Por roles

Categorías

Herramientas 37
Glosario 12

Herramientas

Hermes Agent + DeepSeek en la red Gonka: agente autónomo por centavos

Hermes Agent es un agente de IA de código abierto con autoaprendizaje de Nous Research (licencia MIT). No es solo un chat: es un CLI terminal completo con memoria, habilidades (skills), planificador de tareas y gateway para Telegram, Discord, Slack y WhatsApp. El agente crea habilidades a partir de la experiencia, busca en diálogos anteriores y construye un modelo de usuario entre sesiones. Se puede ejecutar en un VPS de $5 o en un cluster de GPU.

El problema de Hermes es el mismo que el de cualquier herramienta de agentes: el consumo de tokens. El agente lee archivos, ejecuta ciclos de tool-calling, comprime el contexto, gestiona la memoria; en el trabajo activo se consumen fácilmente decenas de millones de tokens. En los modelos de Anthropic u OpenAI ($3-15 por 1M), esto se convierte en decenas y cientos de dólares por día de trabajo autónomo.

Hermes admite por defecto cualquier proveedor: Nous Portal, OpenRouter, OpenAI, Anthropic, o tu propio endpoint. Este es el punto de entrada para JoinGonka Gateway: nuestro gateway compatible con OpenAI proporciona inferencia de la red descentralizada de Gonka a un precio desde $0.0069 por 1M de tokens: cientos y miles de veces más barato. Hermes se convierte en una herramienta realmente cotidiana y no en una demostración cara.

Paso 1: Instalar Hermes y obtener la clave

Instalación de Hermes (Linux, macOS, WSL2). El instalador oficial descargará automáticamente Python, Node.js, ripgrep y ffmpeg:

# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Después de la instalación, reinicie su shell y compruebe que funciona:

source ~/.bashrc   # o ~/.zshrc
hermes             # CLI interactiva

API-key de JoinGonka: si aún no tiene una, regístrese en gate.joingonka.ai/register, verifique su dirección de correo electrónico — se acreditarán 3M de tokens gratuitos en su cuenta — y cree una clave con el prefijo jg- en el Dashboard. Una clave y un saldo funcionan para todos los modelos de inmediato.

Paso 2: Conectar Gonka como proveedor personalizado

Hermes funciona con cualquier endpoint compatible con OpenAI: si el servidor responde a /v1/chat/completions, Hermes puede conectarse a él. El Gateway de JoinGonka es exactamente así. Existen tres formas de configurarlo.

Método 1: nuestro instalador (un comando, recomendado). Configurará el proveedor en el archivo de configuración de Hermes, establecerá DeepSeek V4 Flash como modelo predeterminado y verificará mediante una solicitud en vivo que el gateway acepte la clave y el modelo:

npx @joingonka/setup --tool hermes

Método 2: asistente de configuración. Ejecuta en tu terminal fuera de una sesión activa:

hermes model

En la lista de proveedores, selecciona «Custom endpoint (self-hosted / VLLM / etc.)» e introduce tres valores:

  • API base URL: https://gate.joingonka.ai/v1
  • API key: jg-tu-clave
  • Model name: deepseek-ai/DeepSeek-V4-Flash-0731

Método 3: edición manual del archivo de configuración. Hermes almacena la configuración de los modelos en ~/.hermes/config.yaml, que es la única fuente de verdad. Añade la sección:

# ~/.hermes/config.yaml
model:
  provider: custom
  model: deepseek-ai/DeepSeek-V4-Flash-0731
  base_url: https://gate.joingonka.ai/v1
  api_key: jg-tu-clave

⚠️ La clave debe ir únicamente en model.api_key. La documentación de Hermes permite OPENAI_API_KEY en ~/.hermes/.env, pero esto no funciona con un endpoint personalizado: Hermes solo lee la clave de model.api_key; si usas la clave en el archivo .env, el gateway responderá con 401 Invalid API key. Probado en Hermes v0.20.4.

Verificación: inicia hermes y escribe «Crea un archivo hello.py con una función hello world». El agente debería crear el archivo y mostrar el resultado. Puedes ver el estado de la configuración actual mediante hermes config show | grep '^model\.' y hermes status.

Cambio al vuelo: dentro de una sesión, usa el comando /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Si ejecutas /model custom sin nombre, se seleccionará automáticamente el modelo del endpoint si solo hay uno.

Comparación del costo de las sesiones autónomas

Hermes es una herramienta de agente con memoria y habilidades. No responde con una sola réplica: lee archivos, escribe código, ejecuta comandos, comprime el contexto y realiza largas tareas en segundo plano mediante un programador. Cada acción es una llamada a la API, y en un día de trabajo autónomo se acumulan decenas de millones de tokens. Comparemos el costo de sesiones típicas:

TareaTokensAnthropic ClaudeJoinGonka Gonka
Tarea única con tool-calling~5M$15 — $75$0.048
Agente en segundo plano (varias horas)~20M$60 — $300$0.19
Desarrollo autónomo de una funcionalidad~50M$150 — $750$0.48
24 horas de trabajo vía gateway (Telegram + cron)~150M$450 — $2,250$1.44

Con JoinGonka Gateway, Hermes puede mantenerse funcionando las 24 horas del día: informes nocturnos, auditorías semanales, tareas en segundo plano vía cron-scheduler, sin preocuparse por la factura. Con los precios de Anthropic, cada ejecución tendría que calcularse manualmente. El saldo inicial al registrarse es suficiente para probar al agente en una tarea real y ver su propio consumo antes de la primera recarga.

Elección del modelo y tool calling

A través del Gateway, el usuario tiene acceso inmediato a tres modelos de Gonka: todos ellos soportan tool calling nativo (OpenAI function calling), por lo que las habilidades y herramientas de Hermes funcionan de manera confiable, sin necesidad de parsear respuestas de texto:

Model name (para config)ContextoRespuesta máx.Cuándo elegirlo
deepseek-ai/DeepSeek-V4-Flash-0731380K32768Predeterminado para Hermes: uno de los contextos más largos de la red y un límite de respuesta cuatro veces mayor: el agente mantiene largas cadenas de tool-calling y archivos grandes en una sola pasada
MiniMaxAI/MiniMax-M2.7200K8192Versátil y equilibrado para tareas cortas y ediciones rápidas
zai-org/GLM-5.3-Flash390K8192Modelo de reasoning con el contexto más largo de la red: razona antes de responder, ideal para lógica compleja; parte de la respuesta se dedica al razonamiento, así que no reduzcas el límite de respuesta

Sobre los límites de tokens en Hermes. En el archivo config.yaml, el campo context_length es la ventana de contexto completa (entrada + salida), y max_tokens es el límite solo para la longitud de la respuesta. Es mejor no configurar ninguno: Hermes determinará automáticamente los valores correctos proporcionados por el proveedor. Si configuras max_tokens manualmente, mantenlo dentro de los límites del modelo: a través del Gateway, esto es 32768 para DeepSeek V4 Flash y 8192 para MiniMax M2.7 y GLM-5.3 Flash. Puedes cambiar de modelo en cualquier momento con el comando hermes model o directamente en la sesión mediante /model.

Herramientas de terminal similares en nuestra base de conocimientos: Claude Code, Cline.

Hermes Agent + Gonka = agente de IA autónomo Nous Research por centavos. 24 horas de trabajo en segundo plano cuestan $1.44 en lugar de $450-2,250 con Anthropic. Configuración: npx @joingonka/setup --tool hermes (o proveedor custom con la base_url de nuestro gateway manualmente), tool calling nativo, tres modelos a elegir: DeepSeek V4 Flash con contexto de 380K, MiniMax M2.7 y GLM-5.3 Flash. Saldo inicial después de confirmar la dirección, listo para la primera tarea real.

¿Quieres saber más?

Explora otras secciones o empieza a ganar GNK ahora mismo.

Obtén saldo inicial gratis →