Secciones de la base de conocimientos ▾
Navegación
▸ Empiece aquí Por rolesCategorías
- Cursor + Gonka AI — LLM barato para codificación
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — Agentes de IA accesibles
- OpenCode: tu propio modelo en la terminal
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — Agente de IA en VS Code
- Aider + Gonka AI — Programación en pareja con IA
- LangChain + Gonka AI — Aplicaciones de IA por centavos
- n8n + Gonka AI — Automatización con IA barata
- Open WebUI + Gonka AI — Su propio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código abierto
- Hermes Agent + DeepSeek en la red Gonka: agente autónomo por centavos
- Kilo Code + Gonka AI — agente de IA en VS Code
- Roo Code + Gonka AI — agente de IA autónomo en VS Code
- LlamaIndex + Gonka AI — Aplicaciones RAG por centavos
- PydanticAI + Gonka — Agentes de IA tipados por centavos
- Vercel AI SDK + Gonka AI — Aplicaciones de IA en TypeScript por centavos
- TanStack AI + Gonka — Aplicaciones de IA en TypeScript por centavos
- API inicio rápido — curl, Python, TypeScript
- JoinGonka Gateway — Resumen completo
- Management Keys — SaaS en Gonka
- La API de IA más barata: comparación de proveedores 2026
- Límite de solicitudes de Cursor Pro alcanzado — análisis y una alternativa barata
- Claude Code más barato — análisis de factura y cambio de servicio
- Cline quema dinero — por qué el agente gasta tanto
- OpenClaw sale caro: por qué el agente quema tokens y cómo ahorrar
- OpenRouter: alternativa barata — comparativa con JoinGonka Gateway
- El mejor modelo de IA para codificación en 2026: comparativa y precios
- Alternativa barata a GitHub Copilot sin límites
- Alternativa barata a Windsurf sin créditos ni límites
- La API más barata para agentes de IA en 2026
- ZCode: inferencia GLM barata en lugar de GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — tu propio endpoint en lugar de créditos
- GitHub Copilot BYOK: tus modelos en lugar de la cuota
- Zed + JoinGonka Gateway — inferencia económica en el editor
- Pi + JoinGonka Gateway — agente terminal con inferencia económica
- Codex CLI: su propia clave en lugar de suscripción
Herramientas
Hermes Agent + DeepSeek en la red Gonka: agente autónomo por centavos
Hermes Agent es un agente de IA de código abierto con autoaprendizaje de Nous Research (licencia MIT). No es solo un chat: es un CLI terminal completo con memoria, habilidades (skills), planificador de tareas y gateway para Telegram, Discord, Slack y WhatsApp. El agente crea habilidades a partir de la experiencia, busca en diálogos anteriores y construye un modelo de usuario entre sesiones. Se puede ejecutar en un VPS de $5 o en un cluster de GPU.
El problema de Hermes es el mismo que el de cualquier herramienta de agentes: el consumo de tokens. El agente lee archivos, ejecuta ciclos de tool-calling, comprime el contexto, gestiona la memoria; en el trabajo activo se consumen fácilmente decenas de millones de tokens. En los modelos de Anthropic u OpenAI ($3-15 por 1M), esto se convierte en decenas y cientos de dólares por día de trabajo autónomo.
Hermes admite por defecto cualquier proveedor: Nous Portal, OpenRouter, OpenAI, Anthropic, o tu propio endpoint. Este es el punto de entrada para JoinGonka Gateway: nuestro gateway compatible con OpenAI proporciona inferencia de la red descentralizada de Gonka a un precio desde $0.0069 por 1M de tokens: cientos y miles de veces más barato. Hermes se convierte en una herramienta realmente cotidiana y no en una demostración cara.
Paso 1: Instalar Hermes y obtener la clave
Instalación de Hermes (Linux, macOS, WSL2). El instalador oficial descargará automáticamente Python, Node.js, ripgrep y ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Después de la instalación, reinicie su shell y compruebe que funciona:
source ~/.bashrc # o ~/.zshrc
hermes # CLI interactivaAPI-key de JoinGonka: si aún no tiene una, regístrese en gate.joingonka.ai/register, verifique su dirección de correo electrónico — se acreditarán 3M de tokens gratuitos en su cuenta — y cree una clave con el prefijo jg- en el Dashboard. Una clave y un saldo funcionan para todos los modelos de inmediato.
Paso 2: Conectar Gonka como proveedor personalizado
Hermes funciona con cualquier endpoint compatible con OpenAI: si el servidor responde a /v1/chat/completions, Hermes puede conectarse a él. El Gateway de JoinGonka es exactamente así. Existen tres formas de configurarlo.
Método 1: nuestro instalador (un comando, recomendado). Configurará el proveedor en el archivo de configuración de Hermes, establecerá DeepSeek V4 Flash como modelo predeterminado y verificará mediante una solicitud en vivo que el gateway acepte la clave y el modelo:
npx @joingonka/setup --tool hermesMétodo 2: asistente de configuración. Ejecuta en tu terminal fuera de una sesión activa:
hermes modelEn la lista de proveedores, selecciona «Custom endpoint (self-hosted / VLLM / etc.)» e introduce tres valores:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-tu-clave - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
Método 3: edición manual del archivo de configuración. Hermes almacena la configuración de los modelos en ~/.hermes/config.yaml, que es la única fuente de verdad. Añade la sección:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-tu-clave⚠️ La clave debe ir únicamente en model.api_key. La documentación de Hermes permite OPENAI_API_KEY en ~/.hermes/.env, pero esto no funciona con un endpoint personalizado: Hermes solo lee la clave de model.api_key; si usas la clave en el archivo .env, el gateway responderá con 401 Invalid API key. Probado en Hermes v0.20.4.
Verificación: inicia hermes y escribe «Crea un archivo hello.py con una función hello world». El agente debería crear el archivo y mostrar el resultado. Puedes ver el estado de la configuración actual mediante hermes config show | grep '^model\.' y hermes status.
Cambio al vuelo: dentro de una sesión, usa el comando /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Si ejecutas /model custom sin nombre, se seleccionará automáticamente el modelo del endpoint si solo hay uno.
Comparación del costo de las sesiones autónomas
Hermes es una herramienta de agente con memoria y habilidades. No responde con una sola réplica: lee archivos, escribe código, ejecuta comandos, comprime el contexto y realiza largas tareas en segundo plano mediante un programador. Cada acción es una llamada a la API, y en un día de trabajo autónomo se acumulan decenas de millones de tokens. Comparemos el costo de sesiones típicas:
| Tarea | Tokens | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Tarea única con tool-calling | ~5M | $15 — $75 | $0.048 |
| Agente en segundo plano (varias horas) | ~20M | $60 — $300 | $0.19 |
| Desarrollo autónomo de una funcionalidad | ~50M | $150 — $750 | $0.48 |
| 24 horas de trabajo vía gateway (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
Con JoinGonka Gateway, Hermes puede mantenerse funcionando las 24 horas del día: informes nocturnos, auditorías semanales, tareas en segundo plano vía cron-scheduler, sin preocuparse por la factura. Con los precios de Anthropic, cada ejecución tendría que calcularse manualmente. El saldo inicial al registrarse es suficiente para probar al agente en una tarea real y ver su propio consumo antes de la primera recarga.
Elección del modelo y tool calling
A través del Gateway, el usuario tiene acceso inmediato a tres modelos de Gonka: todos ellos soportan tool calling nativo (OpenAI function calling), por lo que las habilidades y herramientas de Hermes funcionan de manera confiable, sin necesidad de parsear respuestas de texto:
| Model name (para config) | Contexto | Respuesta máx. | Cuándo elegirlo |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Predeterminado para Hermes: uno de los contextos más largos de la red y un límite de respuesta cuatro veces mayor: el agente mantiene largas cadenas de tool-calling y archivos grandes en una sola pasada |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Versátil y equilibrado para tareas cortas y ediciones rápidas |
zai-org/GLM-5.3-Flash | 390K | 8192 | Modelo de reasoning con el contexto más largo de la red: razona antes de responder, ideal para lógica compleja; parte de la respuesta se dedica al razonamiento, así que no reduzcas el límite de respuesta |
Sobre los límites de tokens en Hermes. En el archivo config.yaml, el campo context_length es la ventana de contexto completa (entrada + salida), y max_tokens es el límite solo para la longitud de la respuesta. Es mejor no configurar ninguno: Hermes determinará automáticamente los valores correctos proporcionados por el proveedor. Si configuras max_tokens manualmente, mantenlo dentro de los límites del modelo: a través del Gateway, esto es 32768 para DeepSeek V4 Flash y 8192 para MiniMax M2.7 y GLM-5.3 Flash. Puedes cambiar de modelo en cualquier momento con el comando hermes model o directamente en la sesión mediante /model.
Herramientas de terminal similares en nuestra base de conocimientos: Claude Code, Cline.
¿Quieres saber más?
Explora otras secciones o empieza a ganar GNK ahora mismo.
Obtén saldo inicial gratis →