Sezioni dell'archivio conoscenza ▾

Navigazione

▸ Inizia qui Per ruolo

Categorie

Strumenti 37
Glossario 12

Strumenti

Hermes Agent + DeepSeek sulla rete Gonka — agente autonomo a costi irrisori

Hermes Agent è un AI-agent open-code capace di autoapprendimento creato da Nous Research (licenza MIT). Non è solo una chat: è un CLI completo per terminale con memoria, skills, pianificatore di attività e gateway per Telegram, Discord, Slack e WhatsApp. L'agente crea competenze dall'esperienza, ricerca nei dialoghi passati e costruisce un modello dell'utente tra le sessioni. Può essere avviato sia su una VPS da $5 che su un cluster GPU.

Il problema di Hermes è lo stesso di qualsiasi strumento ad agenti: il consumo di token. L'agente legge file, esegue cicli di tool-calling, comprime il contesto, gestisce la memoria: per un lavoro attivo si consumano facilmente decine di milioni di token. Con i modelli di Anthropic o OpenAI ($3-15 per 1M), ciò si traduce in decine e centinaia di dollari al giorno di lavoro autonomo.

Hermes supporta per impostazione predefinita qualsiasi provider: Nous Portal, OpenRouter, OpenAI, Anthropic — o il tuo endpoint personalizzato. Questo è il punto di ingresso per JoinGonka Gateway: il nostro gateway compatibile con OpenAI fornisce inferenza dalla rete decentralizzata Gonka a un prezzo a partire da $0.0069 per 1M di token — centinaia e migliaia di volte più economico. Hermes diventa uno strumento quotidiano reale, non una costosa dimostrazione.

Passo 1: Installa Hermes e ottieni la chiave

Installazione di Hermes (Linux, macOS, WSL2). L'installer ufficiale scaricherà automaticamente Python, Node.js, ripgrep e ffmpeg:

# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Dopo l'installazione, riavvia la shell e verifica il funzionamento:

source ~/.bashrc   # o ~/.zshrc
hermes             # CLI interattiva

Chiave API JoinGonka: se non ne hai ancora una, registrati su gate.joingonka.ai/register, conferma il tuo indirizzo — riceverai 3M di token gratuiti sul conto — e crea una chiave con il prefisso jg- nella Dashboard. Una singola chiave e un unico saldo funzionano immediatamente per tutti i modelli.

Fase 2: Collega Gonka come provider personalizzato

Hermes funziona con qualsiasi endpoint compatibile con OpenAI: se il server risponde a /v1/chat/completions, Hermes può essere indirizzato lì. Il gateway di JoinGonka è esattamente così. Esistono tre modi per configurarlo.

Metodo 1: il nostro installer (un unico comando, consigliato). Configurerà il provider nel file di configurazione di Hermes, imposterà DeepSeek V4 Flash come modello predefinito e verificherà con una richiesta live che il gateway accetti la chiave e il modello:

npx @joingonka/setup --tool hermes

Metodo 2: wizard di configurazione. Esegui nel terminale fuori dalla sessione attiva:

hermes model

Nell'elenco dei provider seleziona «Custom endpoint (self-hosted / VLLM / etc.)» e inserisci tre valori:

  • API base URL: https://gate.joingonka.ai/v1
  • API key: jg-tua-chiave
  • Model name: deepseek-ai/DeepSeek-V4-Flash-0731

Metodo 3: modifica del file di configurazione. Hermes conserva le impostazioni dei modelli in ~/.hermes/config.yaml: è l'unica fonte di verità. Aggiungi la sezione:

# ~/.hermes/config.yaml
model:
  provider: custom
  model: deepseek-ai/DeepSeek-V4-Flash-0731
  base_url: https://gate.joingonka.ai/v1
  api_key: jg-tua-chiave

⚠️ La chiave va solo in model.api_key. La documentazione di Hermes consente OPENAI_API_KEY in ~/.hermes/.env, ma per un endpoint personalizzato non funziona: Hermes legge la chiave solo da model.api_key, e con la chiave nel .env il gateway risponderà 401 Invalid API key. Testato su Hermes v0.20.4.

Verifica: avvia hermes e scrivi "Crea un file hello.py con una funzione hello world". L'agente dovrebbe creare il file e mostrare il risultato. Lo stato della configurazione corrente è visibile tramite hermes config show | grep '^model\.' e hermes status.

Passaggio al volo: all'interno della sessione con il comando /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. E /model custom senza nome caricherà automaticamente il modello dall'endpoint, se è l'unico presente.

Confronto dei costi delle sessioni autonome

Hermes è uno strumento basato su agenti con memoria e competenze. Non risponde solo con una battuta: legge file, scrive codice, esegue comandi, comprime il contesto e gestisce lunghe attività in background tramite scheduler. Ogni azione è una chiamata API e in una giornata di lavoro autonomo si accumulano decine di milioni di token. Confrontiamo i costi delle sessioni tipiche:

AttivitàTokenAnthropic ClaudeJoinGonka Gonka
Attività singola con tool-calling~5M$15 — $75$0.048
Agente in background (alcune ore)~20M$60 — $300$0.19
Sviluppo autonomo di una funzionalità~50M$150 — $750$0.48
24 ore di lavoro tramite gateway (Telegram + cron)~150M$450 — $2,250$1.44

Con il gateway JoinGonka, Hermes può essere tenuto attivo 24 ore su 24: report notturni, audit settimanali, attività in background tramite cron, senza preoccuparsi dei costi. Con i prezzi di Anthropic, ogni esecuzione dovrebbe essere calcolata manualmente. Il credito iniziale al momento della registrazione è sufficiente per testare l'agente su un compito reale e vedere i propri consumi prima della prima ricarica.

Selezione del modello e tool calling

Tramite il Gateway, l'utente ha accesso immediato a tre modelli Gonka. Tutti supportano il tool calling nativo (OpenAI function calling), quindi le competenze e gli strumenti di Hermes funzionano in modo affidabile, senza dover analizzare le risposte testuali:

Nome modello (per config)ContestoRisposta maxQuando scegliere
deepseek-ai/DeepSeek-V4-Flash-0731380K32768Impostazione predefinita per Hermes: uno dei contesti più lunghi in rete e un limite di risposta quadruplicato — l'agente gestisce lunghe catene di tool-calling e file di grandi dimensioni in un unico passaggio
MiniMaxAI/MiniMax-M2.7200K8192Modello versatile e stabile per attività brevi e correzioni rapide
zai-org/GLM-5.3-Flash390K8192Modello di reasoning con il contesto più lungo della rete: riflette prima di rispondere — ideale per logiche complesse; parte della risposta viene dedicata al ragionamento, quindi non impostare un limite di risposta troppo basso

Informazioni sui limiti di token in Hermes. Nel file config.yaml, il campo context_length indica la finestra di contesto totale (input + output), mentre max_tokens è il limite massimo per la sola lunghezza della risposta. È preferibile non impostare nessuno dei due: Hermes determinerà automaticamente i valori corretti dal provider. Se imposti max_tokens manualmente, mantienilo entro i limiti del modello: tramite Gateway sono 32768 per DeepSeek V4 Flash e 8192 per MiniMax M2.7 e GLM-5.3 Flash. Puoi cambiare modello in qualsiasi momento con il comando hermes model o direttamente nella sessione tramite /model.

Strumenti terminali simili nella nostra base di conoscenza: Claude Code, Cline.

Hermes Agent + Gonka = un AI-agent Nous Research autonomo a un costo irrisorio. 24 ore di lavoro in background costano $1.44 invece di $450-2,250 con Anthropic. Configurazione — npx @joingonka/setup --tool hermes (o provider custom con base_url del nostro gateway manualmente), tool calling nativo, tre modelli a scelta: DeepSeek V4 Flash con contesto 380K, MiniMax M2.7 e GLM-5.3 Flash. Il saldo iniziale dopo la conferma dell'indirizzo è disponibile per la prima attività reale.

Vuoi saperne di più?

Esplora altre sezioni o inizia a guadagnare GNK subito.

Ottieni un saldo iniziale gratuito →