Sezioni dell'archivio conoscenza ▾
Navigazione
▸ Inizia qui Per ruoloCategorie
- Cursor + Gonka AI — LLM economico per la codifica
- Claude Code + Gonka AI — LLM per terminale
- OpenClaw + Gonka AI — agenti AI accessibili
- OpenCode: il tuo modello nel terminale
- Continue.dev + Gonka AI — AI per VS Code/JetBrains
- Cline + Gonka AI — Agente AI in VS Code
- Aider + Gonka AI — Programmazione a coppie con AI
- LangChain + Gonka AI — Applicazioni AI a un costo minimo
- n8n + Gonka AI — automazione con AI economica
- Open WebUI + Gonka AI — il tuo ChatGPT
- LibreChat + Gonka AI — ChatGPT open-source
- Hermes Agent + DeepSeek sulla rete Gonka — agente autonomo a costi irrisori
- Kilo Code + Gonka AI — agente AI in VS Code
- Roo Code + Gonka AI — agente AI autonomo in VS Code
- LlamaIndex + Gonka AI — Applicazioni RAG a basso costo
- PydanticAI + Gonka — Agenti AI tipizzati a basso costo
- Vercel AI SDK + Gonka AI — Applicazioni AI in TypeScript a basso costo
- TanStack AI + Gonka — Applicazioni AI in TypeScript a basso costo
- Avvio rapido API — curl, Python, TypeScript
- JoinGonka Gateway — panoramica completa
- Management Keys — SaaS su Gonka
- L'API AI più economica: confronto tra i fornitori 2026
- Limite di richieste Cursor Pro raggiunto — analisi e alternativa economica
- Claude Code costa meno — analisi del conto e switch
- Cline brucia soldi — perché l'agente consuma così tanto
- OpenClaw costa caro: perché l'agente brucia token e come risparmiare
- OpenRouter: un'alternativa economica — confronto con JoinGonka Gateway
- Il miglior modello AI per il coding nel 2026: confronto e prezzi
- Alternativa economica a GitHub Copilot senza limiti
- Alternativa economica a Windsurf senza crediti e limiti
- L'API più economica per AI-agent nel 2026
- ZCode: inferenza GLM economica al posto del GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — il tuo endpoint invece dei crediti
- GitHub Copilot BYOK — i tuoi modelli invece della quota
- Zed + JoinGonka Gateway — inferenza economica nell'editor
- Pi + JoinGonka Gateway — agente terminale con inferenza economica
- Codex CLI: la tua chiave invece dell'abbonamento
Strumenti
Hermes Agent + DeepSeek sulla rete Gonka — agente autonomo a costi irrisori
Hermes Agent è un AI-agent open-code capace di autoapprendimento creato da Nous Research (licenza MIT). Non è solo una chat: è un CLI completo per terminale con memoria, skills, pianificatore di attività e gateway per Telegram, Discord, Slack e WhatsApp. L'agente crea competenze dall'esperienza, ricerca nei dialoghi passati e costruisce un modello dell'utente tra le sessioni. Può essere avviato sia su una VPS da $5 che su un cluster GPU.
Il problema di Hermes è lo stesso di qualsiasi strumento ad agenti: il consumo di token. L'agente legge file, esegue cicli di tool-calling, comprime il contesto, gestisce la memoria: per un lavoro attivo si consumano facilmente decine di milioni di token. Con i modelli di Anthropic o OpenAI ($3-15 per 1M), ciò si traduce in decine e centinaia di dollari al giorno di lavoro autonomo.
Hermes supporta per impostazione predefinita qualsiasi provider: Nous Portal, OpenRouter, OpenAI, Anthropic — o il tuo endpoint personalizzato. Questo è il punto di ingresso per JoinGonka Gateway: il nostro gateway compatibile con OpenAI fornisce inferenza dalla rete decentralizzata Gonka a un prezzo a partire da $0.0069 per 1M di token — centinaia e migliaia di volte più economico. Hermes diventa uno strumento quotidiano reale, non una costosa dimostrazione.
Passo 1: Installa Hermes e ottieni la chiave
Installazione di Hermes (Linux, macOS, WSL2). L'installer ufficiale scaricherà automaticamente Python, Node.js, ripgrep e ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Dopo l'installazione, riavvia la shell e verifica il funzionamento:
source ~/.bashrc # o ~/.zshrc
hermes # CLI interattivaChiave API JoinGonka: se non ne hai ancora una, registrati su gate.joingonka.ai/register, conferma il tuo indirizzo — riceverai 3M di token gratuiti sul conto — e crea una chiave con il prefisso jg- nella Dashboard. Una singola chiave e un unico saldo funzionano immediatamente per tutti i modelli.
Fase 2: Collega Gonka come provider personalizzato
Hermes funziona con qualsiasi endpoint compatibile con OpenAI: se il server risponde a /v1/chat/completions, Hermes può essere indirizzato lì. Il gateway di JoinGonka è esattamente così. Esistono tre modi per configurarlo.
Metodo 1: il nostro installer (un unico comando, consigliato). Configurerà il provider nel file di configurazione di Hermes, imposterà DeepSeek V4 Flash come modello predefinito e verificherà con una richiesta live che il gateway accetti la chiave e il modello:
npx @joingonka/setup --tool hermesMetodo 2: wizard di configurazione. Esegui nel terminale fuori dalla sessione attiva:
hermes modelNell'elenco dei provider seleziona «Custom endpoint (self-hosted / VLLM / etc.)» e inserisci tre valori:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-tua-chiave - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
Metodo 3: modifica del file di configurazione. Hermes conserva le impostazioni dei modelli in ~/.hermes/config.yaml: è l'unica fonte di verità. Aggiungi la sezione:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-tua-chiave⚠️ La chiave va solo in model.api_key. La documentazione di Hermes consente OPENAI_API_KEY in ~/.hermes/.env, ma per un endpoint personalizzato non funziona: Hermes legge la chiave solo da model.api_key, e con la chiave nel .env il gateway risponderà 401 Invalid API key. Testato su Hermes v0.20.4.
Verifica: avvia hermes e scrivi "Crea un file hello.py con una funzione hello world". L'agente dovrebbe creare il file e mostrare il risultato. Lo stato della configurazione corrente è visibile tramite hermes config show | grep '^model\.' e hermes status.
Passaggio al volo: all'interno della sessione con il comando /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. E /model custom senza nome caricherà automaticamente il modello dall'endpoint, se è l'unico presente.
Confronto dei costi delle sessioni autonome
Hermes è uno strumento basato su agenti con memoria e competenze. Non risponde solo con una battuta: legge file, scrive codice, esegue comandi, comprime il contesto e gestisce lunghe attività in background tramite scheduler. Ogni azione è una chiamata API e in una giornata di lavoro autonomo si accumulano decine di milioni di token. Confrontiamo i costi delle sessioni tipiche:
| Attività | Token | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Attività singola con tool-calling | ~5M | $15 — $75 | $0.048 |
| Agente in background (alcune ore) | ~20M | $60 — $300 | $0.19 |
| Sviluppo autonomo di una funzionalità | ~50M | $150 — $750 | $0.48 |
| 24 ore di lavoro tramite gateway (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
Con il gateway JoinGonka, Hermes può essere tenuto attivo 24 ore su 24: report notturni, audit settimanali, attività in background tramite cron, senza preoccuparsi dei costi. Con i prezzi di Anthropic, ogni esecuzione dovrebbe essere calcolata manualmente. Il credito iniziale al momento della registrazione è sufficiente per testare l'agente su un compito reale e vedere i propri consumi prima della prima ricarica.
Selezione del modello e tool calling
Tramite il Gateway, l'utente ha accesso immediato a tre modelli Gonka. Tutti supportano il tool calling nativo (OpenAI function calling), quindi le competenze e gli strumenti di Hermes funzionano in modo affidabile, senza dover analizzare le risposte testuali:
| Nome modello (per config) | Contesto | Risposta max | Quando scegliere |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Impostazione predefinita per Hermes: uno dei contesti più lunghi in rete e un limite di risposta quadruplicato — l'agente gestisce lunghe catene di tool-calling e file di grandi dimensioni in un unico passaggio |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Modello versatile e stabile per attività brevi e correzioni rapide |
zai-org/GLM-5.3-Flash | 390K | 8192 | Modello di reasoning con il contesto più lungo della rete: riflette prima di rispondere — ideale per logiche complesse; parte della risposta viene dedicata al ragionamento, quindi non impostare un limite di risposta troppo basso |
Informazioni sui limiti di token in Hermes. Nel file config.yaml, il campo context_length indica la finestra di contesto totale (input + output), mentre max_tokens è il limite massimo per la sola lunghezza della risposta. È preferibile non impostare nessuno dei due: Hermes determinerà automaticamente i valori corretti dal provider. Se imposti max_tokens manualmente, mantienilo entro i limiti del modello: tramite Gateway sono 32768 per DeepSeek V4 Flash e 8192 per MiniMax M2.7 e GLM-5.3 Flash. Puoi cambiare modello in qualsiasi momento con il comando hermes model o direttamente nella sessione tramite /model.
Strumenti terminali simili nella nostra base di conoscenza: Claude Code, Cline.
Vuoi saperne di più?
Esplora altre sezioni o inizia a guadagnare GNK subito.
Ottieni un saldo iniziale gratuito →