Sezioni dell'archivio conoscenza ▾
Navigazione
▸ Inizia qui Per ruoloCategorie
- Cursor + Gonka AI — LLM economico per la codifica
- Claude Code + Gonka AI — LLM per terminale
- OpenClaw + Gonka AI — agenti AI accessibili
- OpenCode: il tuo modello nel terminale
- Continue.dev + Gonka AI — AI per VS Code/JetBrains
- Cline + Gonka AI — Agente AI in VS Code
- Aider + Gonka AI — Programmazione a coppie con AI
- LangChain + Gonka AI — Applicazioni AI a un costo minimo
- n8n + Gonka AI — automazione con AI economica
- Open WebUI + Gonka AI — il tuo ChatGPT
- LibreChat + Gonka AI — ChatGPT open-source
- Hermes Agent + DeepSeek sulla rete Gonka — agente autonomo a costi irrisori
- Kilo Code + Gonka AI — agente AI in VS Code
- Roo Code + Gonka AI — agente AI autonomo in VS Code
- LlamaIndex + Gonka AI — Applicazioni RAG a basso costo
- PydanticAI + Gonka — Agenti AI tipizzati a basso costo
- Vercel AI SDK + Gonka AI — Applicazioni AI in TypeScript a basso costo
- TanStack AI + Gonka — Applicazioni AI in TypeScript a basso costo
- Avvio rapido API — curl, Python, TypeScript
- JoinGonka Gateway — panoramica completa
- Management Keys — SaaS su Gonka
- L'API AI più economica: confronto tra i fornitori 2026
- Come acquistare token AI e chiavi API: 3 metodi nel 2026
- Limite di richieste Cursor Pro raggiunto — analisi e alternativa economica
- Claude Code costa meno — analisi del conto e switch
- Cline brucia soldi — perché l'agente consuma così tanto
- OpenClaw costa caro: perché l'agente brucia token e come risparmiare
- OpenRouter: un'alternativa economica — confronto con JoinGonka Gateway
- Il miglior modello AI per il coding nel 2026: confronto e prezzi
- Alternativa economica a GitHub Copilot senza limiti
- Alternativa economica a Windsurf senza crediti e limiti
- L'API più economica per AI-agent nel 2026
- ZCode: inferenza GLM economica al posto del GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — il tuo endpoint invece dei crediti
- GitHub Copilot BYOK — i tuoi modelli invece della quota
- Zed + JoinGonka Gateway — inferenza economica nell'editor
- Pi + JoinGonka Gateway — agente terminale con inferenza economica
- Codex CLI: la tua chiave invece dell'abbonamento
- DeepSeek Harness: il tuo provider tramite JoinGonka Gateway
- MiniMax Code: agente MiniMax con la tua chiave via Gonka
- Warp + JoinGonka Gateway — agent terminal sul proprio endpoint
- Trae + JoinGonka Gateway — modelli della rete Gonka in AI-IDE
- Cherry Studio + JoinGonka Gateway — AI client desktop
- omp (Oh My Pi) + JoinGonka Gateway: agente con ruoli dei modelli
- OpenHands + JoinGonka Gateway: agente sul proprio endpoint
- Qwen Code dopo la chiusura di qwen-oauth: utilizzo tramite JoinGonka Gateway
- Goose + JoinGonka Gateway: il tuo provider e chiave nel keyring
- Crush + JoinGonka Gateway: agente Charm sui modelli della rete Gonka
- Zoo Code + JoinGonka Gateway: migrazione da Roo Code ai modelli Gonka
- Kimi Code CLI: agente Moonshot AI con la propria chiave tramite Gonka
- Factory Droid + JoinGonka Gateway: BYOK sui modelli di rete Gonka
- MiMo Code + JoinGonka Gateway: agente Xiaomi sui modelli di rete Gonka
Strumenti
Warp + JoinGonka Gateway — agent terminal sul proprio endpoint
Warp è un terminale evolutosi in un ambiente di sviluppo basato su agent: il Warp Agent integrato legge l'output dei comandi, modifica i file, avvia le build e gestisce il compito dalla richiesta al risultato. Di default, l'agent lavora sui modelli venduti da Warp, consumando crediti del piano, mentre l'uso del proprio inferenza è stato a lungo possibile solo su piani a pagamento e solo tramite chiavi OpenAI, Anthropic o Google. Il 20 maggio 2026 Warp ha introdotto il BYOK nel piano gratuito e ha aggiunto il custom inference endpoint, consentendo il collegamento di qualsiasi servizio compatibile con le OpenAI Chat Completions.
Questo secondo metodo è necessario per far passare il Warp Agent attraverso il JoinGonka Gateway: il gateway fornisce modelli della rete decentralizzata Gonka tramite un'API compatibile con OpenAI, l'inferenza viene pagata ai prezzi correnti della rete e, per singoli sviluppatori e piccoli team, non vengono consumati i crediti Warp. Dopo la registrazione e la conferma dell'indirizzo, verranno accreditati 3M di token gratuiti, sufficienti per testare l'agent sui propri compiti prima della prima ricarica.
Di seguito trovi cosa è necessario prima di iniziare, quali valori inserire nel modulo Warp, come verificare che le richieste passino dal gateway, quale modello di rete scegliere per i compiti da terminale e cosa è importante sapere sul percorso delle richieste: in Warp è gestito diversamente rispetto alla maggior parte degli strumenti.
Cosa serve: chiave, piano Warp e indirizzo pubblico
Chiave JoinGonka. Registrati sul gateway, apri la sezione "Chiavi API" nel tuo profilo e clicca su "Crea chiave". La chiave inizia con jg- e viene mostrata una sola volta: salvala subito. È comodo creare una chiave separata per Warp: in questo modo, nella sezione "Utilizzo", il consumo dell'agent da terminale sarà visibile separatamente rispetto ad altri strumenti.
Piano Warp. Il proprio endpoint non è disponibile solo nei piani a pagamento; le condizioni dipendono dalle dimensioni del team:
| Chi effettua il collegamento | Disponibilità endpoint personalizzato | Crediti Warp |
|---|---|---|
| Singolo sviluppatore o azienda fino a 10 persone (piani Free, Build, Max) | Sì, su tutti questi piani | Per l'inferenza tramite endpoint personale non vengono scalati crediti |
| Organizzazione con più di 10 persone | Solo su Business o Enterprise | Le esecuzioni locali dell'agent consumano platform credits (tariffe per l'infrastruttura Warp a costo ridotto); l'inferenza stessa viene pagata al fornitore dell'endpoint |
Indirizzo HTTPS pubblico. È un requisito di Warp non sempre ovvio: le richieste al tuo endpoint non vengono inviate dall'applicazione sul tuo PC, ma dai server di Warp, quindi l'indirizzo deve essere raggiungibile da Internet. localhost, 127.0.0.1 e gli indirizzi di rete privata vengono rifiutati dal modulo, ed è ammesso solo lo schema https://. JoinGonka Gateway è un servizio HTTPS pubblico, quindi tunnel come ngrok, suggeriti nella documentazione di Warp per i modelli locali, non sono necessari qui.
Versione aggiornata dell'app. Il proprio endpoint è incluso nella build stabile dal rilascio del 20 maggio 2026, la selezione dello schema API nel modulo è apparsa nel rilascio del 31 luglio 2026. Se il campo API schema non è presente nel modulo, aggiorna Warp.
Connessione: modulo Add custom endpoint
Tutta la configurazione si fa dall'interfaccia dell'app: niente modifiche manuali ai file.
- Apri Settings e digita
inference endpointnella ricerca delle impostazioni: Warp ti porterà al blocco con le chiavi dei provider e i tuoi endpoint (si trova nella pagina delle impostazioni di Warp Agent). - Clicca Add custom endpoint: si apre il modulo.
- Compila i campi con i valori della tabella e clicca Add endpoint.
| Campo del modulo | Cosa inserire | Note |
|---|---|---|
| API schema | OpenAI Chat Completions | Schema predefinito: è proprio per questo che la documentazione di Warp descrive il formato dell'indirizzo. Nell'elenco ci sono anche OpenAI Responses e Anthropic Messages |
| Endpoint name | JoinGonka | Qualsiasi nome: è quello con cui l'endpoint compare nelle impostazioni |
| Endpoint URL | https://gate.joingonka.ai/v1 | Indirizzo di base con /v1, esattamente come nell'esempio della documentazione di Warp |
| API key | jg-your-key | Rimane solo sul dispositivo, nel portachiavi di sistema |
| Model name | deepseek-ai/DeepSeek-V4-Flash-0731 | L'identificativo esatto della modella, così come lo restituisce il gateway |
| Model alias (optional) | DeepSeek V4 Flash | Nome breve per il selettore delle modelle |
Il pulsante + Add model aggiunge la riga successiva. Configura subito tutte le modelle della rete, così potrai passare dall'una all'altra senza tornare nelle impostazioni: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 e zai-org/GLM-5.3-Flash. L'elenco aggiornato è sempre disponibile con GET https://gate.joingonka.ai/v1/models. Copia gli identificativi carattere per carattere: il modulo verifica solo il formato dell'indirizzo e che i campi siano compilati, non fa una richiesta di prova al salvataggio, quindi un refuso nel nome della modella salterà fuori solo durante la conversazione con l'agente.
Dopo il salvataggio, le modelle compaiono nel selettore dell'agente. Se come predefinita era rimasta una delle modelle di Warp, l'app potrebbe proporti di cambiarla: accetta e scegli la modella del tuo endpoint. Dettaglio importante: le voci Auto nel selettore girano sempre sull'infrastruttura di Warp e consumano i suoi crediti, anche con un endpoint configurato. Perché la richiesta arrivi al gateway, nel selettore dev'essere scelta una modella specifica del tuo elenco.
Verifica: le richieste passano attraverso il gateway
Seleziona nel selettore il modello del tuo endpoint e assegna all'agente un compito breve, ad esempio: «Mostra i cinque file più grandi nella directory corrente e spiega il comando». L'agente dovrebbe suggerire il comando, eseguirlo previa autorizzazione e commentare l'output.
Ora apri il pannello del gateway, sezione «Usage». Nel blocco «By keys», per la chiave configurata in Warp, appariranno le richieste e l'orario dell'ultima interazione; nel blocco «By models» apparirà il modello selezionato. Se i contatori aumentano, significa che l'inference avviene tramite JoinGonka Gateway e non a spese dei crediti Warp. Da parte sua, Warp mostra il consumo di token direttamente nella chat con l'agente, sotto i nomi brevi (alias) che hai impostato.
Se qualcosa non va, la causa è solitamente leggibile nella risposta:
| Cosa vedi | Cosa significa | Cosa fare |
|---|---|---|
401, Invalid API key | Il gateway non ha riconosciuto la chiave | Verifica che la chiave inizi con jg-, sia inserita senza spazi e sia attiva nella sezione «API-keys»; in caso di dubbio, creane una nuova |
404, Invalid URL (POST …) | Il percorso è composto con un segmento extra; nel testo dell'errore il gateway mostra dove è arrivata la richiesta | Dovrebbe risultare /v1/chat/completions. È stato duplicato /v1 o è finito il percorso completo nell'indirizzo — correggi l'Endpoint URL secondo la tabella sopra |
405 Not Allowed o una pagina HTML invece della risposta | Manca /v1 nell'indirizzo, la richiesta ha mancato l'API | Aggiungi /v1 alla fine dell'indirizzo |
429 | Il modello è sovraccarico: nelle ore di punta la capacità di un modello specifico può essere completamente esaurita | Riprova dopo qualche secondo o passa a un modello alternativo — ecco perché vale la pena configurarli tutti subito |
| Le richieste passano ma i crediti Warp calano | È selezionato Auto o il router dei modelli Warp, non il modello dell'endpoint | Seleziona il modello specifico dal tuo elenco |
| Il modulo non accetta l'indirizzo | Warp richiede https:// e un host pubblico | Inserisci l'indirizzo del gateway per intero, iniziando con https:// |
| Il modello «non vede» l'immagine allegata | I modelli di rete sono testuali: il gateway sostituisce l'immagine con una nota testuale | Per attività con screenshot passa a un modello con visione, per comandi e codice resta sui modelli di rete |
| Il modello dell'endpoint non è presente durante l'avvio nel cloud | L'endpoint personalizzato è memorizzato localmente e non si estende ai Cloud Agents | Avvia il compito con l'agente locale |
La prima risposta della sessione potrebbe arrivare con un ritardo di alcuni secondi: l'agente invia un ampio system prompt con la descrizione degli strumenti, e la richiesta attraversa prima i server Warp e poi il nodo della rete. Successivamente la conversazione sarà più fluida.
Quale modello scegliere per l'agente da terminale
Il prezzo dei modelli di rete è identico, quindi la scelta riguarda il comportamento, non il budget. Il terminal agent legge molto (output di comandi, log, file) e richiama costantemente strumenti; tutti i modelli nella tabella supportano il native tool calling.
| Modello | Identificativo | Contesto e risposta | Quando scegliere in Warp |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K, risposta fino a 32768 token | Modello predefinito per l'agent: sessioni lunghe, log e diff di grandi dimensioni, modifiche in più file. Ampio margine di contesto e il tetto di risposta più alto della rete |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K, risposta fino a 8192 token | Attività brevi e veloci: trovare un comando, analizzare un errore, correggere una configurazione |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K, risposta fino a 8192 token | Reasoning-model: ragiona prima di rispondere. Debugging complesso, piano di migrazione, analisi di codice sconosciuto; la risposta arriva più tardi e una parte del limite di risposta viene utilizzata per il ragionamento |
Schema pratico: DeepSeek V4 Flash come modello principale, MiniMax M2.7 per le piccole cose, GLM-5.3 Flash quando l'attività si basa sulla logica e non sul volume. Lo switch richiede un secondo perché tutti i modelli sono già impostati nell'endpoint e i nomi brevi dal campo alias aiutano a non confondersi con gli identificativi lunghi. Maggiori dettagli sul più popolare nel review di DeepSeek V4 Flash.
Quanto costa
Il consumo di token dell'agent nel terminale è superiore a quello della chat: a ogni richiesta Warp aggiunge istruzioni di sistema, contesto della conversazione e descrizione degli strumenti, e un'attività consiste in diversi passaggi. Pertanto, il prezzo per token qui è più importante che nella corrispondenza normale.
Tramite JoinGonka Gateway i token costano $0.0069 per milione in entrata e $0.021 per milione in uscita — il prezzo è uguale per tutti i modelli di rete e viene fornito su questa pagina da una fonte in tempo reale. Ordine di grandezza dei prezzi a settembre 2026:
| Scenario | Consumo | Tramite Gateway |
|---|---|---|
| Attività una tantum: comando e analisi dell'output | decine di migliaia di token | frazioni di centesimo |
| Una giornata di lavoro attivo con l'agent | 3-7M di token | pochi centesimi |
| Mese di lavoro quotidiano | ~150M di token | circa uno-due dollari |
Per confronto, tre modi per pagare l'agent Warp:
| Metodo | Chi calcola l'inference | Cosa limita |
|---|---|---|
| Modelli Warp | Warp, tramite crediti del piano | Disponibilità mensile dei crediti del piano |
| BYOK: chiave OpenAI, Anthropic o Google | Vendor del modello secondo il proprio listino | Prezzo per milione di token del vendor |
| Endpoint proprio + JoinGonka Gateway | Gateway: per token, dal saldo | Solo saldo: il consumo è visibile nel pannello, non ci sono quote sul numero di richieste |
Warp stesso per singoli utenti e team fino a 10 persone non addebita crediti per il lavoro tramite il proprio endpoint — paghi solo i token sul gateway. Il saldo viene ricaricato nel pannello, dove sono visibili anche il resto e il consumo per giorni e modelli.
Percorso delle richieste e privacy: cosa è importante sapere
Per la maggior parte degli strumenti, un endpoint personalizzato significa «le richieste vanno direttamente dalla mia macchina al provider». Con Warp è diverso: la parte di esecuzione dell'agente funziona sui server Warp e l'endpoint personalizzato modifica solo la destinazione finale e la chiave. Secondo la documentazione di Warp, il percorso della richiesta è il seguente:
- L'applicazione prende l'indirizzo dell'endpoint e la chiave dal deposito sicuro sul dispositivo e li invia ai server Warp insieme al tuo prompt.
- L'agente lato Warp raccoglie la richiesta completa — istruzioni di sistema, contesto della conversazione, strumenti — e chiama il tuo endpoint con quella chiave.
- La risposta viene restituita all'applicazione tramite streaming attraverso gli stessi server.
Cosa significa questo nella pratica:
- Chiave. Viene memorizzata solo sul dispositivo. Passa attraverso i server Warp a ogni richiesta, ma, secondo Warp, non viene salvata lì: viene utilizzata al momento e poi scartata.
- Prompt e risposte. Transitano attraverso il backend di Warp. Warp dichiara di non utilizzare questi contenuti per l'addestramento, mentre l'archiviazione e l'analisi sono soggette alle impostazioni di privacy e telemetria del tuo account. La garanzia ZDR, che si applica ai modelli di Warp, non può essere estesa all'endpoint personalizzato: ciò che viene conservato dipende dal provider scelto.
- Lato gateway. JoinGonka Gateway non conserva le conversazioni: i prompt e le risposte non rimangono sul gateway dopo la risposta; nel pannello di controllo sono visibili solo i contatori delle richieste e dei token.
- Cosa rimane sull'infrastruttura Warp. Le opzioni Auto, i router di modelli personalizzati, il Codebase Context, i suggerimenti Active AI e gli agenti cloud non sono influenzati dall'endpoint personalizzato.
Se per le tue attività il percorso attraverso server terzi non è accettabile, utilizza un agente che si colleghi all'endpoint direttamente dalla tua macchina, ad esempio Codex CLI o qualsiasi strumento della guida rapida alle API. Warp stessa, nell'annuncio, promette anche un'opzione lato client: un modulo agente leggero in Rust in un repository open source, che si connetterà ai modelli locali senza passare per i server Warp, oltre al supporto per l'Agent Client Protocol. Dalla release del 2 settembre 2026, le descrizioni degli endpoint sono memorizzate in un file di configurazione in un formato comune all'applicazione e al Warp Agent CLI; le chiavi non vengono salvate in questo file e rimangono nel deposito sicuro.
Vuoi saperne di più?
Esplora altre sezioni o inizia a guadagnare GNK subito.
Ottieni chiave e token gratuiti →