Sezioni dell'archivio conoscenza ▾

Navigazione

▸ Inizia qui Per ruolo

Categorie

Strumenti 52
Glossario 12

Strumenti

Warp + JoinGonka Gateway — agent terminal sul proprio endpoint

Warp è un terminale evolutosi in un ambiente di sviluppo basato su agent: il Warp Agent integrato legge l'output dei comandi, modifica i file, avvia le build e gestisce il compito dalla richiesta al risultato. Di default, l'agent lavora sui modelli venduti da Warp, consumando crediti del piano, mentre l'uso del proprio inferenza è stato a lungo possibile solo su piani a pagamento e solo tramite chiavi OpenAI, Anthropic o Google. Il 20 maggio 2026 Warp ha introdotto il BYOK nel piano gratuito e ha aggiunto il custom inference endpoint, consentendo il collegamento di qualsiasi servizio compatibile con le OpenAI Chat Completions.

Questo secondo metodo è necessario per far passare il Warp Agent attraverso il JoinGonka Gateway: il gateway fornisce modelli della rete decentralizzata Gonka tramite un'API compatibile con OpenAI, l'inferenza viene pagata ai prezzi correnti della rete e, per singoli sviluppatori e piccoli team, non vengono consumati i crediti Warp. Dopo la registrazione e la conferma dell'indirizzo, verranno accreditati 3M di token gratuiti, sufficienti per testare l'agent sui propri compiti prima della prima ricarica.

Di seguito trovi cosa è necessario prima di iniziare, quali valori inserire nel modulo Warp, come verificare che le richieste passino dal gateway, quale modello di rete scegliere per i compiti da terminale e cosa è importante sapere sul percorso delle richieste: in Warp è gestito diversamente rispetto alla maggior parte degli strumenti.

Cosa serve: chiave, piano Warp e indirizzo pubblico

Chiave JoinGonka. Registrati sul gateway, apri la sezione "Chiavi API" nel tuo profilo e clicca su "Crea chiave". La chiave inizia con jg- e viene mostrata una sola volta: salvala subito. È comodo creare una chiave separata per Warp: in questo modo, nella sezione "Utilizzo", il consumo dell'agent da terminale sarà visibile separatamente rispetto ad altri strumenti.

Piano Warp. Il proprio endpoint non è disponibile solo nei piani a pagamento; le condizioni dipendono dalle dimensioni del team:

Chi effettua il collegamentoDisponibilità endpoint personalizzatoCrediti Warp
Singolo sviluppatore o azienda fino a 10 persone (piani Free, Build, Max)Sì, su tutti questi pianiPer l'inferenza tramite endpoint personale non vengono scalati crediti
Organizzazione con più di 10 personeSolo su Business o EnterpriseLe esecuzioni locali dell'agent consumano platform credits (tariffe per l'infrastruttura Warp a costo ridotto); l'inferenza stessa viene pagata al fornitore dell'endpoint

Indirizzo HTTPS pubblico. È un requisito di Warp non sempre ovvio: le richieste al tuo endpoint non vengono inviate dall'applicazione sul tuo PC, ma dai server di Warp, quindi l'indirizzo deve essere raggiungibile da Internet. localhost, 127.0.0.1 e gli indirizzi di rete privata vengono rifiutati dal modulo, ed è ammesso solo lo schema https://. JoinGonka Gateway è un servizio HTTPS pubblico, quindi tunnel come ngrok, suggeriti nella documentazione di Warp per i modelli locali, non sono necessari qui.

Versione aggiornata dell'app. Il proprio endpoint è incluso nella build stabile dal rilascio del 20 maggio 2026, la selezione dello schema API nel modulo è apparsa nel rilascio del 31 luglio 2026. Se il campo API schema non è presente nel modulo, aggiorna Warp.

Connessione: modulo Add custom endpoint

Tutta la configurazione si fa dall'interfaccia dell'app: niente modifiche manuali ai file.

  1. Apri Settings e digita inference endpoint nella ricerca delle impostazioni: Warp ti porterà al blocco con le chiavi dei provider e i tuoi endpoint (si trova nella pagina delle impostazioni di Warp Agent).
  2. Clicca Add custom endpoint: si apre il modulo.
  3. Compila i campi con i valori della tabella e clicca Add endpoint.
Campo del moduloCosa inserireNote
API schemaOpenAI Chat CompletionsSchema predefinito: è proprio per questo che la documentazione di Warp descrive il formato dell'indirizzo. Nell'elenco ci sono anche OpenAI Responses e Anthropic Messages
Endpoint nameJoinGonkaQualsiasi nome: è quello con cui l'endpoint compare nelle impostazioni
Endpoint URLhttps://gate.joingonka.ai/v1Indirizzo di base con /v1, esattamente come nell'esempio della documentazione di Warp
API keyjg-your-keyRimane solo sul dispositivo, nel portachiavi di sistema
Model namedeepseek-ai/DeepSeek-V4-Flash-0731L'identificativo esatto della modella, così come lo restituisce il gateway
Model alias (optional)DeepSeek V4 FlashNome breve per il selettore delle modelle

Il pulsante + Add model aggiunge la riga successiva. Configura subito tutte le modelle della rete, così potrai passare dall'una all'altra senza tornare nelle impostazioni: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 e zai-org/GLM-5.3-Flash. L'elenco aggiornato è sempre disponibile con GET https://gate.joingonka.ai/v1/models. Copia gli identificativi carattere per carattere: il modulo verifica solo il formato dell'indirizzo e che i campi siano compilati, non fa una richiesta di prova al salvataggio, quindi un refuso nel nome della modella salterà fuori solo durante la conversazione con l'agente.

Dopo il salvataggio, le modelle compaiono nel selettore dell'agente. Se come predefinita era rimasta una delle modelle di Warp, l'app potrebbe proporti di cambiarla: accetta e scegli la modella del tuo endpoint. Dettaglio importante: le voci Auto nel selettore girano sempre sull'infrastruttura di Warp e consumano i suoi crediti, anche con un endpoint configurato. Perché la richiesta arrivi al gateway, nel selettore dev'essere scelta una modella specifica del tuo elenco.

Verifica: le richieste passano attraverso il gateway

Seleziona nel selettore il modello del tuo endpoint e assegna all'agente un compito breve, ad esempio: «Mostra i cinque file più grandi nella directory corrente e spiega il comando». L'agente dovrebbe suggerire il comando, eseguirlo previa autorizzazione e commentare l'output.

Ora apri il pannello del gateway, sezione «Usage». Nel blocco «By keys», per la chiave configurata in Warp, appariranno le richieste e l'orario dell'ultima interazione; nel blocco «By models» apparirà il modello selezionato. Se i contatori aumentano, significa che l'inference avviene tramite JoinGonka Gateway e non a spese dei crediti Warp. Da parte sua, Warp mostra il consumo di token direttamente nella chat con l'agente, sotto i nomi brevi (alias) che hai impostato.

Se qualcosa non va, la causa è solitamente leggibile nella risposta:

Cosa vediCosa significaCosa fare
401, Invalid API keyIl gateway non ha riconosciuto la chiaveVerifica che la chiave inizi con jg-, sia inserita senza spazi e sia attiva nella sezione «API-keys»; in caso di dubbio, creane una nuova
404, Invalid URL (POST …)Il percorso è composto con un segmento extra; nel testo dell'errore il gateway mostra dove è arrivata la richiestaDovrebbe risultare /v1/chat/completions. È stato duplicato /v1 o è finito il percorso completo nell'indirizzo — correggi l'Endpoint URL secondo la tabella sopra
405 Not Allowed o una pagina HTML invece della rispostaManca /v1 nell'indirizzo, la richiesta ha mancato l'APIAggiungi /v1 alla fine dell'indirizzo
429Il modello è sovraccarico: nelle ore di punta la capacità di un modello specifico può essere completamente esauritaRiprova dopo qualche secondo o passa a un modello alternativo — ecco perché vale la pena configurarli tutti subito
Le richieste passano ma i crediti Warp calanoÈ selezionato Auto o il router dei modelli Warp, non il modello dell'endpointSeleziona il modello specifico dal tuo elenco
Il modulo non accetta l'indirizzoWarp richiede https:// e un host pubblicoInserisci l'indirizzo del gateway per intero, iniziando con https://
Il modello «non vede» l'immagine allegataI modelli di rete sono testuali: il gateway sostituisce l'immagine con una nota testualePer attività con screenshot passa a un modello con visione, per comandi e codice resta sui modelli di rete
Il modello dell'endpoint non è presente durante l'avvio nel cloudL'endpoint personalizzato è memorizzato localmente e non si estende ai Cloud AgentsAvvia il compito con l'agente locale

La prima risposta della sessione potrebbe arrivare con un ritardo di alcuni secondi: l'agente invia un ampio system prompt con la descrizione degli strumenti, e la richiesta attraversa prima i server Warp e poi il nodo della rete. Successivamente la conversazione sarà più fluida.

Quale modello scegliere per l'agente da terminale

Il prezzo dei modelli di rete è identico, quindi la scelta riguarda il comportamento, non il budget. Il terminal agent legge molto (output di comandi, log, file) e richiama costantemente strumenti; tutti i modelli nella tabella supportano il native tool calling.

ModelloIdentificativoContesto e rispostaQuando scegliere in Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, risposta fino a 32768 tokenModello predefinito per l'agent: sessioni lunghe, log e diff di grandi dimensioni, modifiche in più file. Ampio margine di contesto e il tetto di risposta più alto della rete
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, risposta fino a 8192 tokenAttività brevi e veloci: trovare un comando, analizzare un errore, correggere una configurazione
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, risposta fino a 8192 tokenReasoning-model: ragiona prima di rispondere. Debugging complesso, piano di migrazione, analisi di codice sconosciuto; la risposta arriva più tardi e una parte del limite di risposta viene utilizzata per il ragionamento

Schema pratico: DeepSeek V4 Flash come modello principale, MiniMax M2.7 per le piccole cose, GLM-5.3 Flash quando l'attività si basa sulla logica e non sul volume. Lo switch richiede un secondo perché tutti i modelli sono già impostati nell'endpoint e i nomi brevi dal campo alias aiutano a non confondersi con gli identificativi lunghi. Maggiori dettagli sul più popolare nel review di DeepSeek V4 Flash.

Quanto costa

Il consumo di token dell'agent nel terminale è superiore a quello della chat: a ogni richiesta Warp aggiunge istruzioni di sistema, contesto della conversazione e descrizione degli strumenti, e un'attività consiste in diversi passaggi. Pertanto, il prezzo per token qui è più importante che nella corrispondenza normale.

Tramite JoinGonka Gateway i token costano $0.0069 per milione in entrata e $0.021 per milione in uscita — il prezzo è uguale per tutti i modelli di rete e viene fornito su questa pagina da una fonte in tempo reale. Ordine di grandezza dei prezzi a settembre 2026:

ScenarioConsumoTramite Gateway
Attività una tantum: comando e analisi dell'outputdecine di migliaia di tokenfrazioni di centesimo
Una giornata di lavoro attivo con l'agent3-7M di tokenpochi centesimi
Mese di lavoro quotidiano~150M di tokencirca uno-due dollari

Per confronto, tre modi per pagare l'agent Warp:

MetodoChi calcola l'inferenceCosa limita
Modelli WarpWarp, tramite crediti del pianoDisponibilità mensile dei crediti del piano
BYOK: chiave OpenAI, Anthropic o GoogleVendor del modello secondo il proprio listinoPrezzo per milione di token del vendor
Endpoint proprio + JoinGonka GatewayGateway: per token, dal saldoSolo saldo: il consumo è visibile nel pannello, non ci sono quote sul numero di richieste

Warp stesso per singoli utenti e team fino a 10 persone non addebita crediti per il lavoro tramite il proprio endpoint — paghi solo i token sul gateway. Il saldo viene ricaricato nel pannello, dove sono visibili anche il resto e il consumo per giorni e modelli.

Percorso delle richieste e privacy: cosa è importante sapere

Per la maggior parte degli strumenti, un endpoint personalizzato significa «le richieste vanno direttamente dalla mia macchina al provider». Con Warp è diverso: la parte di esecuzione dell'agente funziona sui server Warp e l'endpoint personalizzato modifica solo la destinazione finale e la chiave. Secondo la documentazione di Warp, il percorso della richiesta è il seguente:

  1. L'applicazione prende l'indirizzo dell'endpoint e la chiave dal deposito sicuro sul dispositivo e li invia ai server Warp insieme al tuo prompt.
  2. L'agente lato Warp raccoglie la richiesta completa — istruzioni di sistema, contesto della conversazione, strumenti — e chiama il tuo endpoint con quella chiave.
  3. La risposta viene restituita all'applicazione tramite streaming attraverso gli stessi server.

Cosa significa questo nella pratica:

  • Chiave. Viene memorizzata solo sul dispositivo. Passa attraverso i server Warp a ogni richiesta, ma, secondo Warp, non viene salvata lì: viene utilizzata al momento e poi scartata.
  • Prompt e risposte. Transitano attraverso il backend di Warp. Warp dichiara di non utilizzare questi contenuti per l'addestramento, mentre l'archiviazione e l'analisi sono soggette alle impostazioni di privacy e telemetria del tuo account. La garanzia ZDR, che si applica ai modelli di Warp, non può essere estesa all'endpoint personalizzato: ciò che viene conservato dipende dal provider scelto.
  • Lato gateway. JoinGonka Gateway non conserva le conversazioni: i prompt e le risposte non rimangono sul gateway dopo la risposta; nel pannello di controllo sono visibili solo i contatori delle richieste e dei token.
  • Cosa rimane sull'infrastruttura Warp. Le opzioni Auto, i router di modelli personalizzati, il Codebase Context, i suggerimenti Active AI e gli agenti cloud non sono influenzati dall'endpoint personalizzato.

Se per le tue attività il percorso attraverso server terzi non è accettabile, utilizza un agente che si colleghi all'endpoint direttamente dalla tua macchina, ad esempio Codex CLI o qualsiasi strumento della guida rapida alle API. Warp stessa, nell'annuncio, promette anche un'opzione lato client: un modulo agente leggero in Rust in un repository open source, che si connetterà ai modelli locali senza passare per i server Warp, oltre al supporto per l'Agent Client Protocol. Dalla release del 2 settembre 2026, le descrizioni degli endpoint sono memorizzate in un file di configurazione in un formato comune all'applicazione e al Warp Agent CLI; le chiavi non vengono salvate in questo file e rimangono nel deposito sicuro.

Warp si connette a JoinGonka Gateway tramite il modulo Add custom endpoint: schema OpenAI Chat Completions, indirizzo https://gate.joingonka.ai/v1, chiave jg- e identificativi dei modelli di rete. Per singoli utenti e team fino a 10 persone, ciò è disponibile anche sul piano gratuito e i crediti Warp per l'inference non vengono consumati se nel selettore è selezionato un modello endpoint invece di Auto. La caratteristica principale di Warp è il percorso: le richieste all'endpoint vengono inviate dai suoi server, quindi l'indirizzo deve essere pubblico e i prompt passano attraverso il backend di Warp in transito. Per attività da terminale usa DeepSeek V4 Flash, per compiti minori MiniMax M2.7 e per logica complessa GLM-5.3 Flash.

Vuoi saperne di più?

Esplora altre sezioni o inizia a guadagnare GNK subito.

Ottieni chiave e token gratuiti →