Sezioni dell'archivio conoscenza ▾

Tecnologie

Scelta della GPU per Gonka: raccomandazioni hardware

La domanda principale del miner tecnico: quale GPU è necessaria per Gonka? Analizzeremo i requisiti minimi, le configurazioni ottimali e dove noleggiare i server, se non si possiede il proprio hardware.

Requisiti minimi

Gonka richiede GPU NVIDIA con supporto CUDA e almeno 320 GB di VRAM in totale per ogni container MLNode; le schede si possono combinare se il nodo ospita i modelli della rete e supera il PoC. È un limite hardware rigido: i modelli della rete — MiniMax M2.7, DeepSeek V4 Flash e GLM-5.3 Flash — con architettura MoE richiedono un volume considerevole di memoria video per caricare i pesi ed eseguire l'inference. Le GPU AMD e Intel non sono supportate — Gonka utilizza lo stack CUDA di NVIDIA, inclusi cuBLAS per le operazioni matriciali e cuDNN per i layer neurali.

L'elenco completo dei requisiti:

  • GPU: NVIDIA con CUDA, generazione più recente di Tesla, da 320 GB di VRAM in totale per ML-node. Nell'elenco ufficiale ci sono B300, B200, RTX PRO 6000, H200, H100 e A100 80GB. Le RTX 4090 e RTX 3090 da gaming (24GB ciascuna) non sono adatte: quel volume si ottiene con schede server
  • CPU: è obbligatorio il supporto alle istruzioni AVX — senza di esse inferenced non si avvia (SIGILL all'avvio)
  • RAM: si consigliano 64GB+ di memoria operativa per lavorare comodamente, caricare i pesi e gestire le code di richieste
  • Disco: NVMe SSD con spazio sufficiente — il set completo di pesi di un grande modello MoE occupa centinaia di gigabyte, e un caricamento rapido da NVMe è cruciale per il tempo di cold start del nodo
  • Internet: almeno 100 Mbit/s di connessione stabile — il nodo riceve richieste dai Transfer Agents e invia i risultati ai client in tempo reale
  • Uptime: 24/7 — saltare le epoche riduce la ricompensa, e un lungo downtime può portare all'esclusione dal pool di attività

Schede consigliate

Analizziamo in dettaglio ogni scheda consigliata:

NVIDIA H100 80GB — il flagship della generazione attuale e la scelta ottimale per Gonka. TDP (thermal design power) 700 W, prezzo ~$25—35K per scheda. Supporta FP8 inference, che velocizza l'elaborazione delle richieste senza perdita di qualità. NVLink permette di unire più H100 in un unico nodo con una connessione ad alta velocità tra le schede. Il modello più pesante della rete — GLM-5.3 Flash con i suoi ~560 GB di VRAM per replica — richiede otto H100 da 80GB; questa è la configurazione di riferimento degli host per questo modello.

NVIDIA H200 141GB — la generazione successiva con una capacità di memoria quasi doppia. La VRAM maggiore permette di elaborare più richieste contemporaneamente (batch size più grande), il che aumenta il reddito in GNK per unità di tempo. La larghezza di banda della memoria HBM3e è superiore a quella dell'H100 — caricamento dei pesi più rapido, inferenza più rapida. Per lo stesso modello bastano meno schede H200 rispetto alle H100, il che semplifica l'infrastruttura.

NVIDIA A100 80GB — la generazione precedente, ma ancora nella lista ufficiale della rete. Prezzo ~$10—15K per scheda — nettamente più economica dell'H100. Prestazioni inferiori: niente FP8, HBM2e più lenta. Per un singolo ML node servono almeno quattro di queste schede (4 × 80 = 320 GB); la versione A100 40GB non è nella lista ufficiale. L'A100 è adatta per entrare nella rete con un investimento iniziale minore.

Cosa non è adatto: le schede consumer RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB) — VRAM insufficiente per lavorare con i modelli della rete. La soglia della rete è 320 GB di memoria video per ML node, e si raggiunge con schede server. Una singola istanza di un grande modello MoE corrisponde a più schede H100, H200 o A100 80GB in un unico nodo; il numero esatto dipende dal modello e dalla configurazione.

Configurazione del nodo

MLNode nella rete Gonka è un server con GPU che esegue AI inference. La configurazione del nodo prevede diverse fasi, ognuna cruciale per un funzionamento stabile e per massimizzare i guadagni in GNK.

Software: il componente principale è inferenced CLI, che gestisce il caricamento del modello, l'elaborazione delle richieste e la comunicazione con la blockchain. Inferenced funziona all'interno di un container Docker, il che semplifica il deployment e gli aggiornamenti. Per una configurazione completa dedicata a un grande modello MoE della rete servono centinaia di gigabyte di VRAM totale — ad esempio, otto schede H100 da 80GB per GLM-5.3 Flash (circa 560 GB per replica). I pesi del modello (centinaia di gigabyte) vengono caricati da NVMe SSD all'avvio del nodo.

Registrazione: dopo l'installazione il nodo si registra on-chain — crea un record nella blockchain Gonka indicando il proprio indirizzo, i modelli supportati e le caratteristiche (VRAM, larghezza di banda, posizione). Da quel momento i Transfer Agents iniziano a indirizzare al nodo le richieste AI degli utenti.

Operatività in rete: ogni richiesta in entrata — un prompt dell'utente — viene elaborata dalla GPU attraverso la rete neurale. Il risultato viene inviato al client tramite il Transfer Agent. Il consenso Sprint tiene conto di ogni calcolo eseguito nella formazione del blocco, e la ricompensa viene distribuita in proporzione al volume di lavoro. Il nodo può pubblicare caratteristiche aggiornate in tempo reale — se il carico cresce, i Transfer Agents reindirizzano parte delle richieste verso nodi meno carichi. Per le istruzioni dettagliate sulla configurazione, consulta la guida al mining.

Dove noleggiare GPU

Se non si dispone della propria attrezzatura, ci sono tre modi per accedere alle GPU per Gonka, ognuno con un diverso equilibrio tra costo, complessità e controllo:

PercorsoCostoComplessitàControllo
Poolda $1MinimaBasso
Server dedicatoda $12,000/meseBassaMedio
Noleggio Bare-metalda $2–3/ora GPUAltaCompleto

Pool (da $1 – Ancapex, da $100 – Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) – gli operatori noleggiano GPU, configurano i nodi, monitorano l'uptime. Si ricevono GNK proporzionalmente al contributo, senza occuparsi dei dettagli tecnici. Percorso ideale per principianti e investitori passivi.

Server dedicati (da $12,000/mese): Gonka.Top offre non solo pool, ma anche server dedicati con servizio completo. Si riceve un nodo pronto – l'operatore si occupa della configurazione inferenced, del monitoraggio 24/7, degli aggiornamenti e della risoluzione dei problemi. Il mining avviene direttamente sul proprio wallet – tutto il reddito in GNK è proprio, al netto del canone di locazione fisso.

Noleggio Bare-metal: Spheron fornisce server bare-metal con H100/H200, che si configurano autonomamente (gli utenti russi potrebbero avere difficoltà con il pagamento a Spheron tramite il processore di pagamento). Questo è il percorso per utenti esperti, che conoscono Linux, Docker e CLI. Massima controllo, ma anche massima responsabilità per la configurazione, l'uptime e gli aggiornamenti. Un confronto dettagliato di tutti i fornitori è disponibile sulla pagina “Ottieni GNK”.

Per Gonka serve un ML node NVIDIA (CUDA) con almeno 320 GB di memoria video. Le schede ottimali: H100, H200, A100 80GB. Un cluster completo per un grande modello MoE richiede centinaia di gigabyte di VRAM (circa 560 GB per GLM-5.3 Flash). Se non hai hardware tuo, affittalo da Gonka.Top o Spheron, oppure inizia da un pool.

Vuoi saperne di più?

Esplora altre sezioni o inizia a guadagnare GNK subito.

Confronta i fornitori e noleggia →