Seções da Base de Conhecimento ▾

Tecnologias

Escolha da GPU para Gonka: recomendações de hardware

A principal pergunta do minerador técnico: qual GPU é necessária para Gonka? Analisaremos os requisitos mínimos, as configurações ideais e onde alugar servidores se você não tiver seu próprio hardware.

Requisitos mínimos

A Gonka exige GPU NVIDIA com suporte a CUDA e não menos de 320 GB de VRAM no total por cada contêiner MLNode; as placas podem ser combinadas se o nó comportar os modelos da rede e passar no PoC. Essa é uma limitação de hardware rígida: os modelos da rede — MiniMax M2.7, DeepSeek V4 Flash e GLM-5.3 Flash — com arquitetura MoE exigem um volume significativo de memória de vídeo para carregar os pesos e executar a inferência. GPUs AMD e Intel não são suportadas — a Gonka usa o stack CUDA da NVIDIA, incluindo cuBLAS para operações matriciais e cuDNN para as camadas neurais.

Lista completa de requisitos:

  • GPU: NVIDIA com CUDA, geração mais nova que Tesla, a partir de 320 GB de VRAM no total por ML-nó. Na lista oficial estão B300, B200, RTX PRO 6000, H200, H100 e A100 80GB. As RTX 4090 e RTX 3090 de jogos (24GB cada) não servem: esse volume é reunido com placas de servidor
  • CPU: é obrigatório o suporte a instruções AVX — sem elas o inferenced não inicia (SIGILL na partida)
  • RAM: recomenda-se 64GB+ de memória RAM para um funcionamento confortável, carregamento de pesos e gerenciamento de filas de requisições
  • Disco: NVMe SSD com espaço suficiente — o conjunto completo de pesos de um modelo MoE grande ocupa centenas de gigabytes, e o carregamento rápido via NVMe é crítico para o tempo de inicialização a frio do nó
  • Internet: no mínimo 100 Mbit/s de conexão estável — o nó recebe requisições dos Transfer Agents e envia resultados aos clientes em tempo real
  • Uptime: 24/7 — pular épocas reduz a recompensa, e um downtime prolongado pode levar à exclusão do pool de tarefas

Placas recomendadas

Vamos analisar em detalhes cada placa recomendada:

NVIDIA H100 80GB — o carro-chefe da geração atual e a escolha ideal para a Gonka. TDP (potência térmica de projeto) de 700 W, preço de ~$25—35K por placa. Suporta inference em FP8, o que acelera o processamento de requisições sem perder qualidade. O NVLink permite unir várias H100 em um único nó com conexão de alta velocidade entre as placas. O modelo mais pesado da rede — o GLM-5.3 Flash, com seus ~560 GB de VRAM por réplica — precisa de oito H100 de 80GB; essa é a configuração de referência de hosts para esse modelo.

NVIDIA H200 141GB — a próxima geração, com quase o dobro de memória. O VRAM maior permite processar mais requisições ao mesmo tempo (batch size maior), o que aumenta a receita em GNK por unidade de tempo. A largura de banda da memória HBM3e é maior que a da H100 — carregamento de pesos mais rápido, inference mais rápido. Para o mesmo modelo, bastam menos placas H200 do que H100, o que simplifica a infraestrutura.

NVIDIA A100 80GB — geração anterior, mas ainda na lista oficial da rede. Preço de ~$10—15K por placa — bem mais barata que a H100. Desempenho inferior: não tem FP8, HBM2e mais lenta. Por ML-nó são necessárias no mínimo quatro dessas placas (4 × 80 = 320 GB); a versão A100 40GB não está na lista oficial. A A100 serve para entrar na rede com um investimento inicial menor.

O que não serve: placas de consumo RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB) — VRAM insuficiente para trabalhar com os modelos da rede. O limite da rede é de 320 GB de memória de vídeo por ML-nó, montados com placas de servidor. Uma única instância de um modelo MoE grande são várias placas H100, H200 ou A100 80GB em um mesmo nó; o número exato depende do modelo e da configuração.

Configuração do nó

Um MLNode na rede Gonka é um servidor com GPU que executa inferência de IA. A configuração do nó envolve várias etapas, e cada uma delas é crítica para o funcionamento estável e para o ganho máximo de GNK.

Software: o componente principal é o inferenced CLI, que cuida do carregamento do modelo, do processamento das requisições e da comunicação com a blockchain. O inferenced roda dentro de um contêiner Docker, o que simplifica o deploy e as atualizações. Para a configuração completa de um modelo MoE grande da rede são necessárias centenas de gigabytes de VRAM no total — por exemplo, oito placas H100 de 80GB para o GLM-5.3 Flash (cerca de 560 GB por réplica). Os pesos do modelo (centenas de gigabytes) são carregados de um NVMe SSD na inicialização do nó.

Registro: após a instalação, o nó se registra on-chain — cria um registro na blockchain Gonka informando seu endereço, os modelos suportados e as características (VRAM, largura de banda, localização). A partir desse momento, os Transfer Agents começam a direcionar ao nó as requisições de IA dos usuários.

Operação na rede: cada requisição recebida — um prompt do usuário — é processada pela GPU por meio da rede neural. O resultado é enviado de volta ao cliente pelo Transfer Agent. O consenso Sprint considera cada computação realizada na formação do bloco, e a recompensa é distribuída proporcionalmente ao volume de trabalho. O nó pode publicar características atualizadas em tempo real — se a carga aumentar, os Transfer Agents redirecionam parte das requisições para nós menos carregados. O guia detalhado de configuração está no guia de mineração.

Onde alugar GPU

Se você não tem seu próprio equipamento, há três maneiras de acessar uma GPU para Gonka, cada uma com um equilíbrio diferente de custo, complexidade e controle:

CaminhoCustoComplexidadeControle
Poola partir de $1MínimaBaixo
Servidor dedicadoa partir de $12.000/mêsBaixaMédio
Aluguel bare-metala partir de $2-3/hora GPUAltaCompleto

Pools (a partir de $1 — Ancapex, a partir de $100 — Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) — os operadores alugam GPUs, configuram nós, monitoram o tempo de atividade. Você recebe GNK proporcionalmente à sua contribuição, sem se preocupar com os detalhes técnicos. O caminho ideal para iniciantes e investidores passivos.

Servidores dedicados (a partir de US$ 12.000/mês): Gonka.Top oferece não apenas pools, mas também servidores dedicados com serviço completo. Você recebe um nó pronto — o operador cuida da configuração do inferenced, monitoramento 24 horas por dia, 7 dias por semana, atualizações e solução de problemas. A mineração vai diretamente para sua carteira — toda a receita em GNK é sua, descontado o aluguel fixo.

Aluguel bare-metal: Spheron fornece servidores bare-metal com H100/H200 que você configura por conta própria (usuários da Federação Russa podem ter dificuldades com pagamentos Spheron via processador de pagamento). Este é o caminho para usuários técnicos familiarizados com Linux, Docker e CLI. Controle máximo, mas também responsabilidade máxima pela configuração, tempo de atividade e atualizações. Uma comparação detalhada de todos os provedores está na página “Obter GNK”.

Para a Gonka é preciso um ML-nó NVIDIA (CUDA) com no mínimo 320 GB de memória de vídeo. Placas ideais: H100, H200, A100 80GB. O cluster completo para um modelo MoE grande são centenas de gigabytes de VRAM (cerca de 560 GB no GLM-5.3 Flash). Não tem hardware próprio? Alugue na Gonka.Top ou na Spheron, ou comece com um pool.

Quer saber mais?

Explore outras seções ou comece a ganhar GNK agora mesmo.

Comparar provedores e alugar →