Secciones de la base de conocimientos ▾

Tecnologías

Elección de GPU para Gonka: recomendaciones de hardware

La pregunta principal del minero técnico: ¿qué GPU se necesita para Gonka? Analizaremos los requisitos mínimos, las configuraciones óptimas y dónde alquilar servidores si no tiene su propio hardware.

Requisitos mínimos

Gonka requiere GPU NVIDIA con soporte de CUDA y no menos de 320 GB de VRAM en total por cada contenedor MLNode; se pueden combinar tarjetas si el nodo aloja los modelos de la red y pasa el PoC. Esta es una limitación de hardware estricta: los modelos de la red — MiniMax M2.7, DeepSeek V4 Flash y GLM-5.3 Flash — con arquitectura MoE requieren un volumen importante de memoria de vídeo para cargar los pesos y ejecutar la inferencia. Las GPU AMD e Intel no son compatibles — Gonka usa el stack CUDA de NVIDIA, incluido cuBLAS para operaciones matriciales y cuDNN para las capas neuronales.

Lista completa de requisitos:

  • GPU: NVIDIA con CUDA, generación posterior a Tesla, desde 320 GB de VRAM en total por ML-nodo. En la lista oficial están B300, B200, RTX PRO 6000, H200, H100 y A100 80GB. Las RTX 4090 y RTX 3090 de gaming (24GB cada una) no sirven: ese volumen se reúne con tarjetas de servidor
  • CPU: es obligatorio el soporte de instrucciones AVX — sin ellas inferenced no arranca (SIGILL al inicio)
  • RAM: se recomiendan 64GB+ de memoria operativa para un funcionamiento cómodo, la carga de pesos y la gestión de colas de peticiones
  • Disco: NVMe SSD con espacio suficiente — el conjunto completo de pesos de un modelo MoE grande ocupa cientos de gigabytes, y una carga rápida desde NVMe es crítica para el tiempo de arranque en frío del nodo
  • Internet: mínimo 100 Mbit/s de conexión estable — el nodo recibe peticiones de los Transfer Agents y envía resultados a los clientes en tiempo real
  • Uptime: 24/7 — saltarse épocas reduce la recompensa, y un downtime prolongado puede provocar la exclusión del pool de tareas

Tarjetas recomendadas

Analicemos en detalle cada tarjeta recomendada:

NVIDIA H100 80GB: el buque insignia de la generación actual y la opción óptima para Gonka. TDP (potencia térmica de diseño) de 700 W, precio de ~$25—35K por tarjeta. Admite inference en FP8, lo que acelera el procesamiento de solicitudes sin perder calidad. NVLink permite unir varias H100 en un solo nodo con conexión de alta velocidad entre tarjetas. El modelo más pesado de la red —GLM-5.3 Flash, con sus ~560 GB de VRAM por réplica— necesita ocho H100 de 80GB; esta es la configuración de referencia de hosts para ese modelo.

NVIDIA H200 141GB: la siguiente generación, con casi el doble de memoria. El mayor VRAM permite procesar más solicitudes a la vez (mayor batch size), lo que aumenta los ingresos en GNK por unidad de tiempo. El ancho de banda de memoria HBM3e es superior al de la H100: carga de pesos más rápida, inference más rápido. Para el mismo modelo alcanza con menos tarjetas H200 que H100, lo que simplifica la infraestructura.

NVIDIA A100 80GB: generación anterior, pero sigue en la lista oficial de la red. Precio de ~$10—15K por tarjeta: considerablemente más barata que la H100. Rendimiento inferior: no tiene FP8, HBM2e más lenta. Por cada ML-nodo se necesitan al menos cuatro de estas tarjetas (4 × 80 = 320 GB); la versión A100 40GB no está en la lista oficial. La A100 sirve para entrar a la red con una inversión inicial menor.

Lo que no sirve: las tarjetas de consumo RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB): no tienen suficiente VRAM para trabajar con los modelos de la red. El umbral de la red es de 320 GB de memoria de video por ML-nodo, y se arma con tarjetas de servidor. Una sola instancia de un modelo MoE grande son varias tarjetas H100, H200 o A100 80GB en un mismo nodo; el número exacto depende del modelo y la configuración.

Configuración de nodo

Un MLNode en la red Gonka es un servidor con GPU que ejecuta inferencia de IA. Configurar un nodo implica varias etapas, y cada una es crítica para el funcionamiento estable y para maximizar las ganancias de GNK.

Software: el componente principal es inferenced CLI, que se encarga de cargar el modelo, procesar las solicitudes y comunicarse con la blockchain. Inferenced funciona dentro de un contenedor Docker, lo que simplifica el despliegue y las actualizaciones. Para configurar por completo un modelo MoE grande de la red hacen falta cientos de gigabytes de VRAM en total; por ejemplo, ocho tarjetas H100 de 80GB para GLM-5.3 Flash (unos 560 GB por réplica). Los pesos del modelo (cientos de gigabytes) se cargan desde un NVMe SSD al iniciar el nodo.

Registro: tras la instalación, el nodo se registra on-chain: crea un registro en la blockchain de Gonka indicando su dirección, los modelos que admite y sus características (VRAM, ancho de banda, ubicación). A partir de ese momento, los Transfer Agents empiezan a dirigir al nodo las solicitudes de IA de los usuarios.

Operación en la red: cada solicitud entrante (un prompt del usuario) se procesa en la GPU a través de la red neuronal. El resultado se devuelve al cliente a través del Transfer Agent. El consenso Sprint tiene en cuenta cada cómputo realizado al formar el bloque, y la recompensa se reparte en proporción al volumen de trabajo. El nodo puede publicar sus características actualizadas en tiempo real; si la carga aumenta, los Transfer Agents redirigirán parte de las solicitudes a nodos menos cargados. Encontrarás una guía detallada de configuración en la guía de minería.

Dónde alquilar GPU

Si no tienes tu propio equipo, hay tres formas de acceder a una GPU para Gonka, cada una con un equilibrio diferente de coste, complejidad y control:

RutaCostoComplejidadControl
Pooldesde $1MínimaBajo
Servidor dedicadodesde $12,000/mesBajaMedio
Alquiler bare-metaldesde $2-3/hora GPUAltaCompleto

Pools (desde $1 — Ancapex, desde $100 — Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) — los operadores alquilan GPU, configuran nodos, monitorizan el tiempo de actividad. Recibes GNK proporcionalmente a tu contribución, sin tocar los detalles técnicos. La ruta ideal para principiantes e inversores pasivos.

Servidores dedicados (desde $12,000/mes): Gonka.Top ofrece no solo pools, sino también servidores dedicados con servicio completo. Recibes un nodo listo: el operador se encarga de la configuración de inferenced, la monitorización 24/7, las actualizaciones y la resolución de problemas. La minería se realiza directamente en tu billetera: todos los ingresos en GNK son tuyos, después de deducir el alquiler fijo.

Alquiler bare-metal: Spheron proporciona servidores bare-metal con H100/H200 que configuras tú mismo (los usuarios de la Federación Rusa pueden experimentar dificultades con el pago a Spheron a través del procesador de pagos). Esta es la ruta para usuarios técnicos familiarizados con Linux, Docker y CLI. Máximo control, pero también máxima responsabilidad por la configuración, el tiempo de actividad y las actualizaciones. Una comparación detallada de todos los proveedores se encuentra en la página «Obtener GNK».

Para Gonka se necesita un ML-nodo NVIDIA (CUDA) con no menos de 320 GB de memoria de video. Tarjetas óptimas: H100, H200, A100 80GB. El clúster completo para un modelo MoE grande son cientos de gigabytes de VRAM (unos 560 GB en GLM-5.3 Flash). ¿No tienes hardware propio? Alquila en Gonka.Top o Spheron, o empieza con un pool.

¿Quieres saber más?

Explora otras secciones o empieza a ganar GNK ahora mismo.

Comparar proveedores y alquilar →