Разделы базы знаний ▾
Навигация
▸ Начните здесь По ролямКатегории
- Архитектура сети Gonka: Sprint, Transfer Agents, DiLoCo
- Разработчикам: как заработать GNK
- Свой хост: пошаговый гайд
- Выбор GPU для Gonka: рекомендации по железу
- Qwen3-235B: модель, которую ранее обслуживала Gonka
- Kimi K2.6: модель, которую ранее обслуживала Gonka
- MiniMax M2.7: модель сети Gonka
- DeepSeek V4 Flash: модель сети Gonka с контекстом 380K
- GLM-5.3 Flash: reasoning-модель Z.ai в сети Gonka
Технологии
Выбор GPU для Gonka: рекомендации по железу
Минимальные требования
Gonka требует NVIDIA GPU с поддержкой CUDA и не меньше 320 ГБ VRAM суммарно на каждый контейнер MLNode; карты можно сочетать, если нода вмещает модели сети и проходит PoC. Это жёсткое аппаратное ограничение: модели сети — MiniMax M2.7, DeepSeek V4 Flash и GLM-5.3 Flash — с архитектурой MoE требуют значительного объёма видеопамяти для загрузки весов и выполнения inference. AMD и Intel GPU не поддерживаются — Gonka использует CUDA-стек NVIDIA, включая cuBLAS для матричных операций и cuDNN для нейросетевых слоёв.
Полный список требований:
- GPU: NVIDIA с CUDA, поколение новее Tesla, от 320 ГБ VRAM суммарно на ML-ноду. В официальном списке — B300, B200, RTX PRO 6000, H200, H100 и A100 80GB. Игровые RTX 4090 и RTX 3090 (по 24GB) не подходят: такой объём собирают из серверных карт
- CPU: обязательна поддержка инструкций AVX — без них inferenced не запустится (SIGILL при старте)
- RAM: рекомендуется 64GB+ оперативной памяти для комфортной работы, загрузки весов и обслуживания очередей запросов
- Диск: NVMe SSD с достаточным пространством — полный набор весов крупной MoE-модели занимает сотни гигабайт, и быстрая загрузка с NVMe критична для времени холодного старта ноды
- Интернет: минимум 100 Мбит/с стабильной связи — нода получает запросы от Transfer Agents и отправляет результаты клиентам в реальном времени
- Аптайм: 24/7 — пропуск эпох снижает вознаграждение, а длительный даунтайм может привести к исключению из пула задач
Рекомендуемые карты
Разберём каждую рекомендуемую карту подробно:
NVIDIA H100 80GB — флагман текущего поколения и оптимальный выбор для Gonka. TDP (тепловой пакет) 700 Вт, стоимость ~$25—35K за карту. Поддерживает FP8 inference, что ускоряет обработку запросов без потери качества. NVLink позволяет объединить несколько H100 в одну ноду с высокоскоростной связью между картами. Самой тяжёлой модели сети — GLM-5.3 Flash с её ~560 ГБ VRAM на реплику — нужно восемь H100 по 80GB; это эталонная конфигурация хостов под эту модель.
NVIDIA H200 141GB — следующее поколение с почти вдвое большим объёмом памяти. Увеличенный VRAM позволяет обрабатывать больше запросов одновременно (больший batch size), что повышает доход в GNK за единицу времени. Пропускная способность памяти HBM3e выше, чем у H100 — быстрее загрузка весов, быстрее inference. Под ту же модель хватает меньшего числа карт H200, чем H100, что упрощает инфраструктуру.
NVIDIA A100 80GB — предыдущее поколение, но всё ещё в официальном списке сети. Цена ~$10—15K за карту — существенно дешевле H100. Производительность ниже: нет FP8, медленнее HBM2e. На одну ML-ноду нужно не меньше четырёх таких карт (4 × 80 = 320 ГБ); версии A100 40GB в официальном списке нет. A100 подходит для входа в сеть с меньшими начальными инвестициями.
Что не подходит: потребительские карты RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB) — недостаточно VRAM для работы с моделями сети. Порог сети — 320 ГБ видеопамяти на ML-ноду, и собирают его из серверных карт. Один экземпляр крупной MoE-модели — это несколько карт H100, H200 или A100 80GB в одной ноде; точное число зависит от модели и конфигурации.
Конфигурация ноды
MLNode в сети Gonka — это сервер с GPU, который выполняет AI inference. Настройка ноды включает несколько этапов, каждый из которых критичен для стабильной работы и максимального заработка GNK.
Программное обеспечение: основной компонент — inferenced CLI, который управляет загрузкой модели, обработкой запросов и связью с блокчейном. Inferenced работает внутри Docker-контейнера, что упрощает развёртывание и обновление. Для полной конфигурации под крупную MoE-модель сети нужны сотни гигабайт суммарного VRAM — например, восемь карт H100 по 80GB под GLM-5.3 Flash (около 560 ГБ на реплику). Веса модели (сотни гигабайт) загружаются с NVMe SSD при старте ноды.
Регистрация: после установки нода регистрируется on-chain — создаёт запись в блокчейне Gonka с указанием своего адреса, поддерживаемых моделей и характеристик (VRAM, пропускная способность, местоположение). С этого момента Transfer Agents начинают направлять на ноду AI-запросы от пользователей.
Работа в сети: каждый входящий запрос — промпт от пользователя — обрабатывается GPU через нейросеть. Результат отправляется обратно через Transfer Agent клиенту. Консенсус Sprint учитывает каждое выполненное вычисление при формировании блока, и награда распределяется пропорционально объёму работы. Нода может публиковать обновлённые характеристики в реальном времени — если загрузка растёт, Transfer Agents перенаправят часть запросов на менее загруженные ноды. Подробная инструкция по настройке — в гайде по майнингу.
Где арендовать GPU
Если своего оборудования нет — есть три пути получить доступ к GPU для Gonka, каждый с разным балансом стоимости, сложности и контроля:
| Путь | Стоимость | Сложность | Контроль |
|---|---|---|---|
| Пул | от $1 | Минимальная | Низкий |
| Выделенный сервер | от $12,000/мес | Низкая | Средний |
| Bare-metal аренда | от $2—3/час GPU | Высокая | Полный |
Пулы (от $1 — Ancapex, от $100 — Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) — операторы арендуют GPU, настраивают ноды, следят за аптаймом. Вы получаете GNK пропорционально вкладу, не касаясь технических деталей. Идеальный путь для новичков и пассивных инвесторов.
Выделенные серверы (от $12,000/мес): Gonka.Top предлагает не только пулы, но и выделенные серверы с полным обслуживанием. Вы получаете готовую ноду — оператор занимается настройкой inferenced, мониторингом 24/7, обновлениями и устранением неполадок. Майнинг идёт напрямую на ваш кошелёк — весь доход в GNK ваш, за вычетом фиксированной арендной платы.
Bare-metal аренда: Spheron предоставляет bare-metal серверы с H100/H200, которые вы настраиваете самостоятельно (у пользователей из РФ возможны сложности с оплатой Spheron через платёжный процессор). Это путь для техничных пользователей, знакомых с Linux, Docker и CLI. Максимальный контроль, но и максимальная ответственность за настройку, аптайм и обновления. Подробное сравнение всех провайдеров — на странице «Получить GNK».
Хотите узнать больше?
Изучите другие разделы или начните зарабатывать GNK прямо сейчас.
Сравнить провайдеров и арендовать →