Розділи бази знань ▾
Навігація
▸ Почніть тут За ролямиКатегорії
- Архітектура мережі Gonka: Sprint, Transfer Agents, DiLoCo
- Розробникам: як заробити GNK
- Власний хостинг: покроковий посібник
- Вибір GPU для Gonka: рекомендації щодо обладнання
- Qwen3-235B: модель, яку раніше обслуговувала Gonka
- Kimi K2.6: модель, яку раніше обслуговувала Gonka
- MiniMax M2.7: модель мережі Gonka
- DeepSeek V4 Flash: модель мережі Gonka з контекстом 380K
- GLM-5.3 Flash: reasoning-модель Z.ai у мережі Gonka
Технології
Вибір GPU для Gonka: рекомендації щодо обладнання
Мінімальні вимоги
Gonka вимагає NVIDIA GPU з підтримкою CUDA і щонайменше 320 ГБ VRAM сумарно на кожен контейнер MLNode; карти можна поєднувати, якщо нода вміщає моделі мережі та проходить PoC. Це жорстке апаратне обмеження: моделі мережі — MiniMax M2.7, DeepSeek V4 Flash і GLM-5.3 Flash — з архітектурою MoE потребують значного обсягу відеопам'яті для завантаження ваг і виконання inference. AMD та Intel GPU не підтримуються — Gonka використовує CUDA-стек NVIDIA, включно з cuBLAS для матричних операцій і cuDNN для нейромережевих шарів.
Повний список вимог:
- GPU: NVIDIA з CUDA, покоління новіше за Tesla, від 320 ГБ VRAM сумарно на ML-ноду. В офіційному списку — B300, B200, RTX PRO 6000, H200, H100 і A100 80GB. Ігрові RTX 4090 та RTX 3090 (по 24GB) не підходять: такий обсяг збирають із серверних карт
- CPU: обов'язкова підтримка інструкцій AVX — без них inferenced не запуститься (SIGILL під час старту)
- RAM: рекомендується 64GB+ оперативної пам'яті для комфортної роботи, завантаження ваг і обслуговування черг запитів
- Диск: NVMe SSD з достатнім простором — повний набір ваг великої MoE-моделі займає сотні гігабайт, і швидке завантаження з NVMe критичне для часу холодного старту ноди
- Інтернет: мінімум 100 Мбіт/с стабільного зв'язку — нода отримує запити від Transfer Agents і надсилає результати клієнтам у реальному часі
- Аптайм: 24/7 — пропуск епох знижує винагороду, а тривалий даунтайм може призвести до виключення з пулу завдань
Рекомендовані картки
Розберемо кожну рекомендовану карту докладно:
NVIDIA H100 80GB — флагман поточного покоління й оптимальний вибір для Gonka. TDP (тепловий пакет) 700 Вт, вартість ~$25—35K за карту. Підтримує FP8 inference, що прискорює обробку запитів без втрати якості. NVLink дозволяє об'єднати кілька H100 в одну ноду з високошвидкісним зв'язком між картами. Найважчій моделі мережі — GLM-5.3 Flash з її ~560 ГБ VRAM на репліку — потрібно вісім H100 по 80GB; це еталонна конфігурація хостів під цю модель.
NVIDIA H200 141GB — наступне покоління з майже вдвічі більшим обсягом пам'яті. Збільшений VRAM дозволяє обробляти більше запитів одночасно (більший batch size), що підвищує дохід у GNK за одиницю часу. Пропускна здатність пам'яті HBM3e вища, ніж у H100 — швидше завантаження ваг, швидший inference. Під ту саму модель вистачає меншої кількості карт H200, ніж H100, що спрощує інфраструктуру.
NVIDIA A100 80GB — попереднє покоління, але все ще в офіційному списку мережі. Ціна ~$10—15K за карту — суттєво дешевше за H100. Продуктивність нижча: немає FP8, повільніша HBM2e. На одну ML-ноду потрібно не менше чотирьох таких карт (4 × 80 = 320 ГБ); версії A100 40GB в офіційному списку немає. A100 підходить для входу в мережу з меншими початковими інвестиціями.
Що не підходить: споживчі карти RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB) — недостатньо VRAM для роботи з моделями мережі. Поріг мережі — 320 ГБ відеопам'яті на ML-ноду, і збирають його із серверних карт. Один екземпляр великої MoE-моделі — це кілька карт H100, H200 або A100 80GB в одній ноді; точна кількість залежить від моделі та конфігурації.
Конфігурація ноди
MLNode у мережі Gonka — це сервер із GPU, який виконує AI inference. Налаштування ноди включає кілька етапів, кожен з яких критичний для стабільної роботи та максимального заробітку GNK.
Програмне забезпечення: основний компонент — inferenced CLI, який керує завантаженням моделі, обробкою запитів і зв'язком із блокчейном. Inferenced працює всередині Docker-контейнера, що спрощує розгортання й оновлення. Для повної конфігурації під велику MoE-модель мережі потрібні сотні гігабайт сумарного VRAM — наприклад, вісім карт H100 по 80GB під GLM-5.3 Flash (близько 560 ГБ на репліку). Ваги моделі (сотні гігабайт) завантажуються з NVMe SSD під час старту ноди.
Реєстрація: після встановлення нода реєструється on-chain — створює запис у блокчейні Gonka із зазначенням своєї адреси, підтримуваних моделей і характеристик (VRAM, пропускна здатність, місцезнаходження). Із цього моменту Transfer Agents починають спрямовувати на ноду AI-запити від користувачів.
Робота в мережі: кожен вхідний запит — промпт від користувача — обробляється GPU через нейромережу. Результат надсилається назад через Transfer Agent клієнту. Консенсус Sprint враховує кожне виконане обчислення під час формування блоку, і нагорода розподіляється пропорційно до обсягу роботи. Нода може публікувати оновлені характеристики в реальному часі — якщо навантаження зростає, Transfer Agents перенаправлять частину запитів на менш завантажені ноди. Детальна інструкція з налаштування — у гайді з майнінгу.
Де орендувати GPU
Якщо власного обладнання немає — є три шляхи отримати доступ до GPU для Gonka, кожен з різним балансом вартості, складності та контролю:
| Шлях | Вартість | Складність | Контроль |
|---|---|---|---|
| Пул | від $1 | Мінімальна | Низький |
| Виділений сервер | від $12,000/міс | Низька | Середній |
| Bare-metal оренда | від $2—3/год GPU | Висока | Повний |
Пули (від $1 — Ancapex, від $100 — Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) — оператори орендують GPU, налаштовують ноди, стежать за аптаймом. Ви отримуєте GNK пропорційно внеску, не торкаючись технічних деталей. Ідеальний шлях для новачків та пасивних інвесторів.
Виділені сервери (від $12,000/міс): Gonka.Top пропонує не тільки пули, але й виділені сервери з повним обслуговуванням. Ви отримуєте готову ноду — оператор займається налаштуванням inferenced, моніторингом 24/7, оновленнями та усуненням неполадок. Майнінг йде безпосередньо на ваш гаманець — весь дохід у GNK ваш, за вирахуванням фіксованої орендної плати.
Bare-metal оренда: Spheron надає bare-metal сервери з H100/H200, які ви налаштовуєте самостійно (у користувачів з РФ можливі складності з оплатою Spheron через платіжний процесор). Це шлях для технічних користувачів, знайомих з Linux, Docker та CLI. Максимальний контроль, але й максимальна відповідальність за налаштування, аптайм та оновлення. Детальне порівняння всіх провайдерів — на сторінці «Отримати GNK».
Бажаєте дізнатися більше?
Вивчіть інші розділи або почніть заробляти GNK прямо зараз.
Порівняти провайдерів та орендувати →