Bagian Basis Pengetahuan ▾

Teknologi

Memilih GPU untuk Gonka: Rekomendasi Perangkat Keras

Pertanyaan utama penambang teknis: GPU apa yang dibutuhkan untuk Gonka? Mari kita bahas persyaratan minimum, konfigurasi optimal, dan di mana menyewa server jika Anda tidak memiliki perangkat keras sendiri.

Persyaratan Minimum

Gonka memerlukan GPU NVIDIA dengan dukungan CUDA dan minimal 320 GB VRAM total per kontainer MLNode; kartu dapat dikombinasikan jika node mampu menampung model jaringan dan lulus PoC. Ini batasan perangkat keras yang ketat: model jaringan — MiniMax M2.7, DeepSeek V4 Flash, dan GLM-5.3 Flash — dengan arsitektur MoE memerlukan volume memori video yang signifikan untuk memuat bobot dan menjalankan inference. GPU AMD dan Intel tidak didukung — Gonka menggunakan stack CUDA NVIDIA, termasuk cuBLAS untuk operasi matriks dan cuDNN untuk lapisan jaringan saraf.

Daftar lengkap persyaratan:

  • GPU: NVIDIA dengan CUDA, generasi lebih baru dari Tesla, minimal 320 GB VRAM total per ML-node. Dalam daftar resmi — B300, B200, RTX PRO 6000, H200, H100, dan A100 80GB. RTX 4090 dan RTX 3090 (masing-masing 24GB) tidak cocok: volume seperti itu dirakit dari kartu server
  • CPU: wajib mendukung instruksi AVX — tanpa itu inferenced tidak akan berjalan (SIGILL saat start)
  • RAM: disarankan 64GB+ memori operasional untuk pekerjaan yang nyaman, memuat bobot, dan menangani antrean permintaan
  • Disk: NVMe SSD dengan ruang yang cukup — set lengkap bobot model MoE besar memakan ratusan gigabyte, dan pemuatan cepat dari NVMe sangat penting untuk waktu cold start node
  • Internet: minimal 100 Mbps koneksi stabil — node menerima permintaan dari Transfer Agents dan mengirim hasil ke klien secara real-time
  • Uptime: 24/7 — melewatkan epoch menurunkan hadiah, dan downtime berkepanjangan dapat menyebabkan pengeluaran dari pool tugas

Kartu yang Direkomendasikan

Mari kita bahas setiap kartu yang direkomendasikan secara mendetail:

NVIDIA H100 80GB — andalan generasi saat ini dan pilihan optimal untuk Gonka. TDP (daya termal) 700 W, harga ~$25—35K per kartu. Mendukung inference FP8, yang mempercepat pemrosesan permintaan tanpa menurunkan kualitas. NVLink memungkinkan penggabungan beberapa H100 ke dalam satu node dengan koneksi berkecepatan tinggi antar kartu. Model terberat di jaringan — GLM-5.3 Flash dengan ~560 GB VRAM per replika — membutuhkan delapan H100 80GB; inilah konfigurasi host referensi untuk model ini.

NVIDIA H200 141GB — generasi berikutnya dengan kapasitas memori hampir dua kali lipat. VRAM yang lebih besar memungkinkan pemrosesan lebih banyak permintaan sekaligus (batch size lebih besar), yang meningkatkan pendapatan dalam GNK per satuan waktu. Bandwidth memori HBM3e lebih tinggi daripada H100 — pemuatan bobot lebih cepat, inference lebih cepat. Untuk model yang sama, dibutuhkan lebih sedikit kartu H200 dibandingkan H100, sehingga menyederhanakan infrastruktur.

NVIDIA A100 80GB — generasi sebelumnya, tetapi masih ada dalam daftar resmi jaringan. Harga ~$10—15K per kartu — jauh lebih murah daripada H100. Performa lebih rendah: tidak ada FP8, HBM2e lebih lambat. Untuk satu node ML dibutuhkan minimal empat kartu ini (4 × 80 = 320 GB); versi A100 40GB tidak ada dalam daftar resmi. A100 cocok untuk masuk ke jaringan dengan investasi awal yang lebih kecil.

Yang tidak cocok: kartu konsumen RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB) — VRAM tidak cukup untuk bekerja dengan model jaringan. Ambang batas jaringan adalah 320 GB memori video per node ML, dan itu dirakit dari kartu server. Satu instans model MoE besar berarti beberapa kartu H100, H200, atau A100 80GB dalam satu node; jumlah pastinya bergantung pada model dan konfigurasi.

Konfigurasi Node

MLNode di jaringan Gonka adalah server dengan GPU yang menjalankan AI inference. Menyiapkan node mencakup beberapa tahap, masing-masing krusial untuk operasi yang stabil dan penghasilan GNK yang maksimal.

Perangkat lunak: komponen utamanya adalah inferenced CLI, yang mengatur pemuatan model, pemrosesan permintaan, dan komunikasi dengan blockchain. Inferenced berjalan di dalam kontainer Docker, sehingga penyebaran dan pembaruan menjadi mudah. Untuk konfigurasi lengkap bagi model MoE besar di jaringan ini dibutuhkan ratusan gigabyte VRAM total — misalnya, delapan kartu H100 masing-masing 80GB untuk GLM-5.3 Flash (sekitar 560 GB per replika). Bobot model (ratusan gigabyte) dimuat dari NVMe SSD saat node dinyalakan.

Registrasi: setelah instalasi, node didaftarkan on-chain — membuat catatan di blockchain Gonka dengan mencantumkan alamatnya, model yang didukung, dan spesifikasinya (VRAM, bandwidth, lokasi). Sejak saat itu Transfer Agents mulai mengarahkan permintaan AI dari pengguna ke node tersebut.

Bekerja di jaringan: setiap permintaan masuk — prompt dari pengguna — diproses oleh GPU melalui jaringan neural. Hasilnya dikirim kembali melalui Transfer Agent ke klien. Konsensus Sprint memperhitungkan setiap komputasi yang diselesaikan saat membentuk blok, dan hadiah dibagikan secara proporsional dengan volume kerja. Node dapat memublikasikan spesifikasi terbarunya secara real-time — jika beban meningkat, Transfer Agents akan mengalihkan sebagian permintaan ke node yang kurang terbebani. Panduan lengkap penyiapannya ada di panduan mining.

Tempat Menyewa GPU

Jika Anda tidak memiliki peralatan sendiri – ada tiga cara untuk mendapatkan akses ke GPU untuk Gonka, masing-masing dengan keseimbangan biaya, kompleksitas, dan kontrol yang berbeda:

JalurBiayaKompleksitasKontrol
Poolmulai dari $1MinimumRendah
Server khususmulai dari $12.000/bulanRendahSedang
Sewa bare-metalmulai dari $2-3/jam GPUTinggiPenuh

Pool (dari $1 – Ancapex, dari $100 – Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) – operator menyewa GPU, mengatur node, memantau uptime. Anda menerima GNK secara proporsional dengan kontribusi, tanpa menyentuh detail teknis. Jalur ideal untuk pemula dan investor pasif.

Server khusus (mulai dari $12.000/bulan): Gonka.Top menawarkan tidak hanya pool, tetapi juga server khusus dengan layanan penuh. Anda mendapatkan node yang siap pakai – operator menangani pengaturan inferenced, pemantauan 24/7, pembaruan, dan pemecahan masalah. Penambangan langsung ke dompet Anda – semua pendapatan GNK adalah milik Anda, setelah dikurangi biaya sewa tetap.

Sewa bare-metal: Spheron menyediakan server bare-metal dengan H100/H200 yang Anda atur sendiri (pengguna dari Federasi Rusia mungkin mengalami kesulitan pembayaran Spheron melalui prosesor pembayaran). Ini adalah jalur bagi pengguna teknis yang akrab dengan Linux, Docker, dan CLI. Kontrol maksimal, tetapi juga tanggung jawab maksimal untuk pengaturan, uptime, dan pembaruan. Perbandingan rinci semua penyedia ada di halaman «Dapatkan GNK».

Gonka membutuhkan node ML NVIDIA (CUDA) dengan memori video minimal 320 GB. Kartu optimal: H100, H200, A100 80GB. Cluster lengkap untuk model MoE besar berarti ratusan gigabyte VRAM (sekitar 560 GB pada GLM-5.3 Flash). Tidak punya perangkat keras sendiri — sewa di Gonka.Top atau Spheron, atau mulai dari pool.

Ingin tahu lebih banyak?

Jelajahi bagian lain atau mulai hasilkan GNK sekarang.

Bandingkan penyedia dan sewa →