Các phần cơ sở kiến thức ▾

Công nghệ

Chọn GPU cho Gonka: khuyến nghị về phần cứng

Câu hỏi chính của thợ đào kỹ thuật: cần GPU nào cho Gonka? Chúng tôi sẽ phân tích các yêu cầu tối thiểu, cấu hình tối ưu và nơi thuê máy chủ nếu bạn không có phần cứng riêng.

Yêu cầu tối thiểu

Gonka yêu cầu GPU NVIDIA hỗ trợ CUDA và tối thiểu 320 GB VRAM tổng cộng cho mỗi container MLNode; có thể kết hợp nhiều card nếu nút chứa được các mô hình của mạng và vượt qua PoC. Đây là giới hạn phần cứng nghiêm ngặt: các mô hình của mạng — MiniMax M2.7, DeepSeek V4 Flash và GLM-5.3 Flash — với kiến trúc MoE đòi hỏi dung lượng bộ nhớ đồ họa lớn để tải trọng số và thực hiện inference. GPU AMD và Intel không được hỗ trợ — Gonka sử dụng ngăn xếp CUDA của NVIDIA, bao gồm cuBLAS cho các phép toán ma trận và cuDNN cho các lớp mạng nơ-ron.

Danh sách đầy đủ các yêu cầu:

  • GPU: NVIDIA hỗ trợ CUDA, thế hệ mới hơn Tesla, từ 320 GB VRAM tổng cộng cho mỗi MLNode. Trong danh sách chính thức có B300, B200, RTX PRO 6000, H200, H100 và A100 80GB. RTX 4090 và RTX 3090 dành cho game (24GB mỗi card) không đáp ứng: dung lượng như vậy phải ghép từ các card máy chủ
  • CPU: bắt buộc hỗ trợ tập lệnh AVX — nếu không có, inferenced sẽ không khởi chạy (SIGILL khi khởi động)
  • RAM: khuyến nghị 64GB+ bộ nhớ trong để hoạt động thoải mái, tải trọng số và xử lý hàng đợi yêu cầu
  • Ổ đĩa: NVMe SSD với dung lượng đủ lớn — bộ trọng số đầy đủ của một mô hình MoE lớn chiếm hàng trăm gigabyte, và tải nhanh từ NVMe là yếu tố then chốt cho thời gian khởi động nguội của nút
  • Internet: tối thiểu 100 Mbps kết nối ổn định — nút nhận yêu cầu từ Transfer Agents và gửi kết quả cho khách hàng theo thời gian thực
  • Thời gian hoạt động: 24/7 — bỏ lỡ epoch làm giảm phần thưởng, và thời gian ngừng hoạt động kéo dài có thể dẫn đến việc bị loại khỏi pool nhiệm vụ

Các card được đề xuất

Hãy cùng phân tích chi tiết từng card được khuyến nghị:

NVIDIA H100 80GB — dòng flagship của thế hệ hiện tại và là lựa chọn tối ưu cho Gonka. TDP (mức tiêu thụ nhiệt) 700 W, giá ~$25—35K mỗi card. Hỗ trợ inference FP8, giúp xử lý yêu cầu nhanh hơn mà không giảm chất lượng. NVLink cho phép gộp nhiều H100 thành một node với kết nối tốc độ cao giữa các card. Mô hình nặng nhất của mạng lưới — GLM-5.3 Flash với ~560 GB VRAM mỗi replica — cần tám H100 80GB; đây là cấu hình host tham chiếu cho mô hình này.

NVIDIA H200 141GB — thế hệ kế tiếp với dung lượng bộ nhớ gần gấp đôi. VRAM lớn hơn cho phép xử lý nhiều yêu cầu đồng thời hơn (batch size lớn hơn), từ đó tăng thu nhập GNK trên mỗi đơn vị thời gian. Băng thông bộ nhớ HBM3e cao hơn H100 — nạp trọng số nhanh hơn, inference nhanh hơn. Với cùng mô hình đó, chỉ cần ít card H200 hơn so với H100, giúp đơn giản hoá hạ tầng.

NVIDIA A100 80GB — thế hệ trước nhưng vẫn nằm trong danh sách chính thức của mạng lưới. Giá ~$10—15K mỗi card — rẻ hơn đáng kể so với H100. Hiệu năng thấp hơn: không có FP8, HBM2e chậm hơn. Mỗi ML-node cần ít nhất bốn card loại này (4 × 80 = 320 GB); phiên bản A100 40GB không có trong danh sách chính thức. A100 phù hợp để gia nhập mạng lưới với vốn đầu tư ban đầu thấp hơn.

Những gì không phù hợp: các card tiêu dùng RTX 4090 (24GB), RTX 3090 (24GB), RTX 4080 (16GB) — không đủ VRAM để chạy các mô hình của mạng lưới. Ngưỡng của mạng lưới là 320 GB bộ nhớ video mỗi ML-node, và ngưỡng này được tạo nên từ các card máy chủ. Một instance của mô hình MoE lớn là vài card H100, H200 hoặc A100 80GB trong cùng một node; số lượng chính xác phụ thuộc vào mô hình và cấu hình.

Cấu hình node

MLNode trong mạng Gonka là một máy chủ có GPU chuyên thực hiện AI inference. Việc thiết lập nút bao gồm nhiều bước, mỗi bước đều quan trọng để nút hoạt động ổn định và kiếm được tối đa GNK.

Phần mềm: thành phần chính là inferenced CLI, chịu trách nhiệm tải mô hình, xử lý yêu cầu và kết nối với blockchain. Inferenced chạy trong Docker container, giúp việc triển khai và cập nhật trở nên đơn giản. Để cấu hình đầy đủ cho một mô hình MoE lớn của mạng, cần hàng trăm gigabyte tổng VRAM — ví dụ tám card H100 80GB cho GLM-5.3 Flash (khoảng 560 GB mỗi bản sao). Trọng số mô hình (hàng trăm gigabyte) được tải từ NVMe SSD khi khởi động nút.

Đăng ký: sau khi cài đặt, nút được đăng ký on-chain — tạo một bản ghi trong blockchain Gonka với địa chỉ của mình, các mô hình hỗ trợ và thông số kỹ thuật (VRAM, băng thông, vị trí). Từ lúc đó, Transfer Agents bắt đầu chuyển các yêu cầu AI từ người dùng đến nút.

Hoạt động trong mạng: mỗi yêu cầu đến — một prompt từ người dùng — được GPU xử lý qua mạng nơ-ron. Kết quả được gửi trả lại cho khách hàng qua Transfer Agent. Đồng thuận Sprint ghi nhận mọi phép tính đã hoàn thành khi tạo block, và phần thưởng được phân phối theo tỷ lệ khối lượng công việc. Nút có thể công bố thông số cập nhật theo thời gian thực — nếu tải tăng, Transfer Agents sẽ chuyển một phần yêu cầu sang các nút ít tải hơn. Hướng dẫn thiết lập chi tiết có trong cẩm nang đào coin.

Nơi thuê GPU

Nếu bạn không có thiết bị của riêng mình - có ba cách để truy cập GPU cho Gonka, mỗi cách có sự cân bằng khác nhau về chi phí, độ phức tạp và kiểm soát:

CáchChi phíĐộ phức tạpKiểm soát
Pooltừ $1Tối thiểuThấp
Máy chủ riêngtừ $12,000/thángThấpTrung bình
Thuê bare-metaltừ $2—3/giờ GPUCaoToàn bộ

Pools (từ $1 — Ancapex, từ $100 — Gonka.Top): Ancapex, Gonka.Top, GonkaPool.ai, CloudMine (Mingles) — các nhà điều hành thuê GPU, thiết lập node, giám sát thời gian hoạt động. Bạn nhận được GNK tỷ lệ thuận với đóng góp, không cần chạm vào các chi tiết kỹ thuật. Cách lý tưởng cho người mới và nhà đầu tư thụ động.

Máy chủ riêng (từ $12,000/tháng): Gonka.Top không chỉ cung cấp các pool, mà còn cung cấp các máy chủ riêng với dịch vụ đầy đủ. Bạn nhận được một node đã chuẩn bị sẵn — nhà điều hành chịu trách nhiệm thiết lập inferenced, giám sát 24/7, cập nhật và khắc phục sự cố. Khai thác diễn ra trực tiếp vào ví của bạn — toàn bộ thu nhập bằng GNK là của bạn, sau khi trừ phí thuê cố định.

Thuê bare-metal: Spheron cung cấp các máy chủ bare-metal với H100/H200 mà bạn tự cấu hình (người dùng từ Liên bang Nga có thể gặp khó khăn với thanh toán Spheron qua bộ xử lý thanh toán). Đây là con đường dành cho người dùng kỹ thuật, quen thuộc với Linux, Docker và CLI. Kiểm soát tối đa, nhưng cũng trách nhiệm tối đa về cấu hình, thời gian hoạt động và cập nhật. So sánh chi tiết tất cả các nhà cung cấp — trên trang “Nhận GNK”.

Gonka cần một ML-node NVIDIA (CUDA) với tối thiểu 320 GB bộ nhớ video. Các card tối ưu: H100, H200, A100 80GB. Một cluster đầy đủ cho mô hình MoE lớn là hàng trăm gigabyte VRAM (khoảng 560 GB với GLM-5.3 Flash). Chưa có phần cứng riêng — hãy thuê từ Gonka.Top hoặc Spheron, hoặc bắt đầu với pool.

Muốn tìm hiểu thêm?

Khám phá các phần khác hoặc bắt đầu kiếm GNK ngay bây giờ.

So sánh các nhà cung cấp và thuê →