Các phần cơ sở kiến thức ▾

Điều hướng

▸ Bắt đầu tại đây Theo vai trò

Danh mục

Công cụ 37
Bảng thuật ngữ 12

Công cụ

Hermes Agent + DeepSeek trên mạng Gonka — tác nhân tự hành giá rẻ

Hermes Agent — AI-agent tự học mã nguồn mở từ Nous Research (giấy phép MIT). Đây không chỉ là trò chuyện: một CLI terminal đầy đủ với bộ nhớ, kỹ năng (skills), lập kế hoạch tác vụ và cổng vào Telegram, Discord, Slack và WhatsApp. Agent tạo kỹ năng từ kinh nghiệm, tìm kiếm qua các cuộc trò chuyện trước đây và xây dựng mô hình người dùng giữa các phiên. Chạy được trên VPS giá $5, hoặc trên GPU-cluster.

Vấn đề của Hermes — cũng giống như bất kỳ công cụ agent nào: tiêu thụ token. Agent đọc file, thực hiện các vòng lặp tool-calling, nén ngữ cảnh, lưu trữ bộ nhớ — với công việc tích cực, dễ dàng tiêu tốn hàng chục triệu token. Trên các mô hình Anthropic hoặc OpenAI ($3-15 cho 1M), việc này biến thành hàng chục và hàng trăm đô la mỗi ngày làm việc tự động.

Hermes mặc định hỗ trợ bất kỳ nhà cung cấp nào: Nous Portal, OpenRouter, OpenAI, Anthropic — hoặc endpoint của riêng bạn. Đây chính là điểm truy cập cho JoinGonka Gateway: gateway tương thích OpenAI của chúng tôi cung cấp kết quả inferenced từ mạng lưới phi tập trung Gonka với giá từ $0.0069 cho 1M token — rẻ hơn hàng trăm và hàng nghìn lần. Hermes trở thành một công cụ hàng ngày thực sự, chứ không phải là một mô hình trình diễn đắt đỏ.

Bước 1: Cài đặt Hermes và lấy khóa

Cài đặt Hermes (Linux, macOS, WSL2). Trình cài đặt chính thức sẽ tự động tải Python, Node.js, ripgrep và ffmpeg:

# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Sau khi cài đặt, hãy khởi động lại shell và kiểm tra xem nó có chạy không:

source ~/.bashrc   # hoặc ~/.zshrc
hermes             # CLI tương tác

API-key JoinGonka: nếu bạn chưa có, hãy đăng ký tại gate.joingonka.ai/register, xác minh địa chỉ email — 3M token miễn phí sẽ được cộng vào tài khoản của bạn — và tạo một khóa có tiền tố jg- trong Dashboard. Một khóa và một số dư hoạt động cho tất cả các mô hình ngay lập tức.

Bước 2: Kết nối Gonka làm nhà cung cấp tùy chỉnh

Hermes hoạt động với bất kỳ endpoint nào tương thích với OpenAI: nếu máy chủ phản hồi tại /v1/chat/completions — Hermes có thể được điều hướng đến đó. Gateway JoinGonka chính xác là như vậy. Có ba cách để cấu hình.

Cách 1: Trình cài đặt của chúng tôi (một lệnh, khuyến nghị). Nó sẽ cấu hình nhà cung cấp trong tệp cấu hình Hermes, đặt DeepSeek V4 Flash làm model mặc định và kiểm tra bằng yêu cầu trực tiếp xem gateway có chấp nhận khóa và model hay không:

npx @joingonka/setup --tool hermes

Cách 2: Trình hướng dẫn cấu hình. Chạy trong terminal bên ngoài phiên hoạt động:

hermes model

Trong danh sách các nhà cung cấp, chọn "Custom endpoint (self-hosted / VLLM / etc.)" và nhập ba giá trị:

  • API base URL: https://gate.joingonka.ai/v1
  • API key: jg-your-key
  • Model name: deepseek-ai/DeepSeek-V4-Flash-0731

Cách 3: Chỉnh sửa tệp cấu hình. Hermes lưu trữ cài đặt model trong ~/.hermes/config.yaml — đây là nguồn tin cậy duy nhất. Thêm phần sau:

# ~/.hermes/config.yaml
model:
  provider: custom
  model: deepseek-ai/DeepSeek-V4-Flash-0731
  base_url: https://gate.joingonka.ai/v1
  api_key: jg-your-key

⚠️ Khóa — chỉ trong model.api_key. Tài liệu của Hermes cho phép OPENAI_API_KEY trong ~/.hermes/.env, nhưng điều này không hoạt động đối với endpoint tùy chỉnh: Hermes chỉ đọc khóa từ model.api_key và nếu khóa nằm trong .env, gateway sẽ trả về 401 Invalid API key. Đã kiểm tra trên Hermes v0.20.4.

Kiểm tra: chạy hermes và viết "Tạo tệp hello.py với hàm hello world". Tác nhân sẽ tạo tệp và hiển thị kết quả. Trạng thái cấu hình hiện tại có thể xem qua hermes config show | grep '^model\.'hermes status.

Chuyển đổi nhanh: bên trong phiên làm việc với lệnh /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Và /model custom không có tên sẽ tự động lấy model từ endpoint nếu chỉ có một cái ở đó.

So sánh chi phí các phiên tự động

Hermes là một công cụ tác nhân có bộ nhớ và kỹ năng. Nó không chỉ phản hồi một câu: nó đọc file, viết mã, chạy lệnh, nén ngữ cảnh, thực hiện các tác vụ nền dài thông qua bộ lập lịch. Mỗi hành động là một API-call, và trong một ngày làm việc tự hành, hàng chục triệu token sẽ được tích lũy. Hãy so sánh chi phí của các phiên điển hình:

Tác vụTokenAnthropic ClaudeJoinGonka Gonka
Tác vụ đơn lẻ với tool-calling~5M$15 — $75$0.048
Tác nhân nền (vài giờ)~20M$60 — $300$0.19
Phát triển tính năng tự hành~50M$150 — $750$0.48
Một ngày làm việc qua gateway (Telegram + cron)~150M$450 — $2,250$1.44

Với JoinGonka Gateway, Hermes có thể được giữ chạy 24/7: báo cáo đêm, kiểm toán hàng tuần, tác vụ nền qua cron-scheduler — mà không cần lo lắng về chi phí. Với mức giá của Anthropic, mỗi lần chạy như vậy sẽ phải tính toán thủ công. Số dư ban đầu khi đăng ký là đủ để chạy tác nhân trên một tác vụ thực tế và xem mức tiêu thụ của chính bạn trước lần nạp tiền đầu tiên.

Lựa chọn mô hình và tool calling

Thông qua Gateway, người dùng có thể truy cập ngay vào ba mô hình Gonka — tất cả đều hỗ trợ tool calling (OpenAI function calling) gốc, vì vậy các kỹ năng và công cụ của Hermes hoạt động đáng tin cậy mà không cần phân tích các phản hồi văn bản:

Model name (cho config)ContextPhản hồi tối đaKhi nào chọn
deepseek-ai/DeepSeek-V4-Flash-0731380K32768Mặc định cho Hermes: một trong những context dài nhất trên mạng và giới hạn phản hồi gấp bốn lần — tác nhân xử lý được các chuỗi tool-calling dài và các tệp lớn trong một lần thực thi
MiniMaxAI/MiniMax-M2.7200K8192Công cụ đa năng ổn định cho các tác vụ ngắn và chỉnh sửa nhanh
zai-org/GLM-5.3-Flash390K8192Mô hình Reasoning với context dài nhất trên mạng: suy luận trước khi trả lời — dành cho các logic phức tạp; một phần phản hồi dành cho việc suy luận, vì vậy đừng đặt giới hạn phản hồi quá thấp

Về giới hạn token trong Hermes. Trong config.yaml, trường context_length là cửa sổ context toàn bộ (đầu vào + đầu ra), còn max_tokens là giới hạn chỉ dành cho độ dài phản hồi. Tốt nhất là không nên đặt cả hai: Hermes sẽ tự xác định các giá trị chính xác từ nhà cung cấp. Nếu bạn đặt max_tokens thủ công, hãy giữ nó trong giới hạn của mô hình: thông qua Gateway, đó là 32768 cho DeepSeek V4 Flash và 8192 cho MiniMax M2.7 và GLM-5.3 Flash. Bạn có thể thay đổi mô hình bất cứ lúc nào bằng lệnh hermes model hoặc ngay trong phiên làm việc thông qua /model.

Các công cụ terminal tương tự trong cơ sở kiến thức của chúng tôi: Claude Code, Cline.

Hermes Agent + Gonka = AI agent tự hành Nous Research với chi phí siêu thấp. Một ngày chạy nền chỉ tốn $1.44 thay vì $450-2,250 tại Anthropic. Thiết lập — npx @joingonka/setup --tool hermes (hoặc nhà cung cấp custom với base_url của gateway chúng tôi thủ công), tool calling gốc, ba mô hình để lựa chọn: DeepSeek V4 Flash với context 380K, MiniMax M2.7 và GLM-5.3 Flash. Số dư khởi điểm sau khi xác nhận địa chỉ — dành cho tác vụ thực tế đầu tiên.

Muốn tìm hiểu thêm?

Khám phá các phần khác hoặc bắt đầu kiếm GNK ngay bây giờ.

Nhận số dư khởi điểm miễn phí →