Các phần cơ sở kiến thức ▾
Điều hướng
▸ Bắt đầu tại đây Theo vai tròDanh mục
- Cursor + Gonka AI — LLM giá rẻ để viết mã
- Claude Code + Gonka AI — LLM cho thiết bị đầu cuối
- OpenClaw + Gonka AI — tác nhân AI giá cả phải chăng
- OpenCode: mô hình riêng trong terminal
- Continue.dev + Gonka AI — AI cho VS Code/JetBrains
- Cline + Gonka AI — tác nhân AI trong VS Code
- Aider + Gonka AI — lập trình cặp đôi với AI
- LangChain + Gonka AI — ứng dụng AI giá rẻ
- n8n + Gonka AI — tự động hóa với AI giá rẻ
- Open WebUI + Gonka AI — ChatGPT của riêng bạn
- LibreChat + Gonka AI — ChatGPT mã nguồn mở
- Hermes Agent + DeepSeek trên mạng Gonka — tác nhân tự hành giá rẻ
- Kilo Code + Gonka AI — Tác nhân AI trong VS Code
- Roo Code + Gonka AI — tác nhân AI tự động trong VS Code
- LlamaIndex + Gonka AI — Ứng dụng RAG giá rẻ
- PydanticAI + Gonka — các tác nhân AI có kiểu dữ liệu với chi phí thấp
- Vercel AI SDK + Gonka AI — Ứng dụng AI trên TypeScript giá rẻ
- TanStack AI + Gonka — Ứng dụng AI trên TypeScript giá rẻ
- Khởi động nhanh API — curl, Python, TypeScript
- JoinGonka Gateway — đánh giá đầy đủ
- Management Keys — SaaS trên Gonka
- API AI rẻ nhất: so sánh các nhà cung cấp 2026
- Hết giới hạn yêu cầu Cursor Pro — phân tích và giải pháp thay thế giá rẻ
- Claude Code rẻ hơn — phân tích hóa đơn và chuyển đổi
- Cline tiêu tốn nhiều tiền — tại sao tác nhân lại tốn kém như vậy
- OpenClaw đắt đỏ — tại sao tác nhân đốt token và cách tiết kiệm
- OpenRouter: giải pháp thay thế giá rẻ — so sánh với JoinGonka Gateway
- Mô hình AI tốt nhất cho lập trình năm 2026: so sánh và giá cả
- Giải pháp thay thế GitHub Copilot giá rẻ không giới hạn
- Giải pháp thay thế Windsurf giá rẻ, không credit và không giới hạn
- API rẻ nhất cho AI agent năm 2026
- ZCode: suy luận GLM giá rẻ thay thế cho GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint của riêng bạn thay vì tín dụng
- GitHub Copilot BYOK — mô hình riêng thay vì hạn ngạch
- Zed + JoinGonka Gateway — inference giá rẻ trong trình soạn thảo
- Pi + JoinGonka Gateway — tác nhân terminal với suy luận giá rẻ
- Codex CLI: khóa riêng thay vì gói thuê bao
Công cụ
Hermes Agent + DeepSeek trên mạng Gonka — tác nhân tự hành giá rẻ
Hermes Agent — AI-agent tự học mã nguồn mở từ Nous Research (giấy phép MIT). Đây không chỉ là trò chuyện: một CLI terminal đầy đủ với bộ nhớ, kỹ năng (skills), lập kế hoạch tác vụ và cổng vào Telegram, Discord, Slack và WhatsApp. Agent tạo kỹ năng từ kinh nghiệm, tìm kiếm qua các cuộc trò chuyện trước đây và xây dựng mô hình người dùng giữa các phiên. Chạy được trên VPS giá $5, hoặc trên GPU-cluster.
Vấn đề của Hermes — cũng giống như bất kỳ công cụ agent nào: tiêu thụ token. Agent đọc file, thực hiện các vòng lặp tool-calling, nén ngữ cảnh, lưu trữ bộ nhớ — với công việc tích cực, dễ dàng tiêu tốn hàng chục triệu token. Trên các mô hình Anthropic hoặc OpenAI ($3-15 cho 1M), việc này biến thành hàng chục và hàng trăm đô la mỗi ngày làm việc tự động.
Hermes mặc định hỗ trợ bất kỳ nhà cung cấp nào: Nous Portal, OpenRouter, OpenAI, Anthropic — hoặc endpoint của riêng bạn. Đây chính là điểm truy cập cho JoinGonka Gateway: gateway tương thích OpenAI của chúng tôi cung cấp kết quả inferenced từ mạng lưới phi tập trung Gonka với giá từ $0.0069 cho 1M token — rẻ hơn hàng trăm và hàng nghìn lần. Hermes trở thành một công cụ hàng ngày thực sự, chứ không phải là một mô hình trình diễn đắt đỏ.
Bước 1: Cài đặt Hermes và lấy khóa
Cài đặt Hermes (Linux, macOS, WSL2). Trình cài đặt chính thức sẽ tự động tải Python, Node.js, ripgrep và ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Sau khi cài đặt, hãy khởi động lại shell và kiểm tra xem nó có chạy không:
source ~/.bashrc # hoặc ~/.zshrc
hermes # CLI tương tácAPI-key JoinGonka: nếu bạn chưa có, hãy đăng ký tại gate.joingonka.ai/register, xác minh địa chỉ email — 3M token miễn phí sẽ được cộng vào tài khoản của bạn — và tạo một khóa có tiền tố jg- trong Dashboard. Một khóa và một số dư hoạt động cho tất cả các mô hình ngay lập tức.
Bước 2: Kết nối Gonka làm nhà cung cấp tùy chỉnh
Hermes hoạt động với bất kỳ endpoint nào tương thích với OpenAI: nếu máy chủ phản hồi tại /v1/chat/completions — Hermes có thể được điều hướng đến đó. Gateway JoinGonka chính xác là như vậy. Có ba cách để cấu hình.
Cách 1: Trình cài đặt của chúng tôi (một lệnh, khuyến nghị). Nó sẽ cấu hình nhà cung cấp trong tệp cấu hình Hermes, đặt DeepSeek V4 Flash làm model mặc định và kiểm tra bằng yêu cầu trực tiếp xem gateway có chấp nhận khóa và model hay không:
npx @joingonka/setup --tool hermesCách 2: Trình hướng dẫn cấu hình. Chạy trong terminal bên ngoài phiên hoạt động:
hermes modelTrong danh sách các nhà cung cấp, chọn "Custom endpoint (self-hosted / VLLM / etc.)" và nhập ba giá trị:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-your-key - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
Cách 3: Chỉnh sửa tệp cấu hình. Hermes lưu trữ cài đặt model trong ~/.hermes/config.yaml — đây là nguồn tin cậy duy nhất. Thêm phần sau:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-your-key⚠️ Khóa — chỉ trong model.api_key. Tài liệu của Hermes cho phép OPENAI_API_KEY trong ~/.hermes/.env, nhưng điều này không hoạt động đối với endpoint tùy chỉnh: Hermes chỉ đọc khóa từ model.api_key và nếu khóa nằm trong .env, gateway sẽ trả về 401 Invalid API key. Đã kiểm tra trên Hermes v0.20.4.
Kiểm tra: chạy hermes và viết "Tạo tệp hello.py với hàm hello world". Tác nhân sẽ tạo tệp và hiển thị kết quả. Trạng thái cấu hình hiện tại có thể xem qua hermes config show | grep '^model\.' và hermes status.
Chuyển đổi nhanh: bên trong phiên làm việc với lệnh /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Và /model custom không có tên sẽ tự động lấy model từ endpoint nếu chỉ có một cái ở đó.
So sánh chi phí các phiên tự động
Hermes là một công cụ tác nhân có bộ nhớ và kỹ năng. Nó không chỉ phản hồi một câu: nó đọc file, viết mã, chạy lệnh, nén ngữ cảnh, thực hiện các tác vụ nền dài thông qua bộ lập lịch. Mỗi hành động là một API-call, và trong một ngày làm việc tự hành, hàng chục triệu token sẽ được tích lũy. Hãy so sánh chi phí của các phiên điển hình:
| Tác vụ | Token | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Tác vụ đơn lẻ với tool-calling | ~5M | $15 — $75 | $0.048 |
| Tác nhân nền (vài giờ) | ~20M | $60 — $300 | $0.19 |
| Phát triển tính năng tự hành | ~50M | $150 — $750 | $0.48 |
| Một ngày làm việc qua gateway (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
Với JoinGonka Gateway, Hermes có thể được giữ chạy 24/7: báo cáo đêm, kiểm toán hàng tuần, tác vụ nền qua cron-scheduler — mà không cần lo lắng về chi phí. Với mức giá của Anthropic, mỗi lần chạy như vậy sẽ phải tính toán thủ công. Số dư ban đầu khi đăng ký là đủ để chạy tác nhân trên một tác vụ thực tế và xem mức tiêu thụ của chính bạn trước lần nạp tiền đầu tiên.
Lựa chọn mô hình và tool calling
Thông qua Gateway, người dùng có thể truy cập ngay vào ba mô hình Gonka — tất cả đều hỗ trợ tool calling (OpenAI function calling) gốc, vì vậy các kỹ năng và công cụ của Hermes hoạt động đáng tin cậy mà không cần phân tích các phản hồi văn bản:
| Model name (cho config) | Context | Phản hồi tối đa | Khi nào chọn |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Mặc định cho Hermes: một trong những context dài nhất trên mạng và giới hạn phản hồi gấp bốn lần — tác nhân xử lý được các chuỗi tool-calling dài và các tệp lớn trong một lần thực thi |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Công cụ đa năng ổn định cho các tác vụ ngắn và chỉnh sửa nhanh |
zai-org/GLM-5.3-Flash | 390K | 8192 | Mô hình Reasoning với context dài nhất trên mạng: suy luận trước khi trả lời — dành cho các logic phức tạp; một phần phản hồi dành cho việc suy luận, vì vậy đừng đặt giới hạn phản hồi quá thấp |
Về giới hạn token trong Hermes. Trong config.yaml, trường context_length là cửa sổ context toàn bộ (đầu vào + đầu ra), còn max_tokens là giới hạn chỉ dành cho độ dài phản hồi. Tốt nhất là không nên đặt cả hai: Hermes sẽ tự xác định các giá trị chính xác từ nhà cung cấp. Nếu bạn đặt max_tokens thủ công, hãy giữ nó trong giới hạn của mô hình: thông qua Gateway, đó là 32768 cho DeepSeek V4 Flash và 8192 cho MiniMax M2.7 và GLM-5.3 Flash. Bạn có thể thay đổi mô hình bất cứ lúc nào bằng lệnh hermes model hoặc ngay trong phiên làm việc thông qua /model.
Các công cụ terminal tương tự trong cơ sở kiến thức của chúng tôi: Claude Code, Cline.
Muốn tìm hiểu thêm?
Khám phá các phần khác hoặc bắt đầu kiếm GNK ngay bây giờ.
Nhận số dư khởi điểm miễn phí →