Các phần cơ sở kiến thức ▾
Điều hướng
▸ Bắt đầu tại đây Theo vai tròDanh mục
- Cursor + Gonka AI — LLM giá rẻ để viết mã
- Claude Code + Gonka AI — LLM cho thiết bị đầu cuối
- OpenClaw + Gonka AI — tác nhân AI giá cả phải chăng
- OpenCode: mô hình riêng trong terminal
- Continue.dev + Gonka AI — AI cho VS Code/JetBrains
- Cline + Gonka AI — tác nhân AI trong VS Code
- Aider + Gonka AI — lập trình cặp đôi với AI
- LangChain + Gonka AI — ứng dụng AI giá rẻ
- n8n + Gonka AI — tự động hóa với AI giá rẻ
- Open WebUI + Gonka AI — ChatGPT của riêng bạn
- LibreChat + Gonka AI — ChatGPT mã nguồn mở
- Hermes Agent + DeepSeek trên mạng Gonka — tác nhân tự hành giá rẻ
- Kilo Code + Gonka AI — Tác nhân AI trong VS Code
- Roo Code + Gonka AI — tác nhân AI tự động trong VS Code
- LlamaIndex + Gonka AI — Ứng dụng RAG giá rẻ
- PydanticAI + Gonka — các tác nhân AI có kiểu dữ liệu với chi phí thấp
- Vercel AI SDK + Gonka AI — Ứng dụng AI trên TypeScript giá rẻ
- TanStack AI + Gonka — Ứng dụng AI trên TypeScript giá rẻ
- Khởi động nhanh API — curl, Python, TypeScript
- JoinGonka Gateway — đánh giá đầy đủ
- Management Keys — SaaS trên Gonka
- API AI rẻ nhất: so sánh các nhà cung cấp 2026
- Hết giới hạn yêu cầu Cursor Pro — phân tích và giải pháp thay thế giá rẻ
- Claude Code rẻ hơn — phân tích hóa đơn và chuyển đổi
- Cline tiêu tốn nhiều tiền — tại sao tác nhân lại tốn kém như vậy
- OpenClaw đắt đỏ — tại sao tác nhân đốt token và cách tiết kiệm
- OpenRouter: giải pháp thay thế giá rẻ — so sánh với JoinGonka Gateway
- Mô hình AI tốt nhất cho lập trình năm 2026: so sánh và giá cả
- Giải pháp thay thế GitHub Copilot giá rẻ không giới hạn
- Giải pháp thay thế Windsurf giá rẻ, không credit và không giới hạn
- API rẻ nhất cho AI agent năm 2026
- ZCode: suy luận GLM giá rẻ thay thế cho GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint của riêng bạn thay vì tín dụng
- GitHub Copilot BYOK — mô hình riêng thay vì hạn ngạch
- Zed + JoinGonka Gateway — inference giá rẻ trong trình soạn thảo
- Pi + JoinGonka Gateway — tác nhân terminal với suy luận giá rẻ
- Codex CLI: khóa riêng thay vì gói thuê bao
Công cụ
Kilo Code + Gonka AI — Tác nhân AI trong VS Code
Kilo Code — phần mở rộng tác nhân AI mã nguồn mở cho VS Code, tự động viết và chỉnh sửa mã, chạy lệnh trong terminal, đọc và sửa hàng chục tệp cùng lúc. Dự án đã kết hợp những điểm mạnh của Cline và Roo Code và đang phát triển thành một nền tảng tác nhân thống nhất: ngoài phần mở rộng IDE, còn có các tùy chọn cho JetBrains và CLI. Tính năng chính — các chế độ (agents): Code (viết mã), Plan (hay Architect — lập kế hoạch kiến trúc mà không chỉnh sửa), Debug (tìm nguyên nhân lỗi) và Ask (trả lời câu hỏi về dự án). Bạn cũng có thể tạo các chế độ của riêng mình.
Vấn đề tương tự như bất kỳ tác nhân nào — chi phí token. Kilo Code gửi ngữ cảnh tệp, đầu ra lệnh, lịch sử các bước cho mô hình; một tác vụ dễ dàng tiêu thụ 10–100M token. Với giá của Anthropic ($3–15 cho 1M), điều này là $30–1500 cho một phiên — không thực tế cho công việc hàng ngày.
JoinGonka Gateway giảm chi phí hàng trăm và hàng nghìn lần: cùng một phiên chỉ tốn $0.01–1.00. Vì Kilo Code là mã nguồn mở và hỗ trợ bất kỳ điểm cuối nào tương thích OpenAI (cũng như định dạng Anthropic với URL cơ sở tùy chỉnh), việc kết nối cổng của chúng tôi chỉ là một cài đặt. Điều này biến Kilo Code từ một bản trình diễn đắt tiền thành một công cụ hàng ngày.
Bước 1: Cài đặt Kilo Code và lấy khóa
Cài đặt Kilo Code: trong VS Code, mở Extensions (Ctrl+Shift+X), tìm kiếm "Kilo Code" và nhấn Install. Sau khi cài đặt, biểu tượng Kilo Code sẽ xuất hiện ở thanh bên. Tiện ích mở rộng cũng có sẵn trên Open VSX cho các bản build không có Marketplace.
API-key JoinGonka: nếu bạn chưa có tài khoản — hãy đăng ký tại gate.joingonka.ai/register, nhận 3M token miễn phí và tạo key với tiền tố jg- trong Dashboard → API Keys. Một key duy nhất hoạt động cho cả định dạng OpenAI (/v1) và định dạng Anthropic (/v1/messages) — số dư là chung.
Bước 2: Cấu hình Kilo Code (Tương thích OpenAI)
Cách dễ nhất là thiết lập bằng trình cài đặt chỉ với một lệnh. Đối với các công cụ CLI/tệp, nó sẽ tự động cấu hình nhà cung cấp JoinGonka (baseUrl, mô hình), đối với các công cụ UI, nó sẽ hiển thị các giá trị sẵn sàng để dán:
npx @joingonka/setup --tool kiloTrình cài đặt này có tính linh hoạt cao (nếu không có flag, nó sẽ gợi ý chọn công cụ từ danh sách), yêu cầu nhập khóa jg-… và sau khi thiết lập sẽ thực hiện kiểm tra trực tiếp bằng cách gửi yêu cầu đến gateway. Các cài đặt khác không bị thay đổi. Dưới đây là phương pháp thủ công nếu bạn muốn tự cấu hình.
Thiết lập thủ công (Kế hoạch B)
Mở bảng điều khiển Kilo Code và đi tới cài đặt nhà cung cấp thông qua biểu tượng bánh răng.
Cách A — OpenAI Compatible (khuyên dùng). Trong phiên bản mới của tiện ích mở rộng, mở Settings (biểu tượng bánh răng) → tab Providers → ở dưới cùng chọn nút Custom provider và điền vào hộp thoại:
- Provider ID: bất kỳ định danh nào, ví dụ
joingonka. - Display name: ví dụ
JoinGonka Gonka. - Base URL:
https://gate.joingonka.ai/v1 - API key:
jg-your-key - Models: thêm
MiniMaxAI/MiniMax-M2.7. Kilo sẽ tự động lấy danh sách mô hình từ endpoint/v1/models— bạn có thể chọn mô hình từ danh sách thay vì nhập thủ công.
Nhấn Submit — các mô hình sẽ xuất hiện trong bộ chọn. Trong giao diện cũ (VSCode Legacy), đường dẫn ngắn hơn: API Provider → OpenAI Compatible, sau đó điền vào các trường Base URL, API Key và Model với các giá trị tương tự.
Cách B — Định dạng Anthropic. Cổng kết nối của chúng tôi cũng phản hồi theo Anthropic API. Chọn API Provider → Anthropic, dán khóa jg-your-key, đánh dấu vào «Use custom base URL» và nhập https://gate.joingonka.ai (không bao gồm /v1 — Kilo sẽ tự thêm /v1/messages).
Các mô hình và giới hạn đầu ra của chúng (cả ba đều có sẵn ngay bây giờ):
| Mô hình | Ngữ cảnh | Tối đa đầu ra |
|---|---|---|
| MiniMaxAI/MiniMax-M2.7 (mặc định) | 200K | 8192 |
| deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 |
| zai-org/GLM-5.3-Flash | 390K | 8192 |
Trong hộp thoại nhà cung cấp tùy chỉnh, đối với mỗi mô hình, bạn có thể đặt Max Output Tokens và Context Window — hãy nhập các giá trị từ bảng cho mô hình bạn đã chọn.
Kiểm tra: trong cuộc trò chuyện Kilo Code ở chế độ Code, hãy viết «Tạo tệp hello.py với hàm hello world». Tác nhân (agent) sẽ đề xuất diff để bạn phê duyệt và tạo tệp. Theo mặc định, Kilo Code yêu cầu xác nhận trước mỗi hành động — bạn có thể giảm bớt điều này bằng cách cho phép thực thi tự động cho các hoạt động được tin cậy.
So sánh chi phí các phiên tác nhân
Kilo Code là công cụ đại lý: nó không chỉ trả lời mà còn thực hiện toàn bộ tác vụ — đọc tệp, viết mã, chạy thử nghiệm, sửa lỗi. Mỗi bước là một lần gọi API và token sẽ tăng nhanh chóng. Hãy so sánh chi phí của các phiên làm việc điển hình thông qua Anthropic Claude và thông qua gateway của chúng tôi đến mạng lưới Gonka:
| Tác vụ | Số lượng Token | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Sửa lỗi đơn giản | ~5M | $15 — $75 | $0.048 |
| Tính năng mới (2–3 tệp) | ~20M | $60 — $300 | $0.19 |
| Refactoring module | ~50M | $150 — $750 | $0.48 |
| Phiên phát triển toàn diện (4h) | ~100M | $300 — $1,500 | $0.96 |
Thông qua JoinGonka Gateway, đầu vào có giá ~$0.0069 cho 1M token, đầu ra đắt gấp ba lần — rẻ hơn hàng trăm và hàng nghìn lần so với Anthropic và OpenAI. Kilo Code trở thành công cụ hàng ngày: bạn có thể chạy nó cho mỗi ticket, mỗi lỗi và mỗi tính năng mà không cần đắn đo. Với giá của Anthropic, bạn phải cân nhắc mỗi lần chạy.
Thông số mô hình: MiniMax M2.7 có cửa sổ context 200K token và độ dài phản hồi tối đa 8192 token (DeepSeek V4 Flash có 380K và lên đến 32768, GLM-5.3 Flash có 390K và lên đến 8192). Kilo Code có thể yêu cầu nhiều hơn, nhưng gateway sẽ giới hạn đầu ra theo giới hạn tối đa của mô hình. Đối với các thế hệ dài, tác nhân sẽ chia nhỏ công việc thành các bước.
Chế độ và tool calling
Điểm mạnh của Kilo Code là các chế độ (trong phần mở rộng cũ gọi là modes, trong phần mới gọi là agents), có thể chuyển đổi giữa các chế độ bằng menu thả xuống, lệnh /agents hoặc phím tắt Ctrl+.:
- Plan / Architect — thảo luận và thiết kế giải pháp mà không cần chạm vào tệp. Tiện lợi khi chạy qua GLM-5.3 Flash — mô hình reasoning suy luận trước khi trả lời, và việc lập kế hoạch chiếm nhiều context, nhưng trên gateway của chúng tôi, chi phí này rất nhỏ.
- Code — chế độ mặc định: viết và sửa mã, áp dụng diff, chạy lệnh.
- Debug — tìm nguyên nhân gây lỗi dựa trên logs và stack.
- Ask — trả lời các câu hỏi về cơ sở mã mà không thay đổi gì.
Chế độ Orchestrator riêng biệt trong các phiên bản mới đã bị coi là lỗi thời: các tác nhân có toàn quyền truy cập vào các công cụ hiện nay đã có thể tự chạy các tác vụ phụ (subagents) mà không cần orchestration chuyên dụng. Các chế độ tùy chỉnh cho kịch bản của bạn cũng được hỗ trợ.
Tool calling: gateway của chúng tôi chuyển tiếp OpenAI function calling gốc và Anthropic tool_use, và các mô hình được chọn (MiniMax M2.7, DeepSeek V4 Flash, GLM-5.3 Flash) đều hỗ trợ gọi công cụ. Điều này có nghĩa là vòng lặp tác nhân của Kilo Code — đọc tệp, chỉnh sửa, chạy lệnh, lập chỉ mục cơ sở mã — hoạt động đáng tin cậy trên các mô hình của chúng tôi mà không cần phân tích văn bản dễ lỗi.
Muốn tìm hiểu thêm?
Khám phá các phần khác hoặc bắt đầu kiếm GNK ngay bây giờ.
Nhận token miễn phí →