Các phần cơ sở kiến thức ▾
Điều hướng
▸ Bắt đầu tại đây Theo vai tròDanh mục
- Cursor + Gonka AI — LLM giá rẻ để viết mã
- Claude Code + Gonka AI — LLM cho thiết bị đầu cuối
- OpenClaw + Gonka AI — tác nhân AI giá cả phải chăng
- OpenCode: mô hình riêng trong terminal
- Continue.dev + Gonka AI — AI cho VS Code/JetBrains
- Cline + Gonka AI — tác nhân AI trong VS Code
- Aider + Gonka AI — lập trình cặp đôi với AI
- LangChain + Gonka AI — ứng dụng AI giá rẻ
- n8n + Gonka AI — tự động hóa với AI giá rẻ
- Open WebUI + Gonka AI — ChatGPT của riêng bạn
- LibreChat + Gonka AI — ChatGPT mã nguồn mở
- Hermes Agent + DeepSeek trên mạng Gonka — tác nhân tự hành giá rẻ
- Kilo Code + Gonka AI — Tác nhân AI trong VS Code
- Roo Code + Gonka AI — tác nhân AI tự động trong VS Code
- LlamaIndex + Gonka AI — Ứng dụng RAG giá rẻ
- PydanticAI + Gonka — các tác nhân AI có kiểu dữ liệu với chi phí thấp
- Vercel AI SDK + Gonka AI — Ứng dụng AI trên TypeScript giá rẻ
- TanStack AI + Gonka — Ứng dụng AI trên TypeScript giá rẻ
- Khởi động nhanh API — curl, Python, TypeScript
- JoinGonka Gateway — đánh giá đầy đủ
- Management Keys — SaaS trên Gonka
- API AI rẻ nhất: so sánh các nhà cung cấp 2026
- Cách mua token AI và API-key: 3 cách vào năm 2026
- Hết giới hạn yêu cầu Cursor Pro — phân tích và giải pháp thay thế giá rẻ
- Claude Code rẻ hơn — phân tích hóa đơn và chuyển đổi
- Cline tiêu tốn nhiều tiền — tại sao tác nhân lại tốn kém như vậy
- OpenClaw đắt đỏ — tại sao tác nhân đốt token và cách tiết kiệm
- OpenRouter: giải pháp thay thế giá rẻ — so sánh với JoinGonka Gateway
- Mô hình AI tốt nhất cho lập trình năm 2026: so sánh và giá cả
- Giải pháp thay thế GitHub Copilot giá rẻ không giới hạn
- Giải pháp thay thế Windsurf giá rẻ, không credit và không giới hạn
- API rẻ nhất cho AI agent năm 2026
- ZCode: suy luận GLM giá rẻ thay thế cho GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint của riêng bạn thay vì tín dụng
- GitHub Copilot BYOK — mô hình riêng thay vì hạn ngạch
- Zed + JoinGonka Gateway — inference giá rẻ trong trình soạn thảo
- Pi + JoinGonka Gateway — tác nhân terminal với suy luận giá rẻ
- Codex CLI: khóa riêng thay vì gói thuê bao
- DeepSeek Harness: nhà cung cấp của riêng bạn thông qua JoinGonka Gateway
- MiniMax Code: Đại lý MiniMax với khóa riêng thông qua Gonka
- Warp + JoinGonka Gateway — agent terminal trên endpoint của riêng bạn
- Trae + JoinGonka Gateway — các mô hình mạng Gonka trong AI-IDE
- Cherry Studio + JoinGonka Gateway — ứng dụng AI để bàn
- omp (Oh My Pi) + JoinGonka Gateway: agent với vai trò mô hình
- OpenHands + JoinGonka Gateway: đại lý trên endpoint của riêng bạn
- Qwen Code sau khi đóng qwen-oauth: làm việc qua JoinGonka Gateway
- Goose + JoinGonka Gateway: nhà cung cấp riêng và khóa trong keyring
- Crush + JoinGonka Gateway: tác nhân Charm trên các mô hình mạng lưới Gonka
- Zoo Code + JoinGonka Gateway: chuyển từ Roo Code sang các mô hình Gonka
- Kimi Code CLI: tác nhân Moonshot AI trên khóa riêng qua Gonka
- Factory Droid + JoinGonka Gateway: BYOK trên các mô hình mạng Gonka
- MiMo Code + JoinGonka Gateway: đại lý Xiaomi trên các mô hình mạng Gonka
Công cụ
Cherry Studio + JoinGonka Gateway — ứng dụng AI để bàn
Cherry Studio — ứng dụng AI để bàn mã nguồn mở cho Windows, macOS và Linux: trò chuyện với trợ lý, so sánh phản hồi của nhiều mô hình, tác nhân, cơ sở kiến thức, dịch thuật và kết nối các máy chủ MCP. Dự án được phân phối theo giấy phép AGPL-3.0 và đã thu thập hơn 50 nghìn sao trên GitHub (tháng 9 năm 2026). Nguyên tắc chính của ứng dụng là các khóa của riêng bạn: bạn tự quyết định nhà cung cấp nào thực hiện việc suy luận (inference), còn ứng dụng cung cấp một giao diện thống nhất trên chúng.
Ngoài danh sách nhà cung cấp có sẵn, Cherry Studio còn có Custom Provider — nhà cung cấp riêng với địa chỉ tùy chỉnh. Thông qua đó, bạn có thể kết nối JoinGonka Gateway: API tương thích với OpenAI cho các mô hình của mạng phi tập trung Gonka với thanh toán theo token theo giá thực của mạng. Sau khi đăng ký và xác nhận địa chỉ, tài khoản của bạn sẽ nhận được 3M token miễn phí — bạn có thể thoải mái dùng thử ứng dụng trước khi nạp tiền lần đầu.
Hướng dẫn này bao gồm các bước thiết lập cho dòng V2 hiện tại với các lưu ý cho V1, phân tích trường API Host với quy tắc về ký tự #, chọn mô hình, kiểm tra và các lỗi thường gặp. Các nhãn giao diện được trình bày theo bản địa hóa tiếng Anh của ứng dụng.
Cài đặt, phiên bản và khóa
Cài đặt. Bản dựng cho mọi hệ điều hành nằm trên trang release của dự án: trình cài đặt và bản portable cho Windows, file dmg cho macOS, AppImage, deb và rpm cho Linux — cho cả x64 lẫn ARM. Lịch sử hội thoại và cài đặt được lưu cục bộ, ngay trên máy của bạn.
V1 hay V2. Tháng 8 năm 2026 ra mắt dòng V2 với cấu trúc dữ liệu mới và phần cài đặt được làm lại; bản dựng cuối cùng của dòng cũ là 1.9.13. Cả hai dòng đều có mục nhà cung cấp riêng, chỉ khác ở cách thêm và một số nhãn — những chỗ đó sẽ được đánh dấu bên dưới. Khi nâng cấp từ V1 lên, cài đặt nhà cung cấp và mô hình được chuyển tự động, dữ liệu gốc của V1 vẫn được giữ, nhưng dữ liệu mới không đồng bộ ngược lại, và bản sao lưu của hai dòng không tương thích với nhau. Trước khi cập nhật, hãy đọc phần về migration trong tài liệu Cherry Studio.
Khóa JoinGonka. Đăng ký trên gateway, mở mục "API keys" trong tài khoản và nhấn "Create key". Khóa bắt đầu bằng jg- và chỉ hiển thị một lần — hãy lưu lại ngay. Nên tạo một khóa riêng cho Cherry Studio: trong mục "Usage", chi phí của nó sẽ hiển thị thành một dòng riêng.
Kết nối: nhà cung cấp riêng và trường API Host
- Nhấn vào biểu tượng bánh răng — cửa sổ cài đặt sẽ mở ra. Chọn mục Model Provider (trong tài liệu tiếng Anh gọi là Model Services).
- Bên dưới danh sách nhà cung cấp, nhấn Add Provider.
- Trong V2 hộp thoại Add Custom Provider sẽ mở ra. Điền Provider Name — ví dụ
JoinGonka. Trong mục Endpoint settings, điền địa chỉhttps://gate.joingonka.ai/v1vào dòng OpenAI: bên dưới ô sẽ xuất hiện dòng Request path với đường dẫn cuối cùng — dòng này phải kết thúc bằng/v1/chat/completions. Dánjg-your-keyvào ô API Key và nhấn Add. - Trong V1 hộp thoại ngắn hơn: tên nhà cung cấp và Provider Type — chọn
OpenAI. Khóa và địa chỉ được nhập trên trang của nhà cung cấp, trong các ô API Key và API Host. - Đảm bảo nhà cung cấp đã được bật: công tắc nằm ở góc trên bên phải trang của nhà cung cấp đó. Trong V2, nhà cung cấp mới được thêm ở trạng thái tắt, và model của nhà cung cấp bị tắt sẽ không xuất hiện trong danh sách chọn.
Cách Cherry Studio ghép địa chỉ. Ô API Host nhận địa chỉ cơ sở, còn đường dẫn do ứng dụng tự thêm vào và hiển thị kết quả ở dòng Preview bên dưới ô. Quy tắc giống nhau ở cả hai phiên bản:
| Nội dung đã điền | Yêu cầu sẽ đi đến đâu | Ghi chú |
|---|---|---|
https://gate.joingonka.ai/v1 | https://gate.joingonka.ai/v1/chat/completions | Lựa chọn khuyến nghị: phiên bản đã có trong địa chỉ, chỉ cần thêm đường dẫn |
https://gate.joingonka.ai | Cùng địa chỉ | Không có phiên bản trong địa chỉ — Cherry Studio sẽ tự thêm /v1 |
https://gate.joingonka.ai/v1/ | Cùng địa chỉ | Dấu gạch chéo cuối chỉ đơn giản bị bỏ đi |
https://gate.joingonka.ai/v1/chat/completions# | Địa chỉ nguyên vẹn, không có # | Ký tự # ở cuối tắt việc tự động thêm phiên bản và đường dẫn. Với gateway thì thủ thuật này là thừa — nó cần cho các dịch vụ có đường dẫn không chuẩn |
https://gate.joingonka.ai# | https://gate.joingonka.ai/chat/completions | Phiên bản không được thêm, yêu cầu đi lệch khỏi API — gateway sẽ trả về 405 |
Trong các hướng dẫn cũ còn có một quy tắc khác: dấu gạch chéo ở cuối địa chỉ được cho là tắt /v1. Quy tắc đó áp dụng ở các phiên bản đầu, đến hết dòng 1.6, và đã bị loại bỏ ở 1.7: trong các bản dựng hiện tại, chỉ # mới tắt việc tự động thêm.
Các mô hình: danh sách, loại và mô hình mặc định
Nhà cung cấp đã được thêm, nhưng vẫn chưa thấy trong trò chuyện: danh sách chọn của Cherry Studio chỉ bao gồm các mô hình mà bạn đã thêm một cách rõ ràng. Có hai cách thực hiện.
Danh sách từ máy chủ. Trên trang nhà cung cấp, nhấp vào Sync models (trong V1 — Manage, sau đó là Fetch model list). Cherry Studio sẽ gửi yêu cầu GET /v1/models tới cổng kết nối và hiển thị thành phần mạng trực tiếp; thêm các mô hình cần thiết bằng nút +. Thủ công. Nút Add Model mở ra biểu mẫu, trong đó một trường là bắt buộc — Model ID: định danh được nhập chính xác từng ký tự.
Giá của các mô hình trong mạng là như nhau, vì vậy hãy thêm tất cả — bạn sẽ phải chọn giữa chúng dựa trên hành vi, không phải dựa trên ngân sách:
| Mô hình | Model ID | Ngữ cảnh và phản hồi | Khi nào nên chọn trong Cherry Studio |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K, phản hồi lên đến 32768 token | Mô hình trợ lý chính: tài liệu dài, chèn mã lớn, phản hồi chi tiết và dịch thuật — giới hạn phản hồi lớn nhất trong mạng |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K, phản hồi lên đến 8192 token | Câu hỏi hàng ngày nhanh, bản thảo thư, chỉnh sửa văn bản ngắn; phù hợp cho vai trò mô hình dịch vụ |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K, phản hồi lên đến 8192 token | Mô hình Reasoning: lập luận trước khi trả lời. Giải quyết bài toán phức tạp, lập kế hoạch, kiểm tra logic; phản hồi đến muộn hơn và một phần giới hạn phản hồi được dùng cho việc lập luận |
Loại mô hình. Mỗi mô hình trong danh sách có một nút cài đặt, nơi đánh dấu các khả năng của nó: Vision, Reasoning, Tool và các loại khác. Cherry Studio tự động đặt một số dấu tích, nhưng đối với các mô hình của cổng kết nối, bạn nên kiểm tra lại. Vision cần được bỏ chọn: các mô hình mạng là mô hình văn bản. Tool cần thiết nếu bạn kết nối các công cụ MCP — tất cả các mô hình từ bảng đều hỗ trợ gọi công cụ gốc. Reasoning phù hợp với GLM-5.3 Flash — đây là mô hình reasoning của mạng.
Mô hình mặc định. Trong phần cài đặt Default Model, các mô hình được chỉ định cho các vai trò dịch vụ. Hãy đặt DeepSeek V4 Flash làm mô hình trợ lý chính. Đối với mô hình nhanh để đặt tên cho các đoạn hội thoại và chuẩn bị các truy vấn tìm kiếm, tài liệu của Cherry Studio khuyên dùng một mô hình nhẹ và nhanh, không phải mô hình reasoning — trong số các mô hình mạng, MiniMax M2.7 phù hợp nhất cho vai trò này, còn GLM-5.3 Flash với các lập luận bắt buộc của nó thì không nên dùng ở đây. Đối với dịch thuật, bất kỳ mô hình nào trong hai mô hình đầu tiên đều phù hợp.
Kiểm tra và chẩn đoán
Trên trang nhà cung cấp, trong khối khóa có nút Model Check (trong V1 là Check cạnh trường khóa). Chọn một model — Cherry Studio sẽ gửi một truy vấn thử nghiệm ngắn đến model đó và hiển thị kết quả cùng với độ trễ phản hồi. Kiểm tra thành công — hãy chuyển đến trò chuyện, chọn model cổng kết nối trong bộ chọn model và đặt bất kỳ câu hỏi nào.
Để đảm bảo các truy vấn thực sự đi qua cổng kết nối, hãy mở bảng điều khiển của nó, phần «Sử dụng» (Usage): trong khối «Theo khóa» (By keys), các truy vấn và thời gian truy cập gần nhất sẽ xuất hiện cho khóa Cherry Studio, trong khối «Theo model» (By models) — model đã chọn. Trong V2 cũng có số liệu thống kê riêng của client, mục cài đặt Usage: token và truy vấn theo nhà cung cấp, model và khóa. Chi phí ở đó chỉ mang tính chất tham khảo — Cherry Studio ước tính theo bảng giá công khai của các model chứ không phải theo giá của mạng Gonka, vì vậy hãy xem số tiền chính xác trong bảng điều khiển của cổng kết nối.
Nếu có sự cố xảy ra, nguyên nhân hầu như luôn hiển thị trong phản hồi:
| Dấu hiệu | Ý nghĩa | Cách xử lý |
|---|---|---|
401, Invalid API key | Cổng kết nối không nhận ra khóa | Kiểm tra xem khóa có bắt đầu bằng jg-, được dán mà không có khoảng trắng và đang hoạt động trong phần «API-keys» hay không |
404, Invalid URL (POST …) | Có phân đoạn thừa trong đường dẫn. Trường hợp điển hình — trong API Host đã nhập toàn bộ đường dẫn mà không có #, và Cherry Studio đã thêm /chat/completions lần thứ hai | Chỉ để địa chỉ cơ sở https://gate.joingonka.ai/v1 trong trường và đối chiếu với dòng Preview |
405 Not Allowed hoặc HTML thay vì phản hồi | Truy vấn đi chệch API: địa chỉ kết thúc bằng #, nhưng thiếu /v1 | Xóa # hoặc thêm /v1 |
429 | Model bị quá tải: vào giờ cao điểm, dung lượng của một model cụ thể trong mạng đôi khi bị sử dụng hết | Thử lại sau vài giây hoặc chuyển sang model khác; trạng thái mạng có thể xem tại trang trạng thái |
| Kiểm tra thành công nhưng không thấy model trong trò chuyện | Nhà cung cấp đã tắt hoặc model chưa được thêm vào danh sách | Bật nhà cung cấp và thêm model qua Sync models hoặc Add Model |
| Đã nhập khóa nhưng trò chuyện vẫn không phản hồi | Trợ lý đang chạy trên model mặc định từ một nhà cung cấp khác chưa được cấu hình | Chỉ định model cổng kết nối trong phần Default Model |
| Với GLM-5.3 Flash, phản hồi trống hoặc bị ngắt | Giới hạn phản hồi trong cài đặt trợ lý quá nhỏ: các lập luận cũng nằm trong giới hạn đó | Bỏ giới hạn Max tokens hoặc đặt với mức dự phòng — từ 2000 token trở lên |
| Model phản hồi rằng không thấy hình ảnh | Các model trong mạng là dạng văn bản: cổng kết nối thay thế hình ảnh bằng ghi chú văn bản | Bỏ chọn Vision ở model; hãy giao các tác vụ có hình ảnh cho nhà cung cấp có model hỗ trợ thị giác — trong Cherry Studio, các nhà cung cấp hoàn toàn có thể hoạt động cùng nhau |
Chi phí thế nào
Bản thân client được phát hành miễn phí, bạn chỉ trả tiền cho phần inference. Thông qua JoinGonka Gateway, token có giá $0.0069 cho mỗi triệu token đầu vào và $0.021 cho mỗi triệu token đầu ra — giá giống nhau cho tất cả các model trong mạng và được lấy từ nguồn trực tiếp trên trang này. Trò chuyện tiêu tốn token ít hơn đáng kể so với các công cụ đại lý, do đó ước tính số tiền theo giá tháng 9 năm 2026 như sau:
| Kịch bản | Tiêu thụ | Qua Gateway |
|---|---|---|
| Hội thoại khoảng mười câu lệnh | 10-30 nghìn token | vài phần trăm cent |
| Một ngày làm việc dày đặc: câu hỏi, dịch thuật, phân tích tài liệu | 0.5-1M token | ít hơn một cent |
| Một tháng sử dụng hàng ngày | 15-30M token | vài chục cent |
Một lưu ý quan trọng về các cuộc hội thoại dài: với mỗi câu lệnh, client gửi lại toàn bộ lịch sử cho model, vì vậy câu lệnh thứ 100 đắt hơn câu đầu tiên. Giải pháp là bắt đầu hội thoại mới cho nhiệm vụ mới; trong Cherry Studio, đây chỉ là một nút bấm.
| Phương thức | Cách thanh toán | Kết quả nhận được |
|---|---|---|
| Đăng ký dịch vụ trò chuyện | Số tiền cố định mỗi tháng | Các model của một nhà cung cấp trong giao diện của họ, với các giới hạn gói cước |
| Cherry Studio + khóa nhà cung cấp | Theo token theo bảng giá nhà cung cấp | Giao diện và lịch sử riêng trên máy của bạn; hóa đơn tăng theo khối lượng |
| Cherry Studio + JoinGonka Gateway | Theo token theo giá của mạng, từ số dư cổng kết nối | Các model mở của mạng với một mức giá, chi tiêu theo ngày, khóa và model được hiển thị trong bảng điều khiển |
Sự kết hợp này còn mang lại những gì
So sánh các mô hình trong cùng một cuộc hội thoại. Cherry Studio cho phép đặt một câu hỏi cho nhiều mô hình cùng lúc: chọn chúng trong bộ chuyển đổi mô hình và mỗi mô hình sẽ phản hồi bằng một yêu cầu riêng biệt. Với mức giá đồng nhất cho tất cả các mô hình trên mạng lưới, đây là cách nhanh nhất để hiểu trong các tác vụ của bạn, khi nào thì MiniMax M2.7 là đủ, khi nào cần phản hồi dài từ DeepSeek V4 Flash, và khi nào thì khả năng lập luận của GLM-5.3 Flash đáng giá — các thiết lập của nó đã được phân tích trong bài đánh giá mô hình.
Giao thức thứ hai với cùng một khóa. Cổng kết nối (gateway) cũng phản hồi theo định dạng Anthropic. Trong cuộc hội thoại V2, có một dòng Anthropic riêng biệt trong khối Endpoint settings: hãy nhập https://gate.joingonka.ai vào đó, và trong dòng Request path, đường dẫn kết quả phải là /v1/messages. Trong V1, kết quả tương tự đạt được thông qua một nhà cung cấp riêng với Provider Type là Anthropic và cùng địa chỉ. Dưới nút More options trong V2 còn có dòng OpenAI Responses — cổng kết nối cũng hỗ trợ, địa chỉ giống với dòng OpenAI chính.
Chạy các tác nhân dòng lệnh (terminal agents). Trên trang Code CLI (trong tài liệu là Coding Companion), Cherry Studio cài đặt và chạy các tác nhân console, cung cấp cho chúng nhà cung cấp và mô hình từ các thiết lập của nó; danh sách các nhà cung cấp ở đó được lọc theo giao thức mà công cụ cụ thể yêu cầu. Do đó, bạn nên điền địa chỉ Anthropic trước nếu định chạy Claude Code từ đây. Cách thiết lập tác nhân tương tự mà không cần trung gian được hướng dẫn trong Claude Code + Gonka.
Cơ sở tri thức (Knowledge base). Trong V2, nó hoạt động ngay cả khi không có mô hình nhúng (embedding model) — dựa trên tìm kiếm văn bản BM25, và với mô hình nhúng, tìm kiếm lai (hybrid search) sẽ được kích hoạt. Các mô hình mạng lưới Gonka là các mô hình tạo sinh, vì vậy đối với chế độ lai, hãy chọn mô hình nhúng từ một nhà cung cấp khác, ví dụ như chạy cục bộ thông qua Ollama; khi đó, mô hình của cổng kết nối sẽ trả lời dựa trên các đoạn văn bản được tìm thấy.
Cần một cuộc trò chuyện chung cho nhóm trên trình duyệt? Cherry Studio là một ứng dụng máy tính để bàn cá nhân. Đối với giao diện web chung với các tài khoản, hãy xem Open WebUI: nó kết nối với cổng kết nối bằng cùng địa chỉ và khóa.
Muốn tìm hiểu thêm?
Khám phá các phần khác hoặc bắt đầu kiếm GNK ngay bây giờ.
Nhận khóa và token miễn phí →