Các phần cơ sở kiến thức ▾

Điều hướng

▸ Bắt đầu tại đây Theo vai trò

Danh mục

Công cụ 52
Bảng thuật ngữ 12

Công cụ

Cherry Studio + JoinGonka Gateway — ứng dụng AI để bàn

Cherry Studio — ứng dụng AI để bàn mã nguồn mở cho Windows, macOS và Linux: trò chuyện với trợ lý, so sánh phản hồi của nhiều mô hình, tác nhân, cơ sở kiến thức, dịch thuật và kết nối các máy chủ MCP. Dự án được phân phối theo giấy phép AGPL-3.0 và đã thu thập hơn 50 nghìn sao trên GitHub (tháng 9 năm 2026). Nguyên tắc chính của ứng dụng là các khóa của riêng bạn: bạn tự quyết định nhà cung cấp nào thực hiện việc suy luận (inference), còn ứng dụng cung cấp một giao diện thống nhất trên chúng.

Ngoài danh sách nhà cung cấp có sẵn, Cherry Studio còn có Custom Provider — nhà cung cấp riêng với địa chỉ tùy chỉnh. Thông qua đó, bạn có thể kết nối JoinGonka Gateway: API tương thích với OpenAI cho các mô hình của mạng phi tập trung Gonka với thanh toán theo token theo giá thực của mạng. Sau khi đăng ký và xác nhận địa chỉ, tài khoản của bạn sẽ nhận được 3M token miễn phí — bạn có thể thoải mái dùng thử ứng dụng trước khi nạp tiền lần đầu.

Hướng dẫn này bao gồm các bước thiết lập cho dòng V2 hiện tại với các lưu ý cho V1, phân tích trường API Host với quy tắc về ký tự #, chọn mô hình, kiểm tra và các lỗi thường gặp. Các nhãn giao diện được trình bày theo bản địa hóa tiếng Anh của ứng dụng.

Cài đặt, phiên bản và khóa

Cài đặt. Bản dựng cho mọi hệ điều hành nằm trên trang release của dự án: trình cài đặt và bản portable cho Windows, file dmg cho macOS, AppImage, deb và rpm cho Linux — cho cả x64 lẫn ARM. Lịch sử hội thoại và cài đặt được lưu cục bộ, ngay trên máy của bạn.

V1 hay V2. Tháng 8 năm 2026 ra mắt dòng V2 với cấu trúc dữ liệu mới và phần cài đặt được làm lại; bản dựng cuối cùng của dòng cũ là 1.9.13. Cả hai dòng đều có mục nhà cung cấp riêng, chỉ khác ở cách thêm và một số nhãn — những chỗ đó sẽ được đánh dấu bên dưới. Khi nâng cấp từ V1 lên, cài đặt nhà cung cấp và mô hình được chuyển tự động, dữ liệu gốc của V1 vẫn được giữ, nhưng dữ liệu mới không đồng bộ ngược lại, và bản sao lưu của hai dòng không tương thích với nhau. Trước khi cập nhật, hãy đọc phần về migration trong tài liệu Cherry Studio.

Khóa JoinGonka. Đăng ký trên gateway, mở mục "API keys" trong tài khoản và nhấn "Create key". Khóa bắt đầu bằng jg- và chỉ hiển thị một lần — hãy lưu lại ngay. Nên tạo một khóa riêng cho Cherry Studio: trong mục "Usage", chi phí của nó sẽ hiển thị thành một dòng riêng.

Kết nối: nhà cung cấp riêng và trường API Host

  1. Nhấn vào biểu tượng bánh răng — cửa sổ cài đặt sẽ mở ra. Chọn mục Model Provider (trong tài liệu tiếng Anh gọi là Model Services).
  2. Bên dưới danh sách nhà cung cấp, nhấn Add Provider.
  3. Trong V2 hộp thoại Add Custom Provider sẽ mở ra. Điền Provider Name — ví dụ JoinGonka. Trong mục Endpoint settings, điền địa chỉ https://gate.joingonka.ai/v1 vào dòng OpenAI: bên dưới ô sẽ xuất hiện dòng Request path với đường dẫn cuối cùng — dòng này phải kết thúc bằng /v1/chat/completions. Dán jg-your-key vào ô API Key và nhấn Add.
  4. Trong V1 hộp thoại ngắn hơn: tên nhà cung cấp và Provider Type — chọn OpenAI. Khóa và địa chỉ được nhập trên trang của nhà cung cấp, trong các ô API Key và API Host.
  5. Đảm bảo nhà cung cấp đã được bật: công tắc nằm ở góc trên bên phải trang của nhà cung cấp đó. Trong V2, nhà cung cấp mới được thêm ở trạng thái tắt, và model của nhà cung cấp bị tắt sẽ không xuất hiện trong danh sách chọn.

Cách Cherry Studio ghép địa chỉ. Ô API Host nhận địa chỉ cơ sở, còn đường dẫn do ứng dụng tự thêm vào và hiển thị kết quả ở dòng Preview bên dưới ô. Quy tắc giống nhau ở cả hai phiên bản:

Nội dung đã điềnYêu cầu sẽ đi đến đâuGhi chú
https://gate.joingonka.ai/v1https://gate.joingonka.ai/v1/chat/completionsLựa chọn khuyến nghị: phiên bản đã có trong địa chỉ, chỉ cần thêm đường dẫn
https://gate.joingonka.aiCùng địa chỉKhông có phiên bản trong địa chỉ — Cherry Studio sẽ tự thêm /v1
https://gate.joingonka.ai/v1/Cùng địa chỉDấu gạch chéo cuối chỉ đơn giản bị bỏ đi
https://gate.joingonka.ai/v1/chat/completions#Địa chỉ nguyên vẹn, không có #Ký tự # ở cuối tắt việc tự động thêm phiên bản và đường dẫn. Với gateway thì thủ thuật này là thừa — nó cần cho các dịch vụ có đường dẫn không chuẩn
https://gate.joingonka.ai#https://gate.joingonka.ai/chat/completionsPhiên bản không được thêm, yêu cầu đi lệch khỏi API — gateway sẽ trả về 405

Trong các hướng dẫn cũ còn có một quy tắc khác: dấu gạch chéo ở cuối địa chỉ được cho là tắt /v1. Quy tắc đó áp dụng ở các phiên bản đầu, đến hết dòng 1.6, và đã bị loại bỏ ở 1.7: trong các bản dựng hiện tại, chỉ # mới tắt việc tự động thêm.

Các mô hình: danh sách, loại và mô hình mặc định

Nhà cung cấp đã được thêm, nhưng vẫn chưa thấy trong trò chuyện: danh sách chọn của Cherry Studio chỉ bao gồm các mô hình mà bạn đã thêm một cách rõ ràng. Có hai cách thực hiện.

Danh sách từ máy chủ. Trên trang nhà cung cấp, nhấp vào Sync models (trong V1 — Manage, sau đó là Fetch model list). Cherry Studio sẽ gửi yêu cầu GET /v1/models tới cổng kết nối và hiển thị thành phần mạng trực tiếp; thêm các mô hình cần thiết bằng nút +. Thủ công. Nút Add Model mở ra biểu mẫu, trong đó một trường là bắt buộc — Model ID: định danh được nhập chính xác từng ký tự.

Giá của các mô hình trong mạng là như nhau, vì vậy hãy thêm tất cả — bạn sẽ phải chọn giữa chúng dựa trên hành vi, không phải dựa trên ngân sách:

Mô hìnhModel IDNgữ cảnh và phản hồiKhi nào nên chọn trong Cherry Studio
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, phản hồi lên đến 32768 tokenMô hình trợ lý chính: tài liệu dài, chèn mã lớn, phản hồi chi tiết và dịch thuật — giới hạn phản hồi lớn nhất trong mạng
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, phản hồi lên đến 8192 tokenCâu hỏi hàng ngày nhanh, bản thảo thư, chỉnh sửa văn bản ngắn; phù hợp cho vai trò mô hình dịch vụ
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, phản hồi lên đến 8192 tokenMô hình Reasoning: lập luận trước khi trả lời. Giải quyết bài toán phức tạp, lập kế hoạch, kiểm tra logic; phản hồi đến muộn hơn và một phần giới hạn phản hồi được dùng cho việc lập luận

Loại mô hình. Mỗi mô hình trong danh sách có một nút cài đặt, nơi đánh dấu các khả năng của nó: Vision, Reasoning, Tool và các loại khác. Cherry Studio tự động đặt một số dấu tích, nhưng đối với các mô hình của cổng kết nối, bạn nên kiểm tra lại. Vision cần được bỏ chọn: các mô hình mạng là mô hình văn bản. Tool cần thiết nếu bạn kết nối các công cụ MCP — tất cả các mô hình từ bảng đều hỗ trợ gọi công cụ gốc. Reasoning phù hợp với GLM-5.3 Flash — đây là mô hình reasoning của mạng.

Mô hình mặc định. Trong phần cài đặt Default Model, các mô hình được chỉ định cho các vai trò dịch vụ. Hãy đặt DeepSeek V4 Flash làm mô hình trợ lý chính. Đối với mô hình nhanh để đặt tên cho các đoạn hội thoại và chuẩn bị các truy vấn tìm kiếm, tài liệu của Cherry Studio khuyên dùng một mô hình nhẹ và nhanh, không phải mô hình reasoning — trong số các mô hình mạng, MiniMax M2.7 phù hợp nhất cho vai trò này, còn GLM-5.3 Flash với các lập luận bắt buộc của nó thì không nên dùng ở đây. Đối với dịch thuật, bất kỳ mô hình nào trong hai mô hình đầu tiên đều phù hợp.

Kiểm tra và chẩn đoán

Trên trang nhà cung cấp, trong khối khóa có nút Model Check (trong V1 là Check cạnh trường khóa). Chọn một model — Cherry Studio sẽ gửi một truy vấn thử nghiệm ngắn đến model đó và hiển thị kết quả cùng với độ trễ phản hồi. Kiểm tra thành công — hãy chuyển đến trò chuyện, chọn model cổng kết nối trong bộ chọn model và đặt bất kỳ câu hỏi nào.

Để đảm bảo các truy vấn thực sự đi qua cổng kết nối, hãy mở bảng điều khiển của nó, phần «Sử dụng» (Usage): trong khối «Theo khóa» (By keys), các truy vấn và thời gian truy cập gần nhất sẽ xuất hiện cho khóa Cherry Studio, trong khối «Theo model» (By models) — model đã chọn. Trong V2 cũng có số liệu thống kê riêng của client, mục cài đặt Usage: token và truy vấn theo nhà cung cấp, model và khóa. Chi phí ở đó chỉ mang tính chất tham khảo — Cherry Studio ước tính theo bảng giá công khai của các model chứ không phải theo giá của mạng Gonka, vì vậy hãy xem số tiền chính xác trong bảng điều khiển của cổng kết nối.

Nếu có sự cố xảy ra, nguyên nhân hầu như luôn hiển thị trong phản hồi:

Dấu hiệuÝ nghĩaCách xử lý
401, Invalid API keyCổng kết nối không nhận ra khóaKiểm tra xem khóa có bắt đầu bằng jg-, được dán mà không có khoảng trắng và đang hoạt động trong phần «API-keys» hay không
404, Invalid URL (POST …)Có phân đoạn thừa trong đường dẫn. Trường hợp điển hình — trong API Host đã nhập toàn bộ đường dẫn mà không có #, và Cherry Studio đã thêm /chat/completions lần thứ haiChỉ để địa chỉ cơ sở https://gate.joingonka.ai/v1 trong trường và đối chiếu với dòng Preview
405 Not Allowed hoặc HTML thay vì phản hồiTruy vấn đi chệch API: địa chỉ kết thúc bằng #, nhưng thiếu /v1Xóa # hoặc thêm /v1
429Model bị quá tải: vào giờ cao điểm, dung lượng của một model cụ thể trong mạng đôi khi bị sử dụng hếtThử lại sau vài giây hoặc chuyển sang model khác; trạng thái mạng có thể xem tại trang trạng thái
Kiểm tra thành công nhưng không thấy model trong trò chuyệnNhà cung cấp đã tắt hoặc model chưa được thêm vào danh sáchBật nhà cung cấp và thêm model qua Sync models hoặc Add Model
Đã nhập khóa nhưng trò chuyện vẫn không phản hồiTrợ lý đang chạy trên model mặc định từ một nhà cung cấp khác chưa được cấu hìnhChỉ định model cổng kết nối trong phần Default Model
Với GLM-5.3 Flash, phản hồi trống hoặc bị ngắtGiới hạn phản hồi trong cài đặt trợ lý quá nhỏ: các lập luận cũng nằm trong giới hạn đóBỏ giới hạn Max tokens hoặc đặt với mức dự phòng — từ 2000 token trở lên
Model phản hồi rằng không thấy hình ảnhCác model trong mạng là dạng văn bản: cổng kết nối thay thế hình ảnh bằng ghi chú văn bảnBỏ chọn Vision ở model; hãy giao các tác vụ có hình ảnh cho nhà cung cấp có model hỗ trợ thị giác — trong Cherry Studio, các nhà cung cấp hoàn toàn có thể hoạt động cùng nhau

Chi phí thế nào

Bản thân client được phát hành miễn phí, bạn chỉ trả tiền cho phần inference. Thông qua JoinGonka Gateway, token có giá $0.0069 cho mỗi triệu token đầu vào và $0.021 cho mỗi triệu token đầu ra — giá giống nhau cho tất cả các model trong mạng và được lấy từ nguồn trực tiếp trên trang này. Trò chuyện tiêu tốn token ít hơn đáng kể so với các công cụ đại lý, do đó ước tính số tiền theo giá tháng 9 năm 2026 như sau:

Kịch bảnTiêu thụQua Gateway
Hội thoại khoảng mười câu lệnh10-30 nghìn tokenvài phần trăm cent
Một ngày làm việc dày đặc: câu hỏi, dịch thuật, phân tích tài liệu0.5-1M tokenít hơn một cent
Một tháng sử dụng hàng ngày15-30M tokenvài chục cent

Một lưu ý quan trọng về các cuộc hội thoại dài: với mỗi câu lệnh, client gửi lại toàn bộ lịch sử cho model, vì vậy câu lệnh thứ 100 đắt hơn câu đầu tiên. Giải pháp là bắt đầu hội thoại mới cho nhiệm vụ mới; trong Cherry Studio, đây chỉ là một nút bấm.

Phương thứcCách thanh toánKết quả nhận được
Đăng ký dịch vụ trò chuyệnSố tiền cố định mỗi thángCác model của một nhà cung cấp trong giao diện của họ, với các giới hạn gói cước
Cherry Studio + khóa nhà cung cấpTheo token theo bảng giá nhà cung cấpGiao diện và lịch sử riêng trên máy của bạn; hóa đơn tăng theo khối lượng
Cherry Studio + JoinGonka GatewayTheo token theo giá của mạng, từ số dư cổng kết nốiCác model mở của mạng với một mức giá, chi tiêu theo ngày, khóa và model được hiển thị trong bảng điều khiển

Sự kết hợp này còn mang lại những gì

So sánh các mô hình trong cùng một cuộc hội thoại. Cherry Studio cho phép đặt một câu hỏi cho nhiều mô hình cùng lúc: chọn chúng trong bộ chuyển đổi mô hình và mỗi mô hình sẽ phản hồi bằng một yêu cầu riêng biệt. Với mức giá đồng nhất cho tất cả các mô hình trên mạng lưới, đây là cách nhanh nhất để hiểu trong các tác vụ của bạn, khi nào thì MiniMax M2.7 là đủ, khi nào cần phản hồi dài từ DeepSeek V4 Flash, và khi nào thì khả năng lập luận của GLM-5.3 Flash đáng giá — các thiết lập của nó đã được phân tích trong bài đánh giá mô hình.

Giao thức thứ hai với cùng một khóa. Cổng kết nối (gateway) cũng phản hồi theo định dạng Anthropic. Trong cuộc hội thoại V2, có một dòng Anthropic riêng biệt trong khối Endpoint settings: hãy nhập https://gate.joingonka.ai vào đó, và trong dòng Request path, đường dẫn kết quả phải là /v1/messages. Trong V1, kết quả tương tự đạt được thông qua một nhà cung cấp riêng với Provider Type là Anthropic và cùng địa chỉ. Dưới nút More options trong V2 còn có dòng OpenAI Responses — cổng kết nối cũng hỗ trợ, địa chỉ giống với dòng OpenAI chính.

Chạy các tác nhân dòng lệnh (terminal agents). Trên trang Code CLI (trong tài liệu là Coding Companion), Cherry Studio cài đặt và chạy các tác nhân console, cung cấp cho chúng nhà cung cấp và mô hình từ các thiết lập của nó; danh sách các nhà cung cấp ở đó được lọc theo giao thức mà công cụ cụ thể yêu cầu. Do đó, bạn nên điền địa chỉ Anthropic trước nếu định chạy Claude Code từ đây. Cách thiết lập tác nhân tương tự mà không cần trung gian được hướng dẫn trong Claude Code + Gonka.

Cơ sở tri thức (Knowledge base). Trong V2, nó hoạt động ngay cả khi không có mô hình nhúng (embedding model) — dựa trên tìm kiếm văn bản BM25, và với mô hình nhúng, tìm kiếm lai (hybrid search) sẽ được kích hoạt. Các mô hình mạng lưới Gonka là các mô hình tạo sinh, vì vậy đối với chế độ lai, hãy chọn mô hình nhúng từ một nhà cung cấp khác, ví dụ như chạy cục bộ thông qua Ollama; khi đó, mô hình của cổng kết nối sẽ trả lời dựa trên các đoạn văn bản được tìm thấy.

Cần một cuộc trò chuyện chung cho nhóm trên trình duyệt? Cherry Studio là một ứng dụng máy tính để bàn cá nhân. Đối với giao diện web chung với các tài khoản, hãy xem Open WebUI: nó kết nối với cổng kết nối bằng cùng địa chỉ và khóa.

Cherry Studio kết nối với JoinGonka Gateway như một nhà cung cấp riêng: Settings → Model Provider → Add Provider, địa chỉ https://gate.joingonka.ai/v1 và khóa jg-. Đường dẫn /chat/completions được ứng dụng tự động thêm vào và hiển thị kết quả trong dòng Preview; ký tự # ở cuối địa chỉ sẽ tắt tự động hoàn thiện và cổng kết nối không cần ký tự này. Tiếp theo — bật nhà cung cấp, thêm các mô hình thông qua Sync models, bỏ chọn Vision của chúng và kiểm tra kết nối bằng nút Model Check. Hãy chọn DeepSeek V4 Flash làm mô hình chính, MiniMax M2.7 làm mô hình tiện ích, và GLM-5.3 Flash cho các tác vụ logic; mức tiêu thụ được kiểm tra trong tài khoản của cổng kết nối, phần "Sử dụng".

Muốn tìm hiểu thêm?

Khám phá các phần khác hoặc bắt đầu kiếm GNK ngay bây giờ.

Nhận khóa và token miễn phí →