Розділи бази знань ▾
Навігація
▸ Почніть тут За ролямиКатегорії
- Cursor + Gonka AI — дешевий LLM для кодування
- Claude Code + Gonka AI — LLM для терміналу
- OpenClaw + Gonka AI — доступні AI-агенти
- OpenCode: власна модель у терміналі
- Continue.dev + Gonka AI — AI для VS Code/JetBrains
- Cline + Gonka AI — AI-агент у VS Code
- Aider + Gonka AI — парне програмування з AI
- LangChain + Gonka AI — AI-додатки за копійки
- n8n + Gonka AI — автоматизація з дешевим AI
- Open WebUI + Gonka AI — свій ChatGPT
- LibreChat + Gonka AI — open-source ChatGPT
- Hermes Agent + DeepSeek у мережі Gonka — автономний агент за копійки
- Kilo Code + Gonka AI — AI-агент у VS Code
- Roo Code + Gonka AI — автономний AI-агент у VS Code
- LlamaIndex + Gonka AI — RAG-додатки за копійки
- PydanticAI + Gonka — типізовані AI-агенти за копійки
- Vercel AI SDK + Gonka AI — AI-додатки на TypeScript за копійки
- TanStack AI + Gonka — AI-додатки на TypeScript за копійки
- API швидкий старт — curl, Python, TypeScript
- JoinGonka Gateway — повний огляд
- Management Keys — SaaS на Gonka
- Найдешевший AI API: порівняння провайдерів 2026
- Як купити токени AI та API-ключ: 3 способи у 2026
- Ліміт запитів Cursor Pro вичерпано — розбір та дешева альтернатива
- Claude Code дешевше — розбір рахунку та перемикання
- Cline спалює гроші — чому агент витрачає так багато
- OpenClaw дорого обходиться — чому агент спалює токени і як заощадити
- OpenRouter: дешева альтернатива — порівняння з JoinGonka Gateway
- Найкраща AI-модель для кодингу у 2026: порівняння та ціни
- Дешева альтернатива GitHub Copilot без лімітів
- Дешева альтернатива Windsurf без кредитів і лімітів
- Найдешевший API для AI-агентів у 2026
- ZCode: дешевий GLM-інференс замість GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — власний endpoint замість кредитів
- GitHub Copilot BYOK — власні моделі замість квоти
- Zed + JoinGonka Gateway — дешевий інференс у редакторі
- Pi + JoinGonka Gateway — термінальний агент на дешевому інференсі
- Codex CLI: свій ключ замість підписки
- DeepSeek Harness: власний провайдер через JoinGonka Gateway
- MiniMax Code: агент MiniMax на своєму ключі через Gonka
- Warp + JoinGonka Gateway — агент терміналу на своєму endpoint
- Trae + JoinGonka Gateway — моделі мережі Gonka в AI-IDE
- Cherry Studio + JoinGonka Gateway — настільний AI-клієнт
- omp (Oh My Pi) + JoinGonka Gateway: агент із ролями моделей
- OpenHands + JoinGonka Gateway: агент на своєму endpoint
- Qwen Code після закриття qwen-oauth: робота через JoinGonka Gateway
- Goose + JoinGonka Gateway: свій провайдер і ключ у keyring
- Crush + JoinGonka Gateway: агент Charm на моделях мережі Gonka
- Zoo Code + JoinGonka Gateway: переїзд з Roo Code на моделі Gonka
- Kimi Code CLI: агент Moonshot AI на своєму ключі через Gonka
- Factory Droid + JoinGonka Gateway: BYOK на моделях мережі Gonka
- MiMo Code + JoinGonka Gateway: агент Xiaomi на моделях мережі Gonka
Інструменти
Qwen Code після закриття qwen-oauth: робота через JoinGonka Gateway
Qwen Code (команда qwen) — відкритий термінальний агент для розробки від команди Qwen в Alibaba: розбирається в проєкті, редагує файли, запускає команди та тести — з термінала, редактора або скриптів. Проєкт виріс з Google Gemini CLI і розвивається самостійно, код відкритий під ліцензією Apache-2.0. Протоколів агент знає кілька — OpenAI, Anthropic, Gemini, — тому до нього підключається майже будь-який постачальник моделей.
Почати роботу з Qwen Code без ключа дозволяв безкоштовний вхід через акаунт qwen.ai — тип авторизації qwen-oauth. 15 квітня 2026 року цей безкоштовний рівень закрили, а поведінка за замовчуванням залишилася колишньою: якщо тип авторизації не вибрано, Qwen Code йде саме в нього, а стара інсталяція відповідає рядком Qwen OAuth free tier was discontinued on 2026-04-15. Документація радить переключитися на іншого постачальника, і найпростіше це зробити через OpenAI-сумісний endpoint.
JoinGonka Gateway — саме такий endpoint: через нього Qwen Code працює на моделях децентралізованої мережі Gonka — DeepSeek V4 Flash, GLM-5.3 Flash та MiniMax M2.7 — за єдиною ціною $0.0069 за мільйон вхідних токенів, без підписки. Власних моделей Qwen у мережі зараз немає, але агенту це й не потрібно: він працює з будь-якою моделлю, яка вміє викликати інструменти. Команди та повідомлення нижче звірені живим прогоном Qwen Code 0.24.4 через шлюз 23 вересня 2026 року. Після підтвердження адреси на рахунок прийдуть 3M безкоштовних токенів — їх вистачить, щоб повторити весь шлях самому.
Швидкий старт: встановлення та одна команда
Крок 1: встановити Qwen Code. Офіційні способи з README проєкту:
# Linux and macOS: standalone build with its own Node.js
curl -fsSL https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.sh | bash
# Windows (PowerShell)
irm https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.ps1 | iex
# npm (requires Node.js 22 or newer)
npm install -g @qwen-code/qwen-code@latest
# Homebrew
brew install qwen-codeСкрипт кладе команду в ~/.local/bin/qwen і за потреби дописує шлях у файл налаштувань оболонки. Відкрийте термінал заново й перевірте: qwen --version.
Крок 2: отримати ключ. Зареєструйтеся на gate.joingonka.ai/register, підтвердьте адресу та створіть у розділі «API-ключі» ключ із префіксом jg-.
Крок 3: запустити інсталятор.
npx @joingonka/setup --tool qwen-codeІнсталятор запитає ключ (в аргументах командного рядка він не передається, щоб не осісти в історії оболонки) і відредагує ~/.qwen/settings.json — файл, який документація Qwen Code пропонує для налаштування «в одному файлі»:
- впише ключ у блок
envсамого файлу під іменемJOINGONKA_API_KEY— туди ж кладе ключі власна команда/auth; файл отримає права600, середовище оболонки не змінюється; - додасть моделі мережі до списку
modelProviders.openai— з адресою шлюзу, справжніми вікнами контексту й стелями відповіді; записи інших ваших провайдерів у цьому списку збережуться; - якщо тип авторизації не вибрано або він усе ще вказує на закритий
qwen-oauth, переключить його наopenaiі зробить моделлю за замовчуванням DeepSeek V4 Flash; робочий вибір іншого типу —anthropic,gemini,vertex-ai— без прапорця--modelне чіпає; - збереже копію попереднього файлу, не торкнеться коментарів та інших налаштувань, а наприкінці надішле живий запит на шлюз і скаже, чи прийнято ключ, адресу й модель.
Так виглядав вивід на інсталяції, де залишався qwen-oauth (скорочено):
Configured ~/.qwen/settings.json
Base URL: https://gate.joingonka.ai/v1
Default model: deepseek-ai/DeepSeek-V4-Flash-0731 (replaces qwen-oauth — that free tier was discontinued on 2026-04-15)
Switched Qwen Code to JoinGonka (auth type "openai") — this replaced your previous auth type "qwen-oauth".
To go back: run /auth (and /model) inside Qwen Code, or restore ~/.qwen/settings.json.bak.2026-09-23T04-22-32-159Z.
…
✓ Verified: the gateway accepted the key, base URL and model.Іншу модель за замовчуванням задає прапорець --model: скорочення glm, minimax або повний ідентифікатор; явно вказана модель записується завжди. Режим без запитань бере ключ зі змінної середовища:
JOINGONKA_API_KEY=jg-your-key npx @joingonka/setup --tool qwen-code --model glm --non-interactiveКаталог, перенесений змінною QWEN_HOME, інсталятор знаходить сам. Повторний запуск оновить каталог моделей, а вибрану вами модель мережі залишить: Kept your current default model.
Ручне налаштування: settings.json
Все, що робить інсталятор, можна написати руками. Файл — ~/.qwen/settings.json (або $QWEN_HOME/settings.json); Qwen Code читає його як JSON з коментарями. Робоча конфігурація для мережі Gonka повністю:
{
"env": { "JOINGONKA_API_KEY": "jg-your-key" },
"modelProviders": {
"openai": [
{ "id": "deepseek-ai/DeepSeek-V4-Flash-0731", "name": "DeepSeek V4 Flash (Gonka)",
"baseUrl": "https://gate.joingonka.ai/v1", "envKey": "JOINGONKA_API_KEY",
"generationConfig": { "contextWindowSize": 380000, "samplingParams": { "max_tokens": 32768 } } },
{ "id": "zai-org/GLM-5.3-Flash", "name": "GLM 5.3 Flash (Gonka)",
"baseUrl": "https://gate.joingonka.ai/v1", "envKey": "JOINGONKA_API_KEY",
"generationConfig": { "contextWindowSize": 390000, "samplingParams": { "max_tokens": 8192 } } },
{ "id": "MiniMaxAI/MiniMax-M2.7", "name": "MiniMax M2.7 (Gonka)",
"baseUrl": "https://gate.joingonka.ai/v1", "envKey": "JOINGONKA_API_KEY",
"generationConfig": { "contextWindowSize": 200000, "samplingParams": { "max_tokens": 8192 } } }
]
},
"security": { "auth": { "selectedType": "openai" } },
"model": { "name": "deepseek-ai/DeepSeek-V4-Flash-0731", "baseUrl": "https://gate.joingonka.ai/v1" }
}| Поле | Значення | Що важливо |
|---|---|---|
env.JOINGONKA_API_KEY | ключ jg-… | Сам ключ. У записі моделі поля для ключа немає — вона посилається на цю змінну через envKey |
baseUrl | https://gate.joingonka.ai/v1 | З /v1 на кінці: шлях /chat/completions Qwen Code дописує сам. Ключ списку openai — це і є протокол Chat Completions |
contextWindowSize | вікно моделі | Без нього Qwen Code оцінить вікно за назвою моделі; за цим числом він вирішує, коли стискати історію |
samplingParams.max_tokens | стеля відповіді | Фіксує ліміт відповіді. Без нього, впершись у ліміт, Qwen Code може повторити запит з лімітом від 64K — вище за стелю будь-якої моделі мережі |
security.auth.selectedType | openai | Який протокол вмикати при старті; без поля Qwen Code іде в закритий qwen-oauth |
model.name, model.baseUrl | модель за замовчуванням і її адреса | Пара однозначно вказує на запис шлюзу, навіть якщо модель з тим самим id заведена в іншого провайдера |
Де тримати ключ. Значення змінної з envKey Qwen Code шукає по порядку: оточення оболонки, потім перший знайдений .env (.qwen/.env або .env від поточного каталогу вгору, далі ~/.qwen/.env і ~/.env) і лише потім блок env файлу. Звідси головна пастка: експортована в оболонці JOINGONKA_API_KEY зі старим значенням переб'є файл — ми перевірили це навмисно й отримали 401 Invalid API key при правильному ключі в settings.json. Інсталятор попереджає, коли бачить в оточенні інше значення.
І застереження щодо проєктів: проєктний .qwen/settings.json з власним modelProviders не доповнює, а замінює список із домашнього каталогу — усередині такого проєкту моделі шлюзу зникнуть із /model. Класти ключ у проєктний файл не варто взагалі: разом із ним він потрапить у репозиторій.
Правки modelProviders запущена сесія підхоплює без перезапуску — досить заново відкрити /model. Без редактора те саме робить майстер /auth → Custom Provider.
Авторизація та моделі: як Qwen Code обирає, чим працювати
У Qwen Code два незалежні вибори: тип авторизації — який протокол увімкнути та звідки брати ключі — та модель. Тип зберігається в security.auth.selectedType, і від нього залежить, як вчинить інсталятор:
Що стоїть у selectedType | Що зробить інсталятор |
|---|---|
нічого або qwen-oauth | Встановить openai та модель за замовчуванням з мережі Gonka; закритий тариф робочим вибором не вважається, але інсталятор напише, що замінив і як повернути |
openai | Вибрану модель — шлюзу або іншого провайдера — залишить, оновить лише каталог |
anthropic, gemini, vertex-ai | Не чіпатиме: це робоча зв'язка. З прапором --model перемкне і напише, як повернути попередню |
Всередині сесії модель змінює команда /model. У нашому прогоні вона показала всі записи шлюзу з міткою протоколу, а під списком — вікно контексту, адресу та ім'я змінної з ключем:
Select Model
1. [openai] MiniMax M2.7 (Gonka) (MiniMaxAI/MiniMax-M2.7)
› 2. [openai] DeepSeek V4 Flash (Gonka) (deepseek-ai/DeepSeek-V4-Flash-0731)
3. [openai] GLM 5.3 Flash (Gonka) (zai-org/GLM-5.3-Flash)
Modality: text-only
Context Window: 380,000 tokens
Base URL: https://gate.joingonka.ai/v1
API Key: JOINGONKA_API_KEYВибір з /model зберігається між сесіями. На один запуск модель задає прапор -m з ідентифікатором: qwen -m zai-org/GLM-5.3-Flash. Окрему легку модель для підказок та класифікатора дозволів задає /model --fast; поки її немає, цю роботу виконує основна.
Яку модель вибрати. Ціна у всіх моделей мережі одна, тому вибір — про поведінку. Так вони поводилися в Qwen Code 0.24.4 на одному й тому ж завданні — прочитати файл і знайти помилку (звірено 23 вересня 2026):
| Модель | Контекст / відповідь | Як поводиться в Qwen Code |
|---|---|---|
| DeepSeek V4 Flash | 380K / 32768 | Вибір інсталятора: велике вікно і найвищий поріг відповіді в мережі. Завдання вирішила за два ходи |
| GLM-5.3 Flash | 390K / 8192 | Модель, що міркує: найакуратніша відповідь, міркування приходить окремим потоком і входить у ліміт відповіді |
| MiniMax M2.7 | 200K / 8192 | Вірна відповідь за два ходи та близько семи секунд; міркування приходить окремим потоком і в текст відповіді не потрапляє |
Міркування у GLM-5.3 Flash. Інсталятор задає кожній моделі samplingParams, а в цьому випадку Qwen Code не додає в запит рівень міркування: команда /effort до моделей мережі не доходить, і GLM-5.3 Flash думає завжди. Якщо потрібен перемикач, оголосіть рівні прямо в записі моделі:
{
"id": "zai-org/GLM-5.3-Flash",
"capabilities": {
"reasoning": { "profile": "openai-effort", "efforts": ["low", "high"], "defaultEffort": "high" }
},
…
}Тоді Qwen Code почне надсилати reasoning_effort, а у GLM-5.3 Flash значення low вимикає міркування повністю — деталі в огляді моделі. У нашому прогоні з "defaultEffort": "low" Qwen Code надіслав reasoning_effort: "low", і модель відповіла без блоку міркувань.
Перевірка: що має відбутися
Найшвидша перевірка — одноразовий прогін. Покладіть у порожній каталог calc.py з функцією додавання, яка насправді віднімає, і попросіть знайти помилку:
qwen -p "Read calc.py and tell me in one sentence whether it has a bug."Агент має сам викликати інструмент читання й відповісти по суті. Так відповіла GLM-5.3 Flash (запуск з -m zai-org/GLM-5.3-Flash):
Yes, there is a bug: the `add` function subtracts instead of adding (`return a - b`), so `print(add(2, 3))` prints `-1` instead of `5`.В інтерфейсі (qwen без аргументів) шапка покаже вибрану модель — API Key | DeepSeek V4 Flash (Gonka), — а той самий запит відпрацює так:
> Read calc.py and tell me in one sentence whether it has a bug.
✓ Read calc.py, README.md
◆ Yes, calc.py has a bug: the add function returns the difference (a - b) instead of the sum (a + b). …
➜ demo · DeepSeek V4 Flash (Gonka) · 380.0k Context 5.1% usedКоманда /stats покаже запити й токени за моделями, а кабінет шлюзу — ту саму витрату в розділі «Использование».
Режим схвалення в -p. Без флагів одноразовий прогін іде в режимі Ask Permissions: підтверджувати нікому, тому інструменти, яким потрібен дозвіл, — команди оболонки, правка й запис файлів — моделі просто не передаються. На прохання виконати ls агент у нашому прогоні відповів, що такого інструмента в нього немає. Для правок додайте --approval-mode auto-edit, для команд — --yolo; останній Qwen Code супроводжує попередженням, що пісочниця не ввімкнена.
Якщо щось пішло не так, діагноз зазвичай читається прямо з повідомлення:
| Що видно | Що це означає | Що зробити |
|---|---|---|
No auth type is selected. Please configure an auth type … | Тип авторизації не вибрано | Запустіть інсталятор або впишіть "selectedType": "openai", як у прикладі вище |
Qwen OAuth free tier was discontinued on 2026-04-15 … | У налаштуваннях залишився закритий qwen-oauth | Запустіть інсталятор: він переключить тип і скаже, що замінив |
[API Error: 401 Invalid API key] | Шлюз не прийняв ключ | Перевірте блок env і чи немає в оболонці або в .env змінної JOINGONKA_API_KEY зі старим значенням: вона головніша за файл |
429 Model "…" is currently overloaded in the Gonka network (rate limit) | У моделі в мережі закінчилася вільна ємність | Повторіть за хвилину або змініть модель; стан видно на сторінці статусу |
Request timeout after 151s …, потім Retrying provider attempt | Мережа під навантаженням не почала відповідати за дві з половиною хвилини | Qwen Code повторить запит сам; затягнулося — змініть модель |
Скільки це коштує
Агент витрачає токени інакше, ніж чат: до кожної вашої фрази Qwen Code додає системний промпт і описи інструментів, а завдання займає кілька кроків. У нашому прогоні кожен запит qwen -p ніс близько 13 тисяч вхідних токенів ще до суті справи, а «прочитай файл, знайди помилку» зайняла два кроки і близько 27 тисяч токенів. В інтерфейсі інструментів більше, і після відповіді Qwen Code тією ж моделлю робить службові запити — наприклад, підказку наступної репліки: /stats показав для того ж завдання 4 запити і близько 79 тисяч вхідних токенів.
Через JoinGonka Gateway токени коштують $0.0069 за мільйон на вході та $0.021 за мільйон на виході — ціна однакова для всіх моделей мережі і підставляється на цій сторінці з живого джерела.
| Сценарій | Витрати | Через Gateway |
|---|---|---|
Разове завдання в qwen -p: прочитати файл, знайти помилку | ~27K токенів | соті частки цента |
| Те ж завдання в інтерфейсі, зі службовими запитами | ~79K токенів | соті частки цента |
| День активної роботи | 3-7M токенів | кілька центів |
| Місяць активної розробки | ~150M токенів | близько долара |
Оцінки в правій колонці — за цінами на вересень 2026. Для порівняння — як взагалі можна платити за моделі в Qwen Code:
| Спосіб | Модель оплати | Що обмежує |
|---|---|---|
qwen-oauth | був безкоштовним | закрито 15 квітня 2026 року |
| Alibaba Cloud Coding Plan | фіксована сума на місяць | квоти на стороні вендора, окремий ключ sk-sp-… |
| Alibaba Cloud Token Plan | за токени, для команд і компаній | регіональний endpoint і ключ Alibaba Cloud |
| JoinGonka Gateway | за токени, передплачений баланс | витрати видно в кабінеті; підписок і місячних квот немає |
Службові запити вимикаються, де не потрібні: підказки наступної репліки — "ui": { "enableFollowupSuggestions": false }, фонова авто-пам'ять — "memory": { "enableManagedAutoMemory": false, "enableManagedAutoDream": false }. Точні витрати і залишок — в кабінеті, в розділах «Використання» та «Білінг». Чому за замовчуванням обрана DeepSeek V4 Flash, докладно розібрано в огляді моделі.
Що врахувати в роботі
Режими схвалення. В інтерфейсі Qwen Code стартує в режимі Auto: читання, пошук і правки всередині проєкту дозволені відразу, а команди оболонки та інші ризиковані дії оцінює класифікатор — окремий запит до моделі. Інші режими — Plan, Ask Permissions, Auto-Edit і YOLO — перемикаються через Shift+Tab (у Windows — Tab) або командою /approval-mode; режим за замовчуванням задає ключ tools.approvalMode.
Фонова робота. За замовчуванням Qwen Code веде авто-пам'ять: після розмов фоном витягує нотатки про проєкт і ваші вподобання, а раз на день чистить їх (Dream) — тією ж моделлю. У разовому прогоні це помітно: qwen -p може не завершуватися ще кілька хвилин після відповіді, поки фонова задача чекає на модель. Для скриптів і CI вимкніть авто-пам'ять (ключі — у розділі вище) і ставте стелі прогону: --max-wall-time, --max-session-turns, --max-tool-calls.
Зображення. Моделі мережі текстові (Modality: text-only в /model). Для скриншотів призначте модель-посередника іншого провайдера командою /model --vision: вона перекаже зображення текстом, а працювати далі буде основна модель.
Статистика. Анонімну статистику використання Qwen Code надсилає за замовчуванням; вимикає її "privacy": { "usageStatisticsEnabled": false }. Шлюз не зберігає вміст промптів і відповідей — лише агрегати витрат.
Сусіди по мережі. Своїх агентів випускають і лабораторії, чиї моделі обслуговує мережа: у DeepSeek це DeepSeek Harness, у MiniMax — MiniMax Code, у Z.ai, авторів GLM, — ZCode. Усі вони підключаються до того ж шлюзу з тим же ключем і витрачають один баланс.
qwen-oauth йому потрібен власний постачальник моделей. Швидкий шлях — npx @joingonka/setup --tool qwen-code: інсталятор впише ключ у блок env файлу ~/.qwen/settings.json, додасть у modelProviders.openai DeepSeek V4 Flash, GLM-5.3 Flash та MiniMax M2.7 зі справжніми лімітами, перемкне security.auth.selectedType на openai і перевірить зв'язку живим запитом. Працюють усі три моделі мережі: за замовчуванням стоїть DeepSeek V4 Flash, а GLM-5.3 Flash та MiniMax M2.7 обираються командою /model. Перевірка — qwen -p на файлі з помилкою і розділ «Використання» в кабінеті; платіть за фактичні токени за єдиною ціною мережі Gonka.Бажаєте дізнатися більше?
Вивчіть інші розділи або почніть заробляти GNK прямо зараз.
Отримати ключ та безкоштовні токени →