Розділи бази знань ▾
Навігація
▸ Почніть тут За ролямиКатегорії
- Cursor + Gonka AI — дешевий LLM для кодування
- Claude Code + Gonka AI — LLM для терміналу
- OpenClaw + Gonka AI — доступні AI-агенти
- OpenCode + Gonka AI — безкоштовний AI для коду
- Continue.dev + Gonka AI — AI для VS Code/JetBrains
- Cline + Gonka AI — AI-агент у VS Code
- Aider + Gonka AI — парне програмування з AI
- LangChain + Gonka AI — AI-додатки за копійки
- n8n + Gonka AI — автоматизація з дешевим AI
- Open WebUI + Gonka AI — свій ChatGPT
- LibreChat + Gonka AI — open-source ChatGPT
- Hermes Agent + Gonka AI — автономний агент за копійки
- Kilo Code + Gonka AI — AI-агент у VS Code
- Roo Code + Gonka AI — автономний AI-агент у VS Code
- LlamaIndex + Gonka AI — RAG-додатки за копійки
- PydanticAI + Gonka — типізовані AI-агенти за копійки
- Vercel AI SDK + Gonka AI — AI-додатки на TypeScript за копійки
- TanStack AI + Gonka — AI-додатки на TypeScript за копійки
- API швидкий старт — curl, Python, TypeScript
- JoinGonka Gateway — повний огляд
- Management Keys — SaaS на Gonka
- Найдешевший AI API: порівняння провайдерів 2026
- Ліміт запитів Cursor Pro вичерпано — розбір та дешева альтернатива
- Claude Code дешевше — розбір рахунку та перемикання
- Cline спалює гроші — чому агент витрачає так багато
- OpenClaw дорого обходиться — чому агент спалює токени і як заощадити
- OpenRouter: дешева альтернатива — порівняння з JoinGonka Gateway
- Найкраща AI-модель для кодингу у 2026: порівняння та ціни
- Дешева альтернатива GitHub Copilot без лімітів
- Дешева альтернатива Windsurf без кредитів і лімітів
- Найдешевший API для AI-агентів у 2026
- ZCode: дешевий GLM-інференс замість GLM Coding Plan
Інструменти
Hermes Agent + Gonka AI — автономний агент за копійки
Hermes Agent — самонавчальний AI-агент з відкритим кодом від Nous Research (MIT-ліцензія). Це не просто чат: повноцінний термінальний CLI з пам'яттю, навичками (skills), планувальником завдань і шлюзом у Telegram, Discord, Slack та WhatsApp. Агент створює навички з досвіду, шукає по минулих діалогах і будує модель користувача між сесіями. Запускається хоч на VPS за $5, хоч на GPU-кластері.
Проблема Hermes — та сама, що у будь-якого агентного інструменту: витрата токенів. Агент читає файли, ганяє цикли tool-calling, стискає контекст, веде пам'ять — на активну роботу легко йдуть десятки мільйонів токенів. На моделях Anthropic або OpenAI ($3-15 за 1M) це перетворюється на десятки та сотні доларів за день автономної роботи.
Hermes за замовчуванням підтримує будь-який провайдер: Nous Portal, OpenRouter, OpenAI, Anthropic — або ваш власний endpoint. Це і є точка входу для JoinGonka Gateway: наш OpenAI-сумісний шлюз віддає інференс децентралізованої мережі Gonka за ціною від $0.003 за 1M токенів — у сотні й тисячі разів дешевше. Hermes стає справді повсякденним інструментом, а не дорогою демонстрацією.
Крок 1: Встановити Hermes та отримати ключ
Встановлення Hermes (Linux, macOS, WSL2). Офіційний інсталятор сам підтягне Python, Node.js, ripgrep і ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Після встановлення перезавантажте шелл і перевірте запуск:
source ~/.bashrc # або ~/.zshrc
hermes # інтерактивний CLIAPI-ключ JoinGonka: якщо ще немає — зареєструйтесь на gate.joingonka.ai/register, отримайте 10M безкоштовних токенів та створіть ключ з префіксом jg- у Dashboard. Один ключ і один баланс працюють одразу для всіх моделей.
Крок 2: Підключити Gonka як custom-провайдер
Hermes працює з будь-яким OpenAI-сумісним endpoint: якщо сервер відповідає на /v1/chat/completions — Hermes можна на нього спрямувати. Gateway JoinGonka саме такий. Є два способи налаштування.
Спосіб 1: майстер налаштування (рекомендується). Запустіть у терміналі поза активною сесією:
hermes modelУ списку провайдерів оберіть «Custom endpoint (self-hosted / VLLM / etc.)» та введіть три значення:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-ваш-ключ - Model name:
MiniMaxAI/MiniMax-M2.7
Спосіб 2: редагування конфігу. Hermes зберігає налаштування моделей у ~/.hermes/config.yaml — це єдине джерело істини. Додайте секцію:
# ~/.hermes/config.yaml
model:
provider: custom
default: MiniMaxAI/MiniMax-M2.7
base_url: https://gate.joingonka.ai/v1
api_key: jg-ваш-ключПеревірка: запустіть hermes і напишіть «Створи файл hello.py з функцією hello world». Агент повинен створити файл і показати результат. Стан поточної конфігурації видно через hermes config show | grep '^model\.' та hermes status.
Перемикання на льоту: всередині сесії командою /model custom:MiniMaxAI/MiniMax-M2.7. А /model custom без імені сам підтягне модель з endpoint, якщо вона там одна.
Порівняння вартості автономних сесій
Hermes — агентний інструмент з пам'яттю та навичками. Він не відповідає однією реплікою: читає файли, пише код, запускає команди, стискає контекст, веде довгі фонові завдання через планувальник. Кожна дія — це API-виклик, і за день автономної роботи накопичуються десятки мільйонів токенів. Порівняємо вартість типових сесій:
| Завдання | Токенів | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Разове завдання з tool-calling | ~5M | $15 — $75 | $0.024 |
| Фоновий агент (кілька годин) | ~20M | $60 — $300 | $0.096 |
| Автономна розробка фічі | ~50M | $150 — $750 | $0.24 |
| Доба роботи через шлюз (Telegram + cron) | ~150M | $450 — $2,250 | $0.72 |
З JoinGonka Gateway Hermes можна тримати запущеним цілодобово: нічні звіти, щотижневі аудити, фонові завдання через cron-планувальник — не озираючись на рахунок. За цінами Anthropic кожен такий запуск довелося б рахувати вручну. 10M безкоштовних токенів при реєстрації вистачить на десятки повноцінних сесій.
Вибір моделі та tool calling
Через Gateway користувачеві відразу доступні дві моделі Gonka — обидві підтримують нативний tool calling (OpenAI function calling), тому навички та інструменти Hermes працюють надійно, без парсингу текстових відповідей:
| Model name (для config) | Контекст | Макс. відповідь | Коли обирати |
|---|---|---|---|
moonshotai/Kimi-K2.6 | 200K | 8192 | Дефолт — сильні міркування, кодинг та агентні сценарії |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Довгий контекст, довгі ланцюжки tool-calling |
Про ліміти токенів у Hermes. У config.yaml поле context_length — це повне контекстне вікно (вхід + вихід), а max_tokens — стеля лише на довжину відповіді. Обидва краще не задавати: Hermes сам визначить коректні значення від провайдера. Якщо задаєте max_tokens вручну, тримайте його в межах моделі — для обох моделей максимум через Gateway дорівнює 8192. Змінити модель у будь-який момент можна командою hermes model або прямо в сесії через /model.
Схожі термінальні інструменти в нашій базі знань: Claude Code, Cline.
Бажаєте дізнатися більше?
Вивчіть інші розділи або почніть заробляти GNK прямо зараз.
Отримати безкоштовні 10M токенів →