Sekcje bazy wiedzy ▾
Nawigacja
▸ Zacznij tutaj Według rólKategorie
- Cursor + Gonka AI — tani LLM do kodowania
- Claude Code + Gonka AI — LLM dla terminala
- OpenClaw + Gonka AI — dostępne agenty AI
- OpenCode: własny model w terminalu
- Continue.dev + Gonka AI — AI dla VS Code/JetBrains
- Cline + Gonka AI — agent AI w VS Code
- Aider + Gonka AI — programowanie w parach z AI
- LangChain + Gonka AI — aplikacje AI za grosze
- n8n + Gonka AI — automatyzacja z tanim AI
- Open WebUI + Gonka AI — Twój własny ChatGPT
- LibreChat + Gonka AI — open-source ChatGPT
- Hermes Agent + DeepSeek w sieci Gonka — autonomiczny agent za grosze
- Kilo Code + Gonka AI — agent AI w VS Code
- Roo Code + Gonka AI — autonomiczny agent AI w VS Code
- LlamaIndex + Gonka AI — aplikacje RAG za grosze
- PydanticAI + Gonka — typowane agenty AI za grosze
- Vercel AI SDK + Gonka AI — aplikacje AI w TypeScript za grosze
- TanStack AI + Gonka — aplikacje AI w TypeScript za grosze
- API szybki start — curl, Python, TypeScript
- JoinGonka Gateway — pełny przegląd
- Klucze Zarządzania — SaaS na Gonka
- Najtańsze AI API: porównanie dostawców 2026
- Limit zapytań Cursor Pro wyczerpany — analiza i tania alternatywa
- Claude Code taniej — analiza rachunku i przełączenie
- Cline spala pieniądze — dlaczego agent wydaje tak dużo
- OpenClaw jest drogi — dlaczego agent zużywa tokeny i jak zaoszczędzić
- OpenRouter: tania alternatywa — porównanie z JoinGonka Gateway
- Najlepszy model AI do kodowania w 2026 roku: porównanie i ceny
- Tania alternatywa dla GitHub Copilot bez limitów
- Tania alternatywa dla Windsurf bez kredytów i limitów
- Najtańsze API dla agentów AI w 2026 roku
- ZCode: tania inferencja GLM zamiast GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — własny endpoint zamiast kredytów
- GitHub Copilot BYOK — własne modele zamiast limitów
- Zed + JoinGonka Gateway — tani inferencing w edytorze
- Pi + JoinGonka Gateway — terminalowy agent na tanim inference
- Codex CLI: własny klucz zamiast subskrypcji
Narzędzia
Hermes Agent + DeepSeek w sieci Gonka — autonomiczny agent za grosze
Hermes Agent — samouczący się agent AI z otwartym kodem od Nous Research (licencja MIT). To nie tylko czat: pełnowartościowy terminalowy CLI z pamięcią, umiejętnościami (skills), planistą zadań i bramką (gateway) do Telegram, Discord, Slack i WhatsApp. Agent tworzy umiejętności na podstawie doświadczeń, przeszukuje poprzednie dialogi i buduje model użytkownika między sesjami. Uruchamia się zarówno na VPS za $5, jak i na klastrze GPU.
Problem Hermes jest taki sam, jak w każdym narzędziu agentskim: zużycie tokenów. Agent czyta pliki, uruchamia pętle tool-calling, kompresuje kontekst, zarządza pamięcią — przy aktywnej pracy łatwo zużyć dziesiątki milionów tokenów. Przy modelach Anthropic lub OpenAI ($3-15 za 1M) zmienia się to w dziesiątki i setki dolarów za dzień autonomicznej pracy.
Hermes domyślnie wspiera dowolnego dostawcę: Nous Portal, OpenRouter, OpenAI, Anthropic — lub twój własny endpoint. To właśnie punkt wejścia dla JoinGonka Gateway: nasza bramka kompatybilna z OpenAI dostarcza inferencję zdecentralizowanej sieci Gonka w cenie od $0.0069 za 1M tokenów — setki i tysiące razy taniej. Hermes staje się prawdziwie codziennym narzędziem, a nie drogą demonstracją.
Krok 1: Zainstaluj Hermes i uzyskaj klucz
Instalacja Hermes (Linux, macOS, WSL2). Oficjalny instalator automatycznie pobierze Python, Node.js, ripgrep oraz ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Po instalacji zrestartuj powłokę (shell) i sprawdź działanie:
source ~/.bashrc # lub ~/.zshrc
hermes # interaktywne CLIKlucz API JoinGonka: jeśli jeszcze go nie masz — zarejestruj się na gate.joingonka.ai/register, potwierdź swój adres — na Twoje konto trafi 3M darmowych tokenów — i wygeneruj klucz z prefiksem jg- w Dashboardzie. Jeden klucz i jedno saldo działają od razu dla wszystkich modeli.
Krok 2: Podłącz Gonka jako niestandardowego dostawcę
Hermes współpracuje z dowolnym endpointem zgodnym z OpenAI: jeśli serwer odpowiada na /v1/chat/completions — Hermes może być na niego skierowany. Gateway JoinGonka jest właśnie taki. Istnieją trzy sposoby konfiguracji.
Sposób 1: nasz instalator (jedna komenda, zalecane). Wpisze dostawcę do configu Hermes, ustawi DeepSeek V4 Flash jako model domyślny i sprawdzi na żywo, czy gateway akceptuje klucz i model:
npx @joingonka/setup --tool hermesSposób 2: kreator konfiguracji. Uruchom w terminalu poza aktywną sesją:
hermes modelNa liście dostawców wybierz „Custom endpoint (self-hosted / VLLM / etc.)” i wprowadź trzy wartości:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-twój-klucz - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
Sposób 3: edycja configu. Hermes przechowuje ustawienia modeli w ~/.hermes/config.yaml — to jedyne źródło prawdy. Dodaj sekcję:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-twój-klucz⚠️ Klucz — tylko w model.api_key. Dokumentacja Hermes dopuszcza OPENAI_API_KEY w ~/.hermes/.env, ale dla customowego endpointu to nie działa: Hermes odczytuje klucz tylko z model.api_key, a z kluczem w .env gateway odpowie 401 Invalid API key. Sprawdzone na Hermes v0.20.4.
Weryfikacja: uruchom hermes i napisz „Utwórz plik hello.py z funkcją hello world”. Agent powinien utworzyć plik i pokazać wynik. Stan bieżącej konfiguracji widać przez hermes config show | grep '^model\.' i hermes status.
Przełączanie w locie: wewnątrz sesji komendą /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. A /model custom bez nazwy sam zaciągnie model z endpointu, jeśli jest tam tylko jeden.
Porównanie kosztów autonomicznych sesji
Hermes to narzędzie agencyjne z pamięcią i umiejętnościami. Nie odpowiada jedną kwestią: czyta pliki, pisze kod, uruchamia komendy, kompresuje kontekst, prowadzi długie zadania w tle przez harmonogram. Każda akcja to wywołanie API, a w ciągu dnia autonomicznej pracy gromadzą się dziesiątki milionów tokenów. Porównajmy koszty typowych sesji:
| Zadanie | Tokeny | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Pojedyncze zadanie z tool-calling | ~5M | $15 — $75 | $0.048 |
| Agent w tle (kilka godzin) | ~20M | $60 — $300 | $0.19 |
| Autonomiczna budowa funkcji | ~50M | $150 — $750 | $0.48 |
| Doba pracy przez bramę (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
Z JoinGonka Gateway Hermes można utrzymywać uruchomionego przez całą dobę: raporty nocne, cotygodniowe audyty, zadania w tle przez harmonogram cron — bez martwienia się o rachunek. Przy cenach Anthropic każde takie uruchomienie musiałoby być liczone ręcznie. Saldo startowe przy rejestracji wystarcza, aby uruchomić agenta w rzeczywistym zadaniu i zobaczyć własne zużycie przed pierwszym doładowaniem.
Wybór modelu i tool calling
Poprzez Gateway użytkownik ma od razu dostęp do trzech modeli Gonka — wszystkie one wspierają natywne tool calling (OpenAI function calling), dlatego umiejętności i narzędzia Hermes działają niezawodnie, bez konieczności parsowania odpowiedzi tekstowych:
| Model name (dla config) | Kontekst | Max. odpowiedź | Kiedy wybierać |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Domyślny dla Hermes: jeden z najdłuższych kontekstów w sieci i czterokrotnie większy limit odpowiedzi — agent utrzymuje długie łańcuchy tool-calling i duże pliki w jednym przebiegu |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Równy uniwersalny model do krótkich zadań i szybkich poprawek |
zai-org/GLM-5.3-Flash | 390K | 8192 | Model reasoning z najdłuższym kontekstem w sieci: myśli przed udzieleniem odpowiedzi — do zawiłej logiki; część odpowiedzi jest przeznaczona na rozumowanie, więc nie zaniżaj limitu odpowiedzi |
O limitach tokenów w Hermes. W config.yaml pole context_length — to pełne okno kontekstowe (wejście + wyjście), a max_tokens — limit tylko na długość odpowiedzi. Obu lepiej nie ustawiać: Hermes sam określi poprawne wartości od dostawcy. Jeśli ustawiasz max_tokens ręcznie, trzymaj go w granicach modelu: przez Gateway jest to 32768 dla DeepSeek V4 Flash i 8192 dla MiniMax M2.7 oraz GLM-5.3 Flash. Zmienić model w dowolnym momencie można komendą hermes model lub bezpośrednio w sesji przez /model.
Podobne narzędzia terminalowe w naszej bazie wiedzy: Claude Code, Cline.
Chcesz wiedzieć więcej?
Zapoznaj się z innymi sekcjami lub zacznij zarabiać GNK już teraz.
Odbierz darmowy saldo na start →