Sekcje bazy wiedzy ▾

Nawigacja

▸ Zacznij tutaj Według ról

Kategorie

Narzędzia 52
Słownik 12

Narzędzia

Warp + JoinGonka Gateway — agent terminalowy na własnym endpoint

Warp — terminal, który przekształcił się w środowisko programowania agentowego: wbudowany Warp Agent odczytuje dane wyjściowe poleceń, edytuje pliki, uruchamia buildy i prowadzi zadanie od zapytania do rezultatu. Domyślnie agent pracuje na modelach sprzedawanych przez samego Warp — w ramach kredytów taryfowych — a korzystanie z własnego inferencingu przez długi czas było możliwe tylko w płatnych planach i tylko przy użyciu klucza OpenAI, Anthropic lub Google. 20 maja 2026 r. Warp udostępnił BYOK w darmowej taryfie i dodał custom inference endpoint — podłączenie dowolnego serwisu obsługującego OpenAI Chat Completions.

Druga metoda jest potrzebna, aby skierować agenta Warp przez JoinGonka Gateway: bramka udostępnia modele zdecentralizowanej sieci Gonka za pośrednictwem API kompatybilnego z OpenAI, inferencing opłacany jest według rzeczywistych cen sieci, a w przypadku indywidualnych programistów i małych zespołów kredyty Warp nie są na niego zużywane. Po rejestracji i potwierdzeniu adresu na konto wpłynie 3M darmowych tokenów — wystarczą one, aby wypróbować agenta we własnych zadaniach przed pierwszym doładowaniem.

Poniżej znajdziesz informacje o tym, co jest potrzebne przed rozpoczęciem, jakie wartości wpisać w formularz Warp, jak upewnić się, że zapytania przechodzą przez bramkę, jaki model sieci wybrać do zadań terminalowych oraz co warto wiedzieć o trasie zapytań: w Warp działa ona inaczej niż w większości narzędzi.

Co będzie potrzebne: klucz, taryfa Warp i publiczny adres

Klucz JoinGonka. Zarejestruj się na bramce, otwórz w panelu sekcję „Klucze API” i kliknij „Stwórz klucz”. Klucz zaczyna się od jg- i jest wyświetlany tylko raz — zapisz go od razu. Wygodnie jest utworzyć osobny klucz dla Warp: wtedy w sekcji „Użycie” zużycie agenta terminalowego będzie widoczne w osobnej linii, a nie pomieszane z innymi narzędziami.

Taryfa Warp. Własny endpoint jest dostępny nie tylko w płatnych planach — warunki zależą od wielkości zespołu:

Kto podłączaCzy własny endpoint jest dostępnyCo z kredytami Warp
Pojedynczy programista lub firma do 10 osób (plany Free, Build, Max)Tak, w każdym z tych planówZa inferencing przez własny endpoint kredyty nie są pobierane
Organizacja powyżej 10 osóbTylko w Business lub EnterpriseLokalne uruchomienia agenta zużywają platform credits — opłatę za infrastrukturę Warp według obniżonej stawki; sam inferencing opłacany jest dostawcy endpoint

Publiczny adres HTTPS. To wymaganie Warp, o którym łatwo nie pomyśleć: zapytania do Twojego endpointu wysyła nie aplikacja na Twojej maszynie, a serwery Warp, dlatego adres musi być dostępny z internetu. localhost, 127.0.0.1 oraz adresy sieci prywatnych są odrzucane przez formularz, a schemat jest dozwolony tylko jako https://. JoinGonka Gateway to publiczny serwis HTTPS, więc tunele typu ngrok, które dokumentacja Warp zaleca dla modeli lokalnych, nie są tutaj potrzebne.

Świeża wersja aplikacji. Własny endpoint został włączony w stabilnej wersji od wydania 20 maja 2026 r., wybór schematu API w formularzu pojawił się w wydaniu 31 lipca 2026 r. Jeśli pola API schema nie ma w formularzu — zaktualizuj Warp.

Połączenie: formularz Add custom endpoint

Cała konfiguracja odbywa się w interfejsie aplikacji — nie trzeba ręcznie edytować plików.

  1. Otwórz Settings i wpisz w wyszukiwarce ustawień inference endpoint — Warp przejdzie do sekcji z kluczami providerów i własnymi endpointami (znajduje się ona na stronie ustawień Warp Agent).
  2. Kliknij Add custom endpoint — otworzy się formularz.
  3. Wypełnij pola wartościami z tabeli i kliknij Add endpoint.
Pole formularzaCo wpisaćWyjaśnienie
API schemaOpenAI Chat CompletionsDomyślny schemat: to właśnie dla niego dokumentacja Warp opisuje format adresu. Na liście są też OpenAI Responses i Anthropic Messages
Endpoint nameJoinGonkaDowolna nazwa — pod nią endpoint jest widoczny w ustawieniach
Endpoint URLhttps://gate.joingonka.ai/v1Adres bazowy wraz z /v1 — tak samo jak w przykładzie z dokumentacji Warp
API keyjg-your-keyPrzechowywany wyłącznie na urządzeniu, w systemowym magazynie kluczy
Model namedeepseek-ai/DeepSeek-V4-Flash-0731Dokładny identyfikator modelu, taki jaki zwraca brama
Model alias (optional)DeepSeek V4 FlashKrótka nazwa dla przełącznika modeli

Przycisk + Add model dodaje kolejny wiersz. Dodaj od razu wszystkie modele sieci, aby później przełączać się między nimi bez wracania do ustawień: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 i zai-org/GLM-5.3-Flash. Aktualną listę zawsze zwraca GET https://gate.joingonka.ai/v1/models. Identyfikatory wpisuj znak w znak: formularz sprawdza tylko wygląd adresu i wypełnienie pól, nie wykonuje przy zapisie próbnego zapytania, więc literówka w nazwie modelu wyjdzie dopiero w rozmowie z agentem.

Po zapisaniu modele pojawiają się w przełączniku modeli agenta. Jeśli modelem domyślnym pozostał jeden z modeli Warp, aplikacja może sama zaproponować jego zmianę — zgadzaj się i wybierz model swojego endpointu. Ważny szczegół: opcje Auto w przełączniku zawsze działają na infrastrukturze Warp i zużywają jego kredyty, nawet gdy własny endpoint jest skonfigurowany. Aby zapytanie trafiło do bramy, w przełączniku musi być wybrany konkretny model z twojej listy.

Sprawdzanie: czy zapytania przechodzą przez bramę

Wybierz w przełączniku model swojego endpointu i daj agentowi krótkie zadanie, na przykład: „Pokaż pięć największych plików w bieżącym katalogu i wyjaśnij polecenie”. Agent powinien zaproponować polecenie, wykonać je za Twoją zgodą i skomentować wynik.

Teraz otwórz panel bramy, sekcję „Użycie”. W bloku „Według kluczy” przy kluczu założonym dla Warp pojawią się zapytania i czas ostatniego wywołania, w bloku „Według modeli” — wybrany model. Liczniki rosną — czyli inferencja idzie przez JoinGonka Gateway, a nie za kredyty Warp. Ze swojej strony Warp pokazuje zużycie tokenów bezpośrednio w dialogu z agentem — pod tymi krótkimi nazwami, które nadałeś w polu alias.

Jeśli coś poszło nie tak, przyczynę zwykle odczytasz z odpowiedzi:

Co widaćCo to znaczyCo zrobić
401, Invalid API keyBrama nie rozpoznała kluczaSprawdź, czy klucz zaczyna się od jg-, został wklejony bez spacji i jest aktywny w sekcji „Klucze API”; w razie wątpliwości utwórz nowy
404, Invalid URL (POST …)Ścieżka została złożona z dodatkowym segmentem; w treści błędu brama pokazuje, dokąd dokładnie trafiło zapytaniePowinno wyjść /v1/chat/completions. Podwoiło się /v1 albo w adresie znalazła się pełna ścieżka — doprowadź Endpoint URL do postaci z tabeli powyżej
405 Not Allowed lub strona HTML zamiast odpowiedziW adresie brakuje /v1, zapytanie trafiło obok APIDopisz /v1 na końcu adresu
429Model przeciążony: w godzinach szczytu pojemność konkretnego modelu w sieci bywa wyczerpana w całościPowtórz po kilku sekundach albo przełącz się na sąsiedni model — właśnie po to warto założyć je wszystkie naraz
Zapytania przechodzą, ale kredyty Warp topniejąW przełączniku wybrano Auto lub router modeli Warp, a nie model endpointuWybierz konkretny model ze swojej listy
Formularz nie przyjmuje adresuWarp wymaga https:// i publicznego hostaWpisz adres bramy w całości, zaczynając od https://
Model „nie widzi” załączonego obrazkaModele sieci są tekstowe: brama zastępuje obraz tekstową adnotacjąDo zadań ze zrzutami ekranu przełącz się na model z obsługą obrazu, do poleceń i kodu pozostań przy modelu sieci
Model endpointu nie jest dostępny przy uruchomieniu w chmurzeWłasny endpoint jest przechowywany lokalnie i nie rozciąga się na Cloud AgentsUruchom zadanie lokalnym agentem

Pierwsza odpowiedź w sesji może przyjść z opóźnieniem kilku sekund: agent wysyła duży prompt systemowy z opisem narzędzi, a zapytanie przechodzi najpierw przez serwery Warp, a następnie przez węzeł sieci. Dalej dialog idzie szybciej.

Jaki model wybrać dla agenta terminalowego

Cena modeli w sieci jest taka sama, więc wybór dotyczy zachowania, a nie budżetu. Agent terminalowy dużo czyta (wyjście komend, logi, pliki) i stale wywołuje narzędzia; wszystkie modele z tabeli obsługują natywny tool calling.

ModelIdentyfikatorKontekst i odpowiedźKiedy wybrać w Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, odpowiedź do 32768 tokenówDomyślny model dla agenta: długie sesje, duże logi i diffy, poprawki w wielu plikach. Zapas kontekstu i największy limit odpowiedzi w sieci
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, odpowiedź do 8192 tokenówSzybkie krótkie zadania: dobrać komendę, przeanalizować błąd, poprawić konfigurację
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, odpowiedź do 8192 tokenówModel rozumujący (reasoning): myśli przed udzieleniem odpowiedzi. Złożone debugowanie, plan migracji, analiza nieznanego kodu; odpowiedź przychodzi później, a część limitu odpowiedzi jest przeznaczana na rozumowanie

Praktyczny schemat: DeepSeek V4 Flash — model główny, MiniMax M2.7 — do drobiazgów, GLM-5.3 Flash — gdy zadanie opiera się na logice, a nie na objętości. Przełączenie zajmuje sekundę, ponieważ wszystkie modele są już zdefiniowane w endpoint, a krótkie nazwy z pola alias pozwalają uniknąć pomyłek w długich identyfikatorach. Więcej o najpopularniejszym z nich — w przeglądzie DeepSeek V4 Flash.

Ile to kosztuje

W przypadku agenta w terminalu zużycie tokenów jest wyższe niż w czacie: do każdego zapytania Warp dodaje instrukcje systemowe, kontekst dialogu i opis narzędzi, a jedno zadanie składa się z kilku kroków. Dlatego cena za token ma tu większe znaczenie niż w zwykłej korespondencji.

Przez JoinGonka Gateway tokeny kosztują $0.0069 za milion na wejściu i $0.021 za milion na wyjściu — cena jest taka sama dla wszystkich modeli w sieci i jest pobierana na tej stronie z aktualnego źródła. Szacunkowe kwoty cen na wrzesień 2026:

ScenariuszZużyciePrzez Gateway
Jednorazowe zadanie: komenda i analiza jej wyjściadziesiątki tysięcy tokenówułamki centa
Dzień aktywnej pracy z agentem3-7M tokenówkilka centów
Miesiąc codziennej pracy~150M tokenówrzędu jednego-dwóch dolarów

Dla porównania — trzy sposoby opłacania agenta Warp:

SposóbKto liczy inferenceCo ogranicza
Modele WarpWarp, kredytami taryfyMiesięczny zapas kredytów planu
BYOK: klucz OpenAI, Anthropic lub GoogleDostawca modelu wg własnego cennikaCena za milion tokenów u dostawcy
Własny endpoint + JoinGonka GatewayBramka: wg tokenów, z saldaTylko saldo: zużycie widoczne w panelu, brak limitów liczby zapytań

Sam Warp dla osób indywidualnych i zespołów do 10 osób nie pobiera kredytów za pracę przez własny endpoint — płacisz tylko za tokeny na bramce. Saldo jest uzupełniane w panelu, tam też widać pozostałe środki oraz zużycie z podziałem na dni i modele.

Trasa zapytań i prywatność: co warto wiedzieć

W przypadku większości narzędzi własny endpoint oznacza „zapytania idą z mojego komputera bezpośrednio do dostawcy”. W Warp jest inaczej: część wykonawcza agenta działa na serwerach Warp, a własny endpoint zmienia tylko adresata końcowego i klucz. Zgodnie z dokumentacją Warp ścieżka zapytania wygląda następująco:

  1. Aplikacja pobiera adres endpointu i klucz z bezpiecznego magazynu na urządzeniu i wysyła je na serwery Warp wraz z Twoim promptem.
  2. Agent po stronie Warp gromadzi pełne zapytanie — instrukcje systemowe, kontekst rozmowy, narzędzia — i wywołuje Twój endpoint przy użyciu tego klucza.
  3. Odpowiedź wraca do aplikacji strumieniowo przez te same serwery.

Co z tego wynika w praktyce:

  • Klucz. Jest przechowywany tylko na urządzeniu. Przechodzi przez serwery Warp przy każdym zapytaniu, ale według zapewnień Warp nie jest tam zapisywany: jest używany w locie i odrzucany.
  • Prompty i odpowiedzi. Przechodzą tranzytem przez backend Warp. Warp deklaruje, że nie wykorzystuje tej zawartości do uczenia, a przechowywanie i analityka podlegają ustawieniom prywatności i telemetrii Twojego konta. Gwarancji ZDR, która obowiązuje dla modeli samego Warp, nie może rozszerzyć na Twój endpoint: o tym, co przechowuje dostawca, decyduje dostawca.
  • Strona bramy. JoinGonka Gateway nie przechowuje rozmów: prompty i odpowiedzi nie pozostają na bramie po wysłaniu odpowiedzi, w panelu widoczne są tylko liczniki zapytań i tokenów.
  • Co pozostaje na infrastrukturze Warp. Opcje Auto, niestandardowe routery modeli, Codebase Context, podpowiedzi Active AI i agenci w chmurze — na nie własny endpoint nie wpływa.

Jeśli do Twoich zadań ścieżka przez obce serwery jest nieakceptowalna, wybierz agenta, który łączy się z endpointem bezpośrednio z Twojego komputera — na przykład Codex CLI lub dowolne narzędzie z szybkiego startu API. Sam Warp w zapowiedzi obiecuje również wariant kliencki: lekki moduł agenta w Rust w otwartym repozytorium, który będzie łączyć się z lokalnymi modelami bez trasy przez serwery Warp, oraz wsparcie dla Agent Client Protocol. A od wydania z 2 września 2026 r. opisy endpointów są przechowywane w pliku konfiguracyjnym w formacie wspólnym dla aplikacji i Warp Agent CLI; klucze nie trafiają do tego pliku i pozostają w bezpiecznym magazynie.

Warp łączy się z JoinGonka Gateway poprzez formularz Add custom endpoint: schemat OpenAI Chat Completions, adres https://gate.joingonka.ai/v1, klucz jg- oraz identyfikatory modeli sieci. Dla użytkowników indywidualnych i zespołów do 10 osób jest to dostępne nawet w planie darmowym, a kredyty Warp na inferencję nie są zużywane — jeśli w przełączniku wybrano model endpoint, a nie Auto. Główną cechą Warp jest trasa: zapytania do endpoint wysyłają jego serwery, dlatego adres musi być publiczny, a prompty przechodzą przez backend Warp tranzytem. Do zadań terminalowych wybierz DeepSeek V4 Flash, do drobiazgów — MiniMax M2.7, do złożonej logiki — GLM-5.3 Flash.

Chcesz wiedzieć więcej?

Zapoznaj się z innymi sekcjami lub zacznij zarabiać GNK już teraz.

Uzyskaj klucz i darmowe tokeny →