Sekcje bazy wiedzy ▾

Nawigacja

▸ Zacznij tutaj Według ról

Kategorie

Narzędzia 36
Słownik 12

Narzędzia

ZCode: tania inferencja GLM zamiast GLM Coding Plan

W czerwcu 2026 Z.ai wydało ZCode 3.0 — desktopowe agentowe środowisko programistyczne, które firma nazywa „Official Harness for GLM-5.2”. Produkt szybko zyskał popularność: własny rdzeń agentowy, autonomiczne zadania przez /goal, tryb multi-agent i zdalne zarządzanie sesjami bezpośrednio z Telegram. Jednak wraz z falą recenzji pojawiła się fala pytań od pierwszych subskrybentów GLM Coding Plan: kwota jest liczona w „promptach” w pięciogodzinnych oknach, w godzinach szczytu zużycie mnożone jest przez trzy, w niższych planach dostępny jest jeden równoległy request, a na Hacker News narzekają na nagłe blokady po intensywnym dniu pracy.

Dobra wiadomość: ZCode oficjalnie obsługuje custom provider — można podłączyć do niego dowolny API zgodny z OpenAI lub Anthropic i płacić za faktyczne tokeny, a nie za abonamentowe limity (kwoty). W tym przewodniku wyjaśnimy, czym jest ZCode i jak działa GLM Coding Plan, a następnie krok po kroku skonfigurujemy ZCode z JoinGonka Gateway — bramą zdecentralizowanej sieci Gonka, w rejestrze której dodano już GLM-5.2. Wynik: to samo narzędzie, te same modele open-weight, ale ekonomia oparta na tokenach i wielokrotnie taniej niż w przypadku scentralizowanych API.

Czym jest ZCode: agentowe środowisko programistyczne od Z.ai

ZCode to nie „edytor z paskiem bocznym czatu”, a ADE: opisujesz cel, agent tworzy plan, poprawia pliki, uruchamia testy i iteruje do uzyskania wyniku. Działa jako aplikacja desktopowa na macOS i Windows (budowa dla Linux — w statusie beta).

Kluczowe możliwości wersji 3.0:

  • ZCode Agent — własne rdzeń agentowy z głęboką integracją GLM-5.2; poza nim można podłączać agentów zewnętrznych (Claude Code, Codex, Gemini CLI i inni);
  • Tryb Goal (/goal) — długie autonomiczne zadania: plan → wykonanie → weryfikacja krok po kroku;
  • Multi-agent — równoległa praca kilku agentów nad projektem;
  • Zdalne sterowanie — uruchamianie i kontrola sesji z Telegram, WeChat i Feishu: agent działa na twojej maszynie, a ty odpowiadasz na pytania z telefonu.

Sam klient jest darmowy, nowym użytkownikom Z.ai daje dzienną kwotę tokenów GLM-5.2 do zapoznania się. Dalej — albo subskrypcja GLM Coding Plan, albo własny API-klucz. I tutaj warto wgłębić się w szczegóły, ponieważ mechanizm subskrypcji jest najbardziej dyskutowaną częścią produktu.

GLM Coding Plan: cena, limity i kwoty

GLM Coding Plan — to subskrypcja Z.ai, dająca dostęp do modeli GLM w ZCode i w kilkunastu zewnętrznych narzędziach. W momencie publikacji (lipiec 2026) podstawowa siatka wygląda tak — ale ceny i promocje zmieniają się, sprawdzaj na żywej stronie z.ai/subscribe:

TaryfaCena, $/miesKwotaRównoległe requesty
Lite$18 (w promocji — od ~$12.6)„Prompty” w 5-godzinnych oknach + tygodniowy limit1
Pro$72×4 do Lite1
Max$160×16 do Litedo 30

Na co narzekają subskrybenci (wątki na Hacker News i GitHub):

  • Mnożnik szczytowy. W godzinach szczytu (14:00—18:00 UTC+8 — wieczór w Azji, poranek-dzień w Europie) każdy request odlicza kwotę z współczynnikiem ×3, poza szczytem — ×2. Trzeba planować zużycie zgodnie ze strefą czasową Pekinu.
  • Kwota „promptami”, a nie tokenami. Ile dokładnie tokenów pozostało — jest niejasne; w wątkach zdarzają się historie typu „wykorzystałem ~17M tokenów na GLM — i otrzymałem blokadę na cztery dni”.
  • Jeden równoległy request w Lite i Pro. Dla środowiska agentowego jest to odczuwalne: tryb multi-agent samego ZCode i wszelkie równoległe sub-agenty trafiają do kolejki.
  • GLM-5.2 zużywa kwotę szybciej niż młodsze modele — flagowiec spala limit z własnym mnożnikiem.

Wniosek jest prosty: dla spokojnego tworzenia solo subskrypcja działa uczciwie. Ale im bardziej „agentowy” jest twój tryb pracy — zadania równoległe, długie autonomiczne sesje, nocne przebiegi — tym częściej model kwotowy zamienia się w loterię. Alternatywą jest płatność za faktyczne tokeny: bez okien, mnożników i kolejek — ile agent zużył, tyle zostało odliczone. Ten model daje wbudowany w ZCode mechanizm custom provider, i konfiguruje się go w pięć minut.

BYOK w ZCode: własny API-klucz i custom provider

ZCode posiada oficjalnie wbudowane wsparcie dla BYOK: dokumentacja wyraźnie zezwala na dodawanie „dowolnego serwisu kompatybilnego z protokołami OpenAI lub Anthropic” — publicznych API, kanałów korporacyjnych, a nawet instalacji self-hosted. Konfiguruje się to na trzy sposoby:

  • przycisk Connect na ekranie powitalnym → „Set Your API Key”;
  • Manage Models w selektorze modelu;
  • ikona trybika → Settings → Model Settings → Add Provider.

Dla dostawcy ustawia się OpenAI Base URL oraz/lub Anthropic Base URL oraz API Key — listę dostępnych modeli ZCode pobierze automatycznie.

Trzy typowe problemy, na które najczęściej trafiają użytkownicy:

  • Endpointy Z.ai są różne. Subskrypcja Coding Plan działa tylko przez coding-endpoint https://api.z.ai/api/coding/paas/v4; ogólny /api/paas/v4 z kluczem subskrypcyjnym zwróci błąd — to klasyczna przyczyna „mam 401/429, mimo że plan jest opłacony”.
  • „Działa w Claude Code ≠ działa w ZCode”. Zmienne środowiskowe, takie jak ANTHROPIC_BASE_URL, którymi konfiguruje się Claude Code, nie są odczytywane przez ZCode: posiada on własny magazyn ustawień dostawców. Konfiguruj bezpośrednio przez Settings.
  • „Model widoczny w selektorze ≠ klucz posiada limit (quota)”. Lista modeli jest pobierana z API dostawcy, a dostępność zależy od salda i limitów konkretnego klucza.

Dalej przechodzimy do praktyki: podłączamy do ZCode bramkę JoinGonka i korzystamy z GLM-stack za tokeny.

Konfiguracja JoinGonka Gateway w ZCode: GLM za tokeny

JoinGonka Gateway — bramka do zdecentralizowanej sieci Gonka z dwoma natywnymi protokołami: kompatybilnym z OpenAI /v1/chat/completions oraz Anthropic Messages /v1/messages. Ekonomia — pay-per-token: brak 5-godzinnych okien, mnożników szczytowych ×3 i limitu jednego równoległego zapytania; zużycie jest widoczne w panelu w czasie rzeczywistym, bramka nie przechowuje zawartości promptów.

Krok po kroku (aktualny interfejs Custom Provider):

KrokDziałanie
1. KluczZarejestruj się — gate.joingonka.ai/register (dla nowych kont — 10M darmowych tokenów), utwórz klucz API w sekcji Keys. Więcej informacji — w API Quick Start.
2. DostawcaZCode → Settings → Model Settings → Add Provider. Name: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. Klucz APItwój klucz w formacie jg-…
5. Format APIChat completions (/chat/completions)
6. ModelAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000. W ten sam sposób dodaje się moonshotai/Kimi-K2.6 oraz MiniMaxAI/MiniMax-M2.7; aktualna lista — GET /v1/models.

W starszych wersjach ZCode zamiast tego znajdują się dwa oddzielne pola: OpenAI Base URL (https://gate.joingonka.ai/v1) oraz Anthropic Base URL (https://gate.joingonka.ai — klient sam doda ścieżkę).

Weryfikacja: wybierz utworzony model i zadaj agentowi dowolne pytanie. Jeśli odpowiedź nadeszła — wszystko działa; błąd 401 — sprawdź klucz, 402 — saldo konta. Jeśli na DeepSeek V4 Flash pojawia się „Model request failed” przy Thought Level Max — przełącz Thought Level na High i powtórz zapytanie.

Wskazówka. Polecenie npx @joingonka/setup --tool zcode wyświetli gotowe wartości dla poniższych pól (base URL, klucz, id modelu z aktualnymi limitami) i sprawdzi na żywo, czy bramka je akceptuje. Sam ZCode jest konfigurowany tylko przez UI — nie ma pliku, który można bezpiecznie edytować, więc wartości należy wprowadzać ręcznie.

Porównanie cen: Coding Plan, Z.ai API, OpenRouter oraz Gonka

Ile kosztuje inferencja GLM na różnych kanałach (ceny za 1M tokenów; u konkurencji dane z lipca 2026, cena JoinGonka pobierana jest na stronę na żywo z bramki API):

KanałWejście, $/1MWyjście, $/1MModel płatności
Z.ai API (GLM-5.2)$1.40 (wejście w cache — $0.26)$4.40za tokeny
GLM Coding Plan$18—160/mies.subskrypcja: limity „promptów”, mnożnik ×3 w szczycie, limity równoległości
OpenRouter (z-ai/glm-5.2)$0.93$3.00za tokeny; brak darmowej wersji GLM-5.2
JoinGonka Gateway$0.0032$0.0097za tokeny, sieć Gonka

Różnica dwóch-trzech rzędów wielkości to nie marketingowe zaokrąglenie, a inna ekonomia: obliczenia wykonują uczestnicy zdecentralizowanej sieci, zarabiający na samej pracy, a nie na marży centrum danych. Szczegółową analizę tego, jak to działa i gdzie są granice zastosowań, znajdziesz w artykule o najtańszym AI API.

Uczciwa uwaga dotycząca GLM-5.2: dokładną cenę modelu sieć ustali w momencie uruchomienia (w tabeli powyżej znajduje się aktualna cena modeli w sieci). Liczby na tej stronie aktualizują się automatycznie, nie trzeba niczego przeliczać ręcznie.

GLM-5.2 w sieci Gonka: status i często zadawane pytania

Model zai-org/GLM-5.2-FP8 został już dodany do rejestru on-chain sieci Gonka: konfiguracja określa okno kontekstowe do 400K tokenów, a sam model jest z tych „ciężkich” (jedna replika wymaga ponad terabajta pamięci wideo). Obecnie trwa wdrażanie: węzły sieci rozgrzewają wagi. Gdy tylko testy zmienią kolor na zielony, model automatycznie pojawi się na liście modeli gatewaya — base URL i klucz nie ulegają zmianie, w ZCode wystarczy wybrać go w selektorze.

O samym modelu: otwarte wagi na licencji MIT, architektura MoE na ~750B parametrów (około 40B aktywnych na token), natywne okno do 1M tokenów. Według danych Z.ai, w SWE-bench Pro model pokazuje 62.1 — wyżej niż GPT-5.5, a w FrontierSWE ustępuje Claude Opus 4.8 o około procent. Dla modelu typu open-weight to pierwsza linijka w kodowaniu.

Częste pytania:

  • Dlaczego zaraz po włączeniu nowego modelu występują 429? — To faza wdrażania: część węzłów jeszcze ładuje wagi. Powtórz zapytanie po kilku sekundach — balancer znajdzie aktywny węzeł.
  • Co jest dostępne już dzisiaj? — Kimi K2.6, MiniMax M2.7 i DeepSeek V4 Flash: wszystkie trzy modele działają w ZCode przez ten sam custom provider, konfiguracja z tego poradnika działa już teraz.
  • Co z prywatnością? — Gateway nie przechowuje treści promptów i odpowiedzi; w statystykach — tylko agregaty zużycia.
  • Kiedy Coding Plan jest mimo wszystko bardziej opłacalny? — Jeśli pracujesz solo, mieścisz się w limicie Lite i nie uruchamiasz równoległych agentów, subskrypcja ze stałą kwotą jest wygodna i przewidywalna. Policz według swojego profilu: przy aktywnej pracy agentowej płatność za tokeny przez sieć wychodzi o rzędy wielkości taniej, przy lekkim poprawianiu kodu parę razy dziennie różnica może nie być odczuwalna.
  • Czy sprawdzi się to dla innych narzędzi? — Tak: ten sam endpoint działa w Claude Code, Cursor, Cline i każdym kliencie kompatybilnym z OpenAI/Anthropic.
ZCode 3.0 to godne uwagi IDE typu agent, ale jego natywna subskrypcja GLM Coding Plan opiera się na kwotach: "prompty" w 5-godzinnych oknach, mnożnik ×3 w godzinach szczytu i jedno zapytanie równoległe w niższych taryfach. Im bardziej agentowe obciążenie, tym drożej i bardziej nieprzewidywalnie wychodzi. Oficjalny BYOK rozwiązuje ten problem: podłącz JoinGonka Gateway jako custom provider i płać za faktyczne tokeny po cenach zdecentralizowanej sieci Gonka, setki razy niższych niż w przypadku scentralizowanych API. GLM-5.2 jest już w rejestrze sieci i pojawi się w twoim selektorze modeli automatycznie, a Kimi K2.6, MiniMax M2.7 i DeepSeek V4 Flash działają już dzisiaj. Zacznij od 10M darmowych tokenów.

Chcesz wiedzieć więcej?

Zapoznaj się z innymi sekcjami lub zacznij zarabiać GNK już teraz.

Zdobądź darmowe 10M tokenów →