Bilgi Tabanı Bölümleri ▾

Navigasyon

▸ Buradan başlayın Rol bazlı

Kategoriler

Araçlar 36
Sözlük 12

Araçlar

ZCode: GLM Coding Plan yerine ucuz GLM çıkarımı

Haziran 2026'da Z.ai, şirketin kendisinin «Official Harness for GLM-5.2» olarak adlandırdığı ZCode 3.0 masaüstü ajansal geliştirme ortamını piyasaya sürdü. Ürün hızla dikkat çekti: kendi ajansal çekirdeği, /goal ile otonom görevler, çoklu ajan modu ve doğrudan Telegram üzerinden uzaktan oturum yönetimi. Ancak inceleme dalgasıyla birlikte GLM Coding Plan'ın ilk abonelerinden gelen sorular da arttı: Kota beş saatlik pencerelerdeki «prompt»lar ile hesaplanıyor, yoğun saatlerde tüketim üçe katlanıyor, giriş seviyesi tarifelerde tek bir eşzamanlı istek hakkı var ve Hacker News üzerinde yoğun bir çalışma gününden sonra ani engellemelerden şikayet eden kullanıcılar bulunuyor.

İyi haber şu: ZCode resmi olarak custom provider desteğine custom provider desteği sunuyor — ona herhangi bir OpenAI veya Anthropic uyumlu API bağlayabilir ve abonelik kotaları yerine gerçek tokenlar üzerinden ödeme yapabilirsiniz. Bu kılavuzda ZCode'un ne olduğunu ve GLM Coding Plan'ın nasıl yapılandırıldığını inceleyeceğiz, ardından adım adım ZCode'u JoinGonka Gateway'e — GLM-5.2'nin zaten eklendiği merkeziyetsiz Gonka ağ geçidine — bağlayacağız. Sonuç: aynı araç, aynı open-weight modeller, ancak ekonomi token bazında ve merkezi API'lerden yüzlerce kat daha ucuz.

ZCode nedir: Z.ai'den ajansal geliştirme ortamı

ZCode bir «sohbet kenar çubuğuna sahip düzenleyici» değil, bir ADE'dir: Siz bir hedef tanımlarsınız, ajan bir plan oluşturur, dosyaları düzenler, kontrolleri başlatır ve sonuca ulaşana kadar yineleme yapar. macOS ve Windows üzerinde masaüstü uygulaması olarak çalışır (Linux sürümü beta aşamasındadır).

Sürüm 3.0'ın temel özellikleri:

  • ZCode Agent — GLM-5.2 ile derin entegrasyona sahip kendi ajansal çekirdeği; bunun dışında üçüncü taraf ajanlar (Claude Code, Codex, Gemini CLI vb.) bağlanabilir;
  • Goal-modu (/goal) — uzun süreli otonom görevler: plan → yürütme → adım adım doğrulama;
  • Multi-agent — bir proje üzerinde birkaç ajanın paralel çalışması;
  • Uzaktan yönetim — Telegram, WeChat ve Feishu üzerinden oturumları başlatma ve kontrol etme: ajan bilgisayarınızda çalışırken siz telefondan soruları yanıtlayabilirsiniz.

İstemci ücretsizdir, yeni kullanıcılara Z.ai denemeleri için günlük bir GLM-5.2 kota kotası verir. Gerisi ya GLM Coding Plan aboneliği ya da kendi API anahtarınızdır. Ve tam burada detayları anlamak önemlidir, çünkü abonelik yapısı ürünün en çok tartışılan kısmıdır.

GLM Coding Plan: fiyat, limitler ve kotalar

GLM Coding Plan, ZCode'da ve yirmiden fazla üçüncü taraf araçta GLM modellerine erişim sağlayan Z.ai aboneliğidir. Yayın tarihi itibarıyla (Temmuz 2026) temel tablo şu şekildedir — ancak fiyatlar ve kampanyalar değişebilir, z.ai/subscribe canlı sayfasını kontrol edin:

TarifeFiyat, $/ayKotaEşzamanlı istek
Lite$18 (kampanyalarla — ~$12.6'dan başlayan)5 saatlik pencerelerde «prompt»lar + haftalık tavan1
Pro$72Lite'ın ×4'ü1
Max$160Lite'ın ×16'sı30'a kadar

Abonelerin şikayet ettiği konular (Hacker News ve GitHub başlıkları):

  • Yoğun saat katsayısı. Yoğun saatlerde (14:00—18:00 UTC+8 — Asya'da akşam, Avrupa'da sabah/öğle) her istek kotayı ×3 katsayısı ile düşürür, yoğun saat dışında ise ×2. Tüketimi Pekin saat dilimine göre planlamak zorundayız.
  • Token değil, «prompt» kotası. Tam olarak kaç token kaldığı şeffaf değildir; başlıklarda «GLM'de ~17M token harcadım ve dört gün engellendim» gibi hikayelere rastlanmaktadır.
  • Lite ve Pro'da bir eşzamanlı istek. Ajansal bir ortam için bu hissedilebilirdir: ZCode'un kendi multi-agent modu ve herhangi bir paralel alt ajan kuyruğa takılır.
  • GLM-5.2 kotayı küçük modellerden daha hızlı tüketir — amiral gemisi limiti kendi katsayısı ile tüketir.

Sonuç basittir: sakin bir solo geliştirme için abonelik dürüst bir şekilde çalışır. Ancak modunuz ne kadar «ajansal» ise — paralel görevler, uzun otonom oturumlar, gece çalıştırmaları — kota modeli o kadar sık bir piyangoya dönüşür. Alternatif ise gerçek tokenlar için ödeme yapmaktır: pencereler, katsayılar ve kuyruklar olmadan — ajan ne kadar harcarsa o kadar düşülür. ZCode içine entegre edilmiş custom provider mekanizması tam olarak bu modeli sağlar ve kurulumu beş dakikada biter.

ZCode'da BYOK: kendi API anahtarınız ve custom provider

ZCode, resmi olarak BYOK desteğiyle gelir: Dokümantasyon, „OpenAI veya Anthropic protokolleriyle uyumlu herhangi bir servisi“ (halka açık API'ler, kurumsal kanallar ve hatta self-hosted kurulumlar) eklemenize doğrudan izin verir. Ayarlar üç şekilde yapılandırılabilir:

  • Hoş geldin ekranındaki Connect düğmesi → „Set Your API Key“;
  • Model seçicide Manage Models;
  • Çark simgesi → Settings → Model Settings → Add Provider.

Provider (sağlayıcı) için OpenAI Base URL ve/veya Anthropic Base URL ile birlikte API Key tanımlanır; ZCode mevcut modellerin listesini otomatik olarak çeker.

En sık yapılan üç hata:

  • Z.ai endpoint'leri farklıdır. Coding Plan aboneliği sadece https://api.z.ai/api/coding/paas/v4 coding-endpoint'i üzerinden çalışır; genel /api/paas/v4 adresi abonelik anahtarıyla hata verir — „planım ödenmiş olmasına rağmen 401/429 alıyorum“ sorununun klasik nedeni budur.
  • „Claude Code'da çalışıyor ≠ ZCode'da çalışıyor“. Claude Code yapılandırmasında kullanılan ANTHROPIC_BASE_URL gibi ortam değişkenlerini ZCode okumaz; kendi sağlayıcı ayarları deposuna sahiptir. Ayarları doğrudan Settings üzerinden yapılandırın.
  • „Model seçicide görünüyor ≠ anahtarın kotası var“. Model listesi sağlayıcının API'sinden çekilir, ancak erişilebilirlik belirli bir anahtarın bakiyesine ve limitlerine bağlıdır.

Sırada pratik var: ZCode'a JoinGonka ağ geçidini bağlayıp token karşılığında GLM-stack elde ediyoruz.

ZCode'da JoinGonka Gateway Kurulumu: Token ile GLM

JoinGonka Gateway — iki yerel protokole sahip merkeziyetsiz Gonka ağına açılan kapı: OpenAI uyumlu /v1/chat/completions ve Anthropic Messages /v1/messages. Ekonomi — pay-per-token: 5 saatlik pencereler, ×3 zirve çarpanları ve tek paralel sorgu sınırı yoktur; tüketim Dashboard'da gerçek zamanlı olarak görülebilir, ağ geçidi prompt içeriğini saklamaz.

Adım adım (güncel Custom Provider arayüzü):

AdımEylem
1. AnahtarKaydolun — gate.joingonka.ai/register (yeni hesaplara 10M ücretsiz token verilir), Keys bölümünde bir API anahtarı oluşturun. Detaylar — API Quick Start kısmında.
2. ProviderZCode → Settings → Model Settings → Add Provider. İsim: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyjg-… formatındaki anahtarınız
5. API formatChat completions (/chat/completions)
6. ModelAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000. Aynı şekilde moonshotai/Kimi-K2.6 ve MiniMaxAI/MiniMax-M2.7 de eklenebilir; güncel liste — GET /v1/models.

ZCode'un eski sürümlerinde bunun yerine iki ayrı alan bulunur: OpenAI Base URL (https://gate.joingonka.ai/v1) ve Anthropic Base URL (https://gate.joingonka.ai — yolu istemci kendisi ekler).

Doğrulama: Oluşturduğunuz modeli seçin ve asistana herhangi bir soru sorun. Yanıt geldiyse her şey çalışıyor demektir; 401 hatası — anahtarı kontrol edin, 402 hatası — hesap bakiyesini kontrol edin. DeepSeek V4 Flash üzerinde Thought Level Max iken «Model request failed» hatası alırsanız, Thought Level ayarını High olarak değiştirin ve sorguyu tekrarlayın.

İpucu: npx @joingonka/setup --tool zcode komutu, aşağıdaki alanlar için hazır değerleri (base URL, anahtar, güncel limitli model kimliği) yazdırır ve canlı bir sorguyla ağ geçidinin bunları kabul ettiğini doğrular. ZCode sadece UI üzerinden yapılandırılır — güvenli bir şekilde düzenlenebilecek bir dosyası yoktur, bu yüzden değerleri manuel olarak yapıştırmanız gerekir.

Fiyat karşılaştırması: Coding Plan, Z.ai API, OpenRouter ve Gonka

Farklı kanallarda GLM-inferenced maliyeti ne kadar (fiyatlar 1M token başına; rakipler için Temmuz 2026 itibarıyla sabitlenmiştir, JoinGonka fiyatı API ağ geçidinden sayfaya canlı olarak aktarılır):

KanalGiriş, $/1MÇıkış, $/1MÖdeme modeli
Z.ai API (GLM-5.2)$1.40 (önbelleğe alınmış giriş — $0.26)$4.40token başına
GLM Coding Plan$18—160/ayabonelik: "prompt" kotaları, yoğun saatlerde ×3 çarpanı, paralellik limitleri
OpenRouter (z-ai/glm-5.2)$0.93$3.00token başına; GLM-5.2'nin ücretsiz bir seçeneği yoktur
JoinGonka Gateway$0.0032$0.0097token başına, Gonka ağı

İki veya üç basamaklı fark, pazarlama amaçlı bir yuvarlama değil, farklı bir ekonomidir: hesaplamalar, veri merkezi kârından değil, işin kendisinden kazanan merkeziyetsiz ağ katılımcıları tarafından gerçekleştirilir. Bunun nasıl çalıştığına ve uygulanabilirlik sınırlarının nerede olduğuna dair detaylı analiz en ucuz AI API hakkındaki makalede yer almaktadır.

GLM-5.2 hakkında dürüst bir not: Modelin tam fiyatı, ağ tarafından etkinleştirme anında belirlenir (yukarıdaki tabloda ağ modellerinin güncel canlı fiyatı bulunmaktadır). Bu sayfadaki rakamlar otomatik olarak güncellenir, manuel olarak hiçbir şeyi yeniden hesaplamanıza gerek kalmaz.

Gonka ağında GLM-5.2: Durum ve sıkça sorulan sorular

zai-org/GLM-5.2-FP8 modeli, Gonka ağının on-chain kayıt defterine zaten eklendi: yapılandırma 400K tokene kadar bağlam penceresi tanımlıyor ve modelin kendisi ağır modeller kategorisinde (bir replika için bir terabayttan fazla VRAM gerekiyor). Şu anda yayılma aşamasındayız: ağ düğümleri ağırlıkları yüklüyor. Kontroller yeşile döndüğünde, model otomatik olarak ağ geçidi model listesinde görünecektir — base URL ve anahtar değişmez, ZCode içinde seçicide onu seçmek yeterli olacaktır.

Model hakkında: MIT lisansı altında açık ağırlıklar, her token için model parametrelerinin sadece bir kısmını aktive eden MoE mimarisi, ~750B parametre (token başına yaklaşık 40B aktif), 1M tokene kadar doğal pencere. Z.ai verilerine göre, SWE-bench Pro'da model 62.1 puan alıyor — GPT-5.5'ten daha yüksek ve FrontierSWE'de Claude Opus 4.8'in yaklaşık bir puan gerisinde. Açık ağırlıklı bir model için bu kodlamada zirve noktasıdır.

Sıkça Sorulan Sorular:

  • Yeni bir model açıldıktan hemen sonra neden 429 hatası alıyorum? — Bu, yayılma aşamasıdır: bazı düğümler hala ağırlıkları yüklüyor. Birkaç saniye sonra isteği tekrarlayın — yük dengeleyici canlı bir düğüm bulacaktır.
  • Bugün ne mevcut? — Kimi K2.6, MiniMax M2.7 ve DeepSeek V4 Flash: üç model de ZCode'da aynı özel sağlayıcı üzerinden çalışıyor, bu kılavuzdaki konfigürasyon şu an tamamen çalışır durumdadır.
  • Gizlilik ne durumda? — Ağ geçidi prompt ve cevapların içeriğini saklamaz; istatistiklerde sadece tüketim toplamları görünür.
  • Coding Plan ne zaman daha kârlıdır? — Tek başınıza çalışıyorsanız, Lite kotasına uyuyorsanız ve paralel ajanlar çalıştırmıyorsanız, sabit ücretli abonelik kullanışlı ve tahmin edilebilirdir. Kendi profilinize göre hesaplayın: aktif ajan çalışmaları yapıyorsanız ağ üzerinden token başına ödeme kat kat daha ucuzdur, ancak günde birkaç kez hafif kod düzeltmeleri yapıyorsanız farkı hissetmeyebilirsiniz.
  • Bu diğer araçlar için uygun mu? — Evet: aynı uç nokta (endpoint) Claude Code, Cursor, Cline ve herhangi bir OpenAI/Anthropic uyumlu istemcide çalışır.
ZCode 3.0 kayda değer bir ajan tabanlı IDE'dir, ancak yerel GLM Coding Plan aboneliği kota tabanlıdır: 5 saatlik pencerelerde "promptlar", yoğun saatlerde ×3 çarpanı ve alt tarifelerde tek bir eşzamanlı istek. İş yükü ne kadar ajan tabanlı olursa, o kadar pahalı ve öngörülemez olur. Resmi BYOK sorunu çözer: JoinGonka Gateway'i custom provider olarak bağlayın ve merkezi API'lerden yüzlerce kat daha düşük olan merkeziyetsiz Gonka ağı fiyatlarıyla gerçek tokenlar için ödeme yapın. GLM-5.2 zaten ağ kayıt defterindedir ve model seçicinizde otomatik olarak görünecektir; Kimi K2.6, MiniMax M2.7 ve DeepSeek V4 Flash ise bugün çalışmaktadır. 10M ücretsiz token ile başlayın.

Daha fazla bilgi edinmek ister misiniz?

Diğer bölümleri keşfedin veya şimdi GNK kazanmaya başlayın.

10M ücretsiz token al →