ज्ञानकोश अनुभाग ▾

नेविगेशन

▸ यहाँ से शुरू करें भूमिका के अनुसार

श्रेणियाँ

उपकरण 36
शब्दावली 12

टूल्स

ZCode: GLM Coding Plan के बजाय सस्ता GLM inferencing

जून 2026 में, Z.ai ने ZCode 3.0 जारी किया — एक डेस्कटॉप एजेंटिक डेवलपमेंट एनवायरनमेंट, जिसे कंपनी खुद «Official Harness for GLM-5.2» कहती है। यह उत्पाद तेजी से चर्चा में आया: अपना एजेंटिक कोर, /goal के माध्यम से स्वायत्त कार्य, multi-agent मोड और सीधे Telegram से रिमोट सेशन प्रबंधन। लेकिन समीक्षाओं के साथ-साथ GLM Coding Plan के पहले सब्सक्राइबरों के सवालों का दौर शुरू हो गया: कोटा पांच घंटे की विंडो में «prompts» के रूप में गिना जाता है, व्यस्त घंटों में खपत तीन गुना हो जाती है, लोअर प्लान में केवल एक पैरेलल रिक्वेस्ट मिलती है, और Hacker News पर काम के व्यस्त दिनों के बाद अचानक ब्लॉक होने की शिकायतें की जा रही हैं।

अच्छी खबर: ZCode आधिकारिक तौर पर custom provider को सपोर्ट करता है — इससे कोई भी OpenAI- या Anthropic-compatible API कनेक्ट किया जा सकता है और सब्सक्रिप्शन कोटों के बजाय वास्तविक टोकन के लिए भुगतान किया जा सकता है। इस गाइड में, हम यह समझेंगे कि ZCode क्या है और GLM Coding Plan कैसे काम करता है, और फिर चरण-दर-चरण ZCode को JoinGonka Gateway पर सेट करेंगे — जो विकेंद्रीकृत नेटवर्क Gonka का एक गेटवे है, जिसकी रजिस्ट्री में GLM-5.2 पहले से ही जोड़ा जा चुका है। परिणाम: वही टूल, वही open-weight मॉडल, लेकिन अर्थव्यवस्था टोकन पर आधारित और केंद्रीकृत API की तुलना में सैकड़ों गुना सस्ती।

ZCode क्या है: Z.ai का एजेंटिक डेवलपमेंट एनवायरनमेंट

ZCode «चैट साइडबार वाला एडिटर» नहीं है, बल्कि एक ADE है: आप लक्ष्य का वर्णन करते हैं, एजेंट प्लान बनाता है, फाइलें एडिट करता है, जांच शुरू करता है और परिणाम तक पुनरावृति करता है। यह macOS और Windows पर डेस्कटॉप एप्लिकेशन के रूप में काम करता है (Linux के लिए बिल्ड — बीटा स्टेटस में)।

वर्जन 3.0 की प्रमुख विशेषताएं:

  • ZCode Agent — GLM-5.2 के साथ गहरे एकीकरण वाला अपना एजेंटिक कोर; इसके अलावा थर्ड-पार्टी एजेंट (Claude Code, Codex, Gemini CLI और अन्य) जोड़े जा सकते हैं;
  • Goal-मोड (/goal) — लंबे स्वायत्त कार्य: प्लान → निष्पादन → चरणों द्वारा सत्यापन;
  • Multi-agent — एक प्रोजेक्ट पर कई एजेंटों का समानांतर काम;
  • रिमोट प्रबंधन — Telegram, WeChat और Feishu से सेशन लॉन्च और नियंत्रण: एजेंट आपकी मशीन पर चलता है, और आप फोन से सवालों के जवाब देते हैं।

क्लाइंट खुद मुफ्त है, Z.ai नए उपयोगकर्ताओं को परिचित होने के लिए GLM-5.2 टोकन का दैनिक कोटा देता है। उसके बाद — या तो GLM Coding Plan की सब्सक्रिप्शन लें या अपना API-की (key) इस्तेमाल करें। यहाँ विस्तार से समझना जरूरी है, क्योंकि सब्सक्रिप्शन का स्ट्रक्चर ही उत्पाद का सबसे चर्चित हिस्सा है।

GLM Coding Plan: कीमत, सीमाएं और कोटा

GLM Coding Plan — Z.ai की सब्सक्रिप्शन है, जो ZCode और दो दर्जन थर्ड-पार्टी टूल्स में GLM मॉडल तक पहुंच प्रदान करती है। प्रकाशन के समय (जुलाई 2026) बुनियादी स्ट्रक्चर इस प्रकार दिखता है — लेकिन कीमतें और ऑफर बदलते रहते हैं, z.ai/subscribe की लाइव पेज देखें:

प्लानकीमत, $/महीनाकोटासमानांतर रिक्वेस्ट
Lite$18 (ऑफर में — ~$12.6 से)5 घंटे की विंडो में «prompts» + साप्ताहिक सीमा1
Pro$72Lite का ×41
Max$160Lite का ×1630 तक

सब्सक्राइबर क्या शिकायत करते हैं (Hacker News और GitHub थ्रेड्स):

  • पीक मल्टीप्लायर (Peak Multiplier)। व्यस्त घंटों के दौरान (14:00—18:00 UTC+8 — एशिया में शाम, यूरोप में सुबह-दोपहर) प्रत्येक रिक्वेस्ट कोटा को ×3 के गुणांक के साथ काटती है, और नॉन-पीक समय में — ×2। खर्च की योजना बीजिंग के टाइम जोन के अनुसार बनानी पड़ती है।
  • टोकन नहीं, «prompts» का कोटा। यह पारदर्शी नहीं है कि कितने टोकन बचे हैं; थ्रेड्स में ऐसी कहानियां मिलती हैं कि «GLM पर ~17M टोकन खर्च किए — और चार दिनों के लिए ब्लॉक हो गए»।
  • Lite और Pro पर एक समानांतर रिक्वेस्ट। एजेंटिक एनवायरनमेंट के लिए यह काफी महसूस होता है: ZCode का अपना multi-agent मोड और कोई भी समानांतर सब-एजेंट कतार (queue) में फंस जाते हैं।
  • GLM-5.2 छोटे मॉडलों की तुलना में कोटा तेजी से खर्च करता है — फ्लैगशिप मॉडल अपने मल्टीप्लायर के साथ लिमिट को तेजी से जलाता है।

निष्कर्ष आसान है: सामान्य सोलो-डेवलपमेंट के लिए सब्सक्रिप्शन ईमानदारी से काम करता है। लेकिन आपका मोड जितना «एजेंटिक» होगा — समानांतर कार्य, लंबे स्वायत्त सेशन, रात भर चलने वाले रन — कोटा मॉडल उतना ही लॉटरी में बदल जाता है। विकल्प — वास्तविक टोकन के लिए भुगतान: बिना विंडो, मल्टीप्लायर और कतारों के — जितना एजेंट ने खर्च किया, उतना ही काटा गया। ZCode में अंतर्निहित custom provider मैकेनिज्म यही मॉडल प्रदान करता है, और इसे पांच मिनट में सेटअप किया जा सकता है।

ZCode में BYOK: अपना API-की और custom provider

ZCode में आधिकारिक तौर पर BYOK सपोर्ट दिया गया है: डॉक्यूमेंटेशन स्पष्ट रूप से "OpenAI या Anthropic प्रोटोकॉल के साथ संगत किसी भी सर्विस" को जोड़ने की अनुमति देता है — जिसमें पब्लिक API, कॉर्पोरेट चैनल और यहां तक कि self-hosted इंस्टॉलेशन भी शामिल हैं। इसे तीन तरीकों से कॉन्फ़िगर किया जा सकता है:

  • वेलकम स्क्रीन पर Connect बटन → "Set Your API Key";
  • मॉडल सिलेक्शन में Manage Models;
  • गियर आइकन → Settings → Model Settings → Add Provider.

प्रदाता को OpenAI Base URL और/या Anthropic Base URL के साथ API Key सेट करनी होती है — ZCode उपलब्ध मॉडल्स की सूची खुद ही अपडेट कर लेगा।

तीन आम गलतियां जिनसे अक्सर बचना चाहिए:

  • Z.ai के एंडपॉइंट्स अलग-अलग होते हैं। Coding Plan सब्सक्रिप्शन केवल coding-endpoint https://api.z.ai/api/coding/paas/v4 के माध्यम से काम करता है; सब्सक्रिप्शन की के साथ सामान्य /api/paas/v4 त्रुटि दिखाएगा — यह 401/429 एरर का सबसे आम कारण है, भले ही प्लान का भुगतान किया गया हो।
  • "Claude Code में काम करता है ≠ ZCode में काम करेगा"। Claude Code को सेटअप करने वाली एनवायरनमेंट वैरिएबल्स (जैसे ANTHROPIC_BASE_URL), को ZCode नहीं पढ़ता है: इसमें अपना खुद का प्रदाता सेटिंग्स स्टोरेज होता है। इसे Settings के जरिए ही कॉन्फ़िगर करें।
  • "मॉडल सेलेक्टर में दिख रहा है ≠ की (key) के पास कोटा है"। मॉडल्स की लिस्ट प्रदाता के API से आती है, लेकिन उपलब्धता बैलेंस और की (key) की लिमिट पर निर्भर करती है।

इसके बाद प्रैक्टिकल शुरू होता है: ZCode से JoinGonka गेटवे को जोड़ें और टोकन के बदले GLM-स्टैक प्राप्त करें।

ZCode में JoinGonka Gateway की सेटिंग: टोकन के बदले GLM

JoinGonka Gateway — विकेंद्रीकृत Gonka नेटवर्क के लिए गेटवे, दो नेटिव प्रोटोकॉल के साथ: OpenAI-संगत /v1/chat/completions और Anthropic Messages /v1/messages। इकोनॉमी — pay-per-token: कोई 5-घंटे की विंडो नहीं, कोई ×3 पीक मल्टीप्लायर नहीं और न ही सिंगल समानांतर अनुरोध की कोई सीमा; खपत डैशबोर्ड में वास्तविक समय में दिखाई देती है, गेटवे प्रॉम्प्ट की सामग्री को स्टोर नहीं करता है।

स्टेप-बाय-स्टेप (वर्तमान कस्टम प्रोवाइडर इंटरफ़ेस):

स्टेपएक्शन
1. कीरजिस्टर करें — gate.joingonka.ai/register (नए खातों के लिए — 10M फ्री टोकन), Keys सेक्शन में API-की बनाएं। अधिक जानकारी — API Quick Start में।
2. प्रोवाइडरZCode → Settings → Model Settings → Add Provider. Name: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyआपकी jg-… वाली की
5. API फॉर्मेटChat completions (/chat/completions)
6. मॉडलAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000। इसी तरह moonshotai/Kimi-K2.6 और MiniMaxAI/MiniMax-M2.7 जोड़े जाते हैं; वर्तमान सूची — GET /v1/models

ZCode के पुराने वर्ज़न में इसके बजाय दो अलग-अलग फ़ील्ड हैं: OpenAI Base URL (https://gate.joingonka.ai/v1) और Anthropic Base URL (https://gate.joingonka.ai — पाथ क्लाइंट खुद जोड़ लेगा)।

सत्यापन: बनाए गए मॉडल को चुनें और एजेंट से कोई भी सवाल पूछें। उत्तर मिल गया — तो सब कुछ काम कर रहा है; त्रुटि 401 — की जांचें, 402 — अकाउंट बैलेंस। यदि DeepSeek V4 Flash पर Thought Level Max होने पर «Model request failed» आता है — तो Thought Level को High पर स्विच करें और अनुरोध दोहराएं।

सुझाव: कमांड npx @joingonka/setup --tool zcode नीचे दिए गए फ़ील्ड्स के लिए तैयार मान (base URL, की, मॉडल ID और वर्तमान लिमिट्स) प्रिंट करेगा और लाइव रिक्वेस्ट के साथ जांचेगा कि गेटवे उन्हें स्वीकार करता है या नहीं। ZCode को केवल UI के माध्यम से कॉन्फ़िगर किया जाता है — इसमें कोई ऐसी फ़ाइल नहीं है जिसे सुरक्षित रूप से संपादित किया जा सके, इसलिए मानों को हाथ से दर्ज करना होगा।

कीमतों की तुलना: Coding Plan, Z.ai API, OpenRouter और Gonka

विभिन्न चैनलों पर GLM-inferencing की लागत क्या है (1M टोकन के लिए कीमतें; प्रतिस्पर्धियों की कीमतें जुलाई 2026 के लिए तय की गई हैं, JoinGonka की कीमत API गेटवे से सीधे पेज पर ली जाती है):

चैनलइनपुट, $/1Mआउटपुट, $/1Mभुगतान मॉडल
Z.ai API (GLM-5.2)$1.40 (कैश्ड इनपुट — $0.26)$4.40टोकन के आधार पर
GLM Coding Plan$18—160/माहसदस्यता: 'प्रॉम्प्ट' कोटा, पीक पर ×3 मल्टीप्लायर, समानांतर सीमाएं
OpenRouter (z-ai/glm-5.2)$0.93$3.00टोकन के आधार पर; GLM-5.2 का कोई मुफ्त विकल्प नहीं है
JoinGonka Gateway$0.0032$0.0097टोकन के आधार पर, Gonka नेटवर्क

दो से तीन ऑर्डर की परिमाण का अंतर मार्केटिंग का राउंडिंग नहीं है, बल्कि एक अलग अर्थशास्त्र है: गणना विकेंद्रीकृत नेटवर्क के प्रतिभागियों द्वारा की जाती है, जो डेटा सेंटर मार्जिन पर नहीं, बल्कि वास्तविक काम पर कमाई करते हैं। यह कैसे काम करता है और इसकी प्रयोज्यता की सीमाएं क्या हैं, इसका विस्तृत विश्लेषण सबसे सस्ते AI API पर लेख में दिया गया है।

GLM-5.2 के बारे में निष्पक्ष अस्वीकरण: नेटवर्क मॉडल की सटीक कीमत सक्रियण के समय निर्धारित करेगा (ऊपर दी गई तालिका में - नेटवर्क मॉडल की वर्तमान लाइव कीमत)। इस पेज पर आंकड़े स्वचालित रूप से अपडेट होते हैं, कुछ भी मैन्युअल रूप से पुनर्गणना करने की आवश्यकता नहीं है।

Gonka नेटवर्क में GLM-5.2: स्टेटस और सामान्य सवाल

मॉडल zai-org/GLM-5.2-FP8 को पहले ही Gonka नेटवर्क की ऑन-चेन रजिस्ट्री में जोड़ दिया गया है: कॉन्फ़िगरेशन 400K टोकन तक का संदर्भ विंडो सेट करता है, और मॉडल स्वयं भारी मॉडलों में से है (एक प्रतिकृति के लिए एक टेराबाइट से अधिक वीडियो मेमोरी की आवश्यकता होती है)। वर्तमान में रोलआउट चल रहा है: नेटवर्क नोड्स वेट्स को गर्म (warm up) कर रहे हैं। जैसे ही चेक हरे हो जाएंगे, मॉडल स्वचालित रूप से गेटवे के मॉडल सूची में दिखाई देगा — बेस URL और कुंजी नहीं बदलती है, ZCode में बस सेलेक्टर में इसे चुनना पर्याप्त होगा।

मॉडल के बारे में: MIT लाइसेंस के तहत ओपन वेट्स, ~750B पैरामीटर पर MoE आर्किटेक्चर (प्रति टोकन लगभग 40B सक्रिय), 1M टोकन तक की नेटिव विंडो। Z.ai के आंकड़ों के अनुसार, SWE-bench Pro पर मॉडल 62.1 का स्कोर दिखाता है — जो GPT-5.5 से अधिक है, और FrontierSWE पर Claude Opus 4.8 से लगभग एक प्रतिशत पीछे है। ओपन-वेट मॉडल के लिए, यह कोडिंग में शीर्ष पंक्ति है।

अक्सर पूछे जाने वाले प्रश्न:

  • नया मॉडल चालू करने के तुरंत बाद 429 एरर क्यों आते हैं? — यह रोलआउट चरण है: कुछ नोड्स अभी भी वेट्स लोड कर रहे हैं। कुछ सेकंड के बाद अनुरोध दोहराएं — बैलेंसर एक सक्रिय नोड ढूंढ लेगा।
  • आज क्या उपलब्ध है? — Kimi K2.6, MiniMax M2.7 और DeepSeek V4 Flash: ये तीनों मॉडल ZCode में उसी कस्टम प्रदाता के माध्यम से काम करते हैं, इस गाइड का कॉन्फ़िगरेशन अभी काम कर रहा है।
  • गोपनीयता के बारे में क्या? — गेटवे प्रॉम्प्ट और उत्तर की सामग्री को संग्रहीत नहीं करता है; सांख्यिकी में केवल खपत का कुल योग होता है।
  • Coding Plan कब अधिक फायदेमंद है? — यदि आप अकेले काम करते हैं, Lite कोटे के भीतर रहते हैं, और समानांतर एजेंट नहीं चलाते हैं, तो एक निश्चित चेक के साथ सदस्यता सुविधाजनक और पूर्वानुमानित है। अपने प्रोफाइल के अनुसार गणना करें: सक्रिय एजेंट कार्य के दौरान, नेटवर्क के माध्यम से टोकन के लिए भुगतान कई गुना सस्ता होता है, लेकिन हल्के कोड संपादन के लिए अंतर महसूस नहीं हो सकता है।
  • क्या यह अन्य उपकरणों के लिए उपयुक्त है? — हाँ: वही एंडपॉइंट Claude Code, Cursor, Cline और किसी भी OpenAI/Anthropic-संगत क्लाइंट में काम करता है।
ZCode 3.0 एक उल्लेखनीय एजेंट-आधारित IDE है, लेकिन इसकी नेटिव GLM Coding Plan सदस्यता कोटा पर आधारित है: 5-घंटे की विंडो में "prompts", पीक आवर्स के दौरान ×3 मल्टीप्लायर और लोअर टैरिफ पर एक समानांतर अनुरोध। लोड जितना अधिक एजेंट-आधारित होता है, यह उतना ही महंगा और अप्रत्याशित हो जाता है। आधिकारिक BYOK समस्या का समाधान करता है: JoinGonka Gateway को custom provider के रूप में कनेक्ट करें - और विकेंद्रीकृत Gonka नेटवर्क की कीमतों पर वास्तविक टोकन के लिए भुगतान करें, जो केंद्रीकृत API की तुलना में सैकड़ों गुना कम है। GLM-5.2 पहले से ही नेटवर्क रजिस्ट्री में है और आपके मॉडल चयनकर्ता में स्वचालित रूप से दिखाई देगा, जबकि Kimi K2.6, MiniMax M2.7 और DeepSeek V4 Flash आज ही काम कर रहे हैं। 10M मुफ्त टोकन के साथ शुरुआत करें।

अधिक जानना चाहते हैं?

अन्य अनुभागों का अन्वेषण करें या अभी GNK कमाना शुरू करें।

10M मुफ्त टोकन प्राप्त करें →