ज्ञानकोश अनुभाग ▾

नेविगेशन

▸ यहाँ से शुरू करें भूमिका के अनुसार

श्रेणियाँ

उपकरण 52
शब्दावली 12

टूल्स

ZCode: GLM Coding Plan के बजाय सस्ता GLM inferencing

जून 2026 में, Z.ai ने ZCode 3.0 जारी किया — एक डेस्कटॉप एजेंट विकास वातावरण, जिसे कंपनी स्वयं 'Official Harness for GLM-5.2' कहती है। उत्पाद ने जल्दी ही ध्यान आकर्षित किया: स्वयं का एजेंट कोर, /goal के माध्यम से स्वायत्त कार्य, मल्टी-एजेंट मोड और सीधे Telegram से रिमोट सेशन प्रबंधन। लेकिन समीक्षाओं की लहर के साथ, GLM Coding Plan के पहले ग्राहकों से प्रश्नों की लहर भी आई: कोटा को पांच घंटे की खिड़कियों में 'प्रॉम्प्ट्स' के रूप में गिना जाता है, पीक आवर्स के दौरान खपत तीन गुना बढ़ जाती है, निचले टैरिफ पर केवल एक समानांतर अनुरोध होता है, और Hacker News पर उपयोगकर्ता काम के व्यस्त दिन के बाद अचानक ब्लॉकिंग की शिकायत करते हैं।

अच्छी खबर: ZCode आधिकारिक तौर पर custom provider का समर्थन करता है — इससे कोई भी OpenAI- या Anthropic-संगत API कनेक्ट किया जा सकता है और सब्सक्रिप्शन कोटे के बजाय वास्तविक टोकन के लिए भुगतान किया जा सकता है। इस गाइड में, हम समझेंगे कि ZCode क्या है और GLM Coding Plan कैसे काम करता है, और फिर चरण-दर-चरण JoinGonka Gateway पर ZCode को सेटअप करेंगे — जो विकेंद्रीकृत Gonka नेटवर्क का गेटवे है, जो Z.ai के स्वयं के ओपन रीजनिंग-मॉडल GLM-5.3 Flash को सर्व करता है। परिणाम: वही उपकरण, वही ओपन-वेट मॉडल, लेकिन अर्थव्यवस्था टोकन पर आधारित है और केंद्रीकृत API की तुलना में कई गुना सस्ती है।

ZCode क्या है: Z.ai का एजेंटिक डेवलपमेंट एनवायरनमेंट

ZCode «चैट साइडबार वाला एडिटर» नहीं है, बल्कि एक ADE है: आप लक्ष्य का वर्णन करते हैं, एजेंट प्लान बनाता है, फाइलें एडिट करता है, जांच शुरू करता है और परिणाम तक पुनरावृति करता है। यह macOS और Windows पर डेस्कटॉप एप्लिकेशन के रूप में काम करता है (Linux के लिए बिल्ड — बीटा स्टेटस में)।

वर्जन 3.0 की प्रमुख विशेषताएं:

  • ZCode Agent — GLM-5.2 के साथ गहरे एकीकरण वाला अपना एजेंटिक कोर; इसके अलावा थर्ड-पार्टी एजेंट (Claude Code, Codex, Gemini CLI और अन्य) जोड़े जा सकते हैं;
  • Goal-मोड (/goal) — लंबे स्वायत्त कार्य: प्लान → निष्पादन → चरणों द्वारा सत्यापन;
  • Multi-agent — एक प्रोजेक्ट पर कई एजेंटों का समानांतर काम;
  • रिमोट प्रबंधन — Telegram, WeChat और Feishu से सेशन लॉन्च और नियंत्रण: एजेंट आपकी मशीन पर चलता है, और आप फोन से सवालों के जवाब देते हैं।

क्लाइंट खुद मुफ्त है, Z.ai नए उपयोगकर्ताओं को परिचित होने के लिए GLM-5.2 टोकन का दैनिक कोटा देता है। उसके बाद — या तो GLM Coding Plan की सब्सक्रिप्शन लें या अपना API-की (key) इस्तेमाल करें। यहाँ विस्तार से समझना जरूरी है, क्योंकि सब्सक्रिप्शन का स्ट्रक्चर ही उत्पाद का सबसे चर्चित हिस्सा है।

GLM Coding Plan: कीमत, सीमाएं और कोटा

GLM Coding Plan, Z.ai की सब्सक्रिप्शन है जो ZCode और दो दर्जन से ज़्यादा बाहरी टूल्स में GLM मॉडल्स तक पहुँच देती है। प्रकाशन के समय (जुलाई 2026) बेसिक स्लैब ऐसा है — लेकिन कीमतें और ऑफ़र बदलते रहते हैं, z.ai/subscribe का लाइव पेज देखते रहें:

प्लानकीमत, $/माहकोटासमांतर अनुरोध
Lite$18 (ऑफ़र में — ~$12.6 से)5-घंटे की विंडो में "prompt" + साप्ताहिक सीमा1
Pro$72Lite से ×41
Max$160Lite से ×1630 तक

सब्सक्राइबर किन बातों की शिकायत करते हैं (Hacker News और GitHub थ्रेड्स):

  • पीक मल्टीप्लायर। पीक आवर्स (14:00—18:00 UTC+8 — एशिया की शाम, यूरोप की सुबह-दोपहर) में हर अनुरोध कोटा ×3 गुणांक से काटता है, पीक के बाहर ×2। खर्च की योजना बीजिंग टाइमज़ोन के हिसाब से बनानी पड़ती है।
  • कोटा "prompt" में, टोकन में नहीं। बिल्कुल कितने टोकन बचे हैं — यह पारदर्शी नहीं; थ्रेड्स में "GLM पर ~17M टोकन जला दिए — और चार दिन का ब्लॉक मिला" जैसी कहानियाँ मिलती हैं।
  • Lite और Pro पर एक समांतर अनुरोध। एजेंटिक माहौल के लिए यह महसूस होता है: ख़ुद ZCode का multi-agent मोड और कोई भी समांतर सब-एजेंट कतार में फँस जाते हैं।
  • GLM-5.2 कोटा जल्दी खर्च करता है छोटे मॉडल्स से — फ़्लैगशिप अपने अलग गुणांक से लिमिट जलाता है।

निष्कर्ष सीधा है: शांत सोलो डेवलपमेंट के लिए सब्सक्रिप्शन ईमानदारी से काम करती है। लेकिन आपका मोड जितना ज़्यादा "एजेंटिक" होगा — समांतर काम, लंबे ऑटोनॉमस सेशन, रात के रन — उतनी ही बार कोटा मॉडल लॉटरी बन जाएगा। विकल्प है असली टोकन के लिए भुगतान: बिना विंडो, बिना गुणांक, बिना कतार — एजेंट ने जितना खर्च किया, उतना ही कटा। यही मॉडल ZCode में पहले से मौजूद custom provider मेकैनिज़्म देता है, और सेटअप पाँच मिनट में हो जाता है।

ZCode में BYOK: अपना API-की और custom provider

ZCode में BYOK की सपोर्ट ऑफ़िशियली बिल्ट-इन है: डॉक्युमेंटेशन सीधे इजाज़त देता है कि "OpenAI या Anthropic प्रोटोकॉल से कम्पैटिबल कोई भी सर्विस" जोड़ी जा सकती है — पब्लिक API, कॉर्पोरेट चैनल, यहाँ तक कि self-hosted इंस्टॉलेशन भी। इसे तीन तरीक़ों से सेट किया जाता है:

  • वेलकम स्क्रीन पर Connect बटन → "Set Your API Key";
  • मॉडल सेलेक्टर में Manage Models;
  • गियर आइकन → Settings → Model Settings → Add Provider।

प्रोवाइडर के लिए OpenAI Base URL और/या Anthropic Base URL के साथ API Key सेट करें — उपलब्ध मॉडल्स की लिस्ट ZCode ख़ुद खींच लेगा।

तीन सबसे आम ठोकरें:

  • Z.ai के endpoint अलग-अलग हैं। Coding Plan सब्सक्रिप्शन सिर्फ़ coding-endpoint https://api.z.ai/api/coding/paas/v4 से काम करता है; सब्सक्रिप्शन की के साथ आम /api/paas/v4 एरर देगा — "प्लान पेड है फिर भी 401/429 आ रहा है" की क्लासिक वजह।
  • "Claude Code में चलता है ≠ ZCode में चलता है।" ANTHROPIC_BASE_URL जैसे env वेरिएबल्स, जिनसे Claude Code कॉन्फ़िगर होता है, ZCode नहीं पढ़ता: उसका प्रोवाइडर सेटिंग्स का अपना स्टोर है। सेटिंग्स से ही कॉन्फ़िगर करें।
  • "मॉडल सेलेक्टर में दिखता है ≠ की के पास क्वोटा है।" मॉडल्स की लिस्ट प्रोवाइडर के API से आती है, और उपलब्धता उस ख़ास की के बैलेंस और लिमिट्स पर निर्भर है।

अब प्रैक्टिस: JoinGonka गेटवे को ZCode से जोड़ते हैं और टोकन्स पर GLM स्टैक पाते हैं।

ZCode में JoinGonka Gateway की सेटिंग: टोकन के बदले GLM

JoinGonka Gateway — एक विकेंद्रीकृत Gonka नेटवर्क का गेटवे है, जिसमें दो नेटिव प्रोटोकॉल हैं: OpenAI-अनुरूप /v1/chat/completions और Anthropic Messages /v1/messages। इकोनॉमी — pay-per-token: कोई 5-घंटे की विंडो नहीं, कोई ×3 पीक मल्टीप्लायर नहीं और कोई एक समानांतर अनुरोध सीमा नहीं; उपयोग डैशबोर्ड में वास्तविक समय में दिखाई देता है, गेटवे प्रॉम्प्ट की सामग्री को स्टोर नहीं करता है।

चरण-दर-चरण (वर्तमान Custom Provider इंटरफ़ेस):

चरणकार्य
1. कुंजीसाइन अप करें — gate.joingonka.ai/register (नए खातों के लिए — 3M मुफ्त टोकन), Keys सेक्शन में API-कुंजी बनाएं। अधिक जानकारी — API Quick Start में।
2. प्रदाताZCode → Settings → Model Settings → Add Provider। Name: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyआपकी jg-… प्रकार की कुंजी
5. API formatChat completions (/chat/completions)
6. मॉडलAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000। इसी तरह MiniMaxAI/MiniMax-M2.7 और zai-org/GLM-5.3-Flash भी जोड़े जाते हैं — स्वयं Z.ai का reasoning-मॉडल; वर्तमान सूची और सीमाएँ — GET /v1/models।

ZCode के पुराने संस्करणों में इसके बजाय दो अलग-अलग फ़ील्ड हैं: OpenAI Base URL (https://gate.joingonka.ai/v1) और Anthropic Base URL (https://gate.joingonka.ai — पथ क्लाइंट स्वयं जोड़ देगा)।

जांच: बनाया गया मॉडल चुनें और एजेंट से कोई भी प्रश्न पूछें। उत्तर आने पर — सब कुछ काम कर रहा है; त्रुटि 401 — कुंजी की जांच करें, 402 — खाता शेष। यदि DeepSeek V4 Flash पर Thought Level Max पर «Model request failed» दिखाई देता है — तो Thought Level को High पर स्विच करें और अनुरोध दोहराएं।

सुझाव: कमांड npx @joingonka/setup --tool zcode इन फ़ील्ड के लिए तैयार मान प्रिंट करेगी — base URL, कुंजी, मॉडल आईडी और इसकी वास्तविक सीमाएँ: संदर्भ विंडो और प्रतिक्रिया सीमा — और लाइव अनुरोध के साथ जांचेगी कि गेटवे उन्हें स्वीकार कर रहा है या नहीं। ZCode स्वयं केवल UI के माध्यम से कॉन्फ़िगर किया जाता है — इसमें कोई ऐसी फ़ाइल नहीं है जिसे सुरक्षित रूप से संपादित किया जा सके, इसलिए मानों को मैन्युअल रूप से डालना होगा।

कीमतों की तुलना: Coding Plan, Z.ai API, OpenRouter और Gonka

विभिन्न चैनलों पर GLM-इंफरेंस की लागत क्या है (1M टोकन के लिए कीमतें; प्रतिस्पर्धियों की कीमतें सितंबर 2026 के अनुसार तय की गई हैं, JoinGonka की कीमत गेटवे API से सीधे पेज पर अपडेट होती है):

चैनलइनपुट, $/1Mआउटपुट, $/1Mभुगतान मॉडल
Z.ai API (GLM-5.2)$1.40 (कैश इनपुट — $0.26)$4.40टोकन के अनुसार
GLM Coding Plan$18—160/माहसदस्यता: «प्रॉम्प्ट» कोटा, पीक पर ×3 मल्टीप्लायर, समानांतर सीमाएं
OpenRouter (z-ai/glm-5.2)$1.40$4.40टोकन के अनुसार
OpenRouter (z-ai/glm-5.3-flash)$0.09$0.30टोकन के अनुसार
JoinGonka Gateway$0.0069$0.021टोकन के अनुसार, Gonka नेटवर्क

दो से तीन ऑर्डर का अंतर कोई मार्केटिंग राउंडिंग नहीं है, बल्कि एक अलग इकोनॉमी है: गणनाएँ विकेंद्रीकृत नेटवर्क के प्रतिभागी करते हैं, जो डेटा-सेंटर के मार्जिन पर नहीं, बल्कि वास्तविक काम पर कमाई करते हैं। यह कैसे काम करता है और इसके दायरे की सीमाएं क्या हैं, इस पर विस्तृत विश्लेषण — सबसे सस्ते AI API वाले लेख में है।

JoinGonka पंक्ति Gonka नेटवर्क में GLM-5.3 Flash की कीमत है: नेटवर्क के सभी मॉडलों के लिए एक समान टैरिफ है। इस पेज के आंकड़े स्वचालित रूप से अपडेट होते हैं, मैन्युअल रूप से कुछ भी पुनर्गणना करने की आवश्यकता नहीं होगी।

Gonka नेटवर्क में GLM: GLM-5.3 Flash और अक्सर पूछे जाने वाले प्रश्न

Gonka नेटवर्क Z.ai मॉडल को होस्ट करता है: zai-org/GLM-5.3-Flash जिसे गवर्नेंस-प्रपोजल #101 द्वारा स्वीकार किया गया है और इसे MiniMax M2.7 और DeepSeek V4 Flash के साथ गेटवे के माध्यम से प्रदान किया जा रहा है। फ्लैगशिप GLM-5.2, जिसका इस गाइड के शुरुआती संस्करणों में उल्लेख किया गया था, नेटवर्क में शामिल नहीं हुआ — नेटवर्क ने उसी लाइन के एक हल्के और तेज़ मॉडल को चुना है। बेस URL और कुंजी वही हैं: ZCode में बस मॉडल को custom provider में जोड़ें।

मॉडल के बारे में: MIT लाइसेंस के तहत ओपन वेट्स, 320B पैरामीटर्स (प्रति टोकन 18B सक्रिय) के साथ MoE आर्किटेक्चर, हाइब्रिड स्पार्स और लीनियर अटेंशन। मुख्य विशेषता यह एक reasoning-model है: उत्तर देने से पहले यह तर्क (reason) करता है, और एक सरल प्रश्न पर भी तर्क करने में कई सौ टोकन लग जाते हैं। ZCode के लिए इसका मतलब दो चीजें हैं: मॉडल की उत्तर लंबाई सीमा को कम न करें (छोटी प्रतिक्रियाओं के लिए भी 600 टोकन से शुरू करें) और त्वरित संपादन के लिए Thought Level कम करें — API स्तर पर यह reasoning_effort: low है। मॉडल और इसकी सीमाओं का विस्तृत विश्लेषण Gonka नेटवर्क पर GLM-5.3 Flash लेख में है।

अक्सर पूछे जाने वाले प्रश्न:

  • नए मॉडल पर 429 या कतार (queue) क्यों होती है? — मॉडल अभी नेटवर्क के कुछ होस्ट्स द्वारा ही सर्विस किया जा रहा है; पीक घंटों के दौरान अनुरोधों को खाली स्लॉट के लिए प्रतीक्षा करनी पड़ सकती है। कुछ सेकंड के बाद अनुरोध दोहराएं — बैलेंसर एक सक्रिय नोड ढूंढ लेगा। वर्तमान स्थिति गेटवे स्टेटस पेज पर उपलब्ध है।
  • और क्या उपलब्ध है? — GLM-5.3 Flash के अलावा — MiniMax M2.7 और DeepSeek V4 Flash: तीनों मॉडल ZCode में उसी custom provider के माध्यम से काम करते हैं, इस गाइड का कॉन्फ़िगरेशन पूरी तरह से काम करता है।
  • प्राइवेसी का क्या? — गेटवे प्रॉम्पट्स और उत्तरों की सामग्री को संग्रहीत नहीं करता है; आंकड़ों में केवल उपयोग का कुल डेटा होता है।
  • Coding Plan कब अधिक फायदेमंद है? — यदि आप अकेले काम करते हैं, Lite कोटा के भीतर रहते हैं और समानांतर एजेंट नहीं चलाते हैं, तो फिक्स्ड प्राइस वाला सब्सक्रिप्शन सुविधाजनक और अनुमानित है। अपने प्रोफाइल के अनुसार गणना करें: सक्रिय एजेंट कार्य के दौरान, नेटवर्क के माध्यम से टोकन के लिए भुगतान काफी सस्ता पड़ता है, दिन में एक-दो बार हल्के कोड संपादन के लिए अंतर महसूस नहीं हो सकता है।
  • क्या यह अन्य टूल के लिए उपयुक्त है? — हाँ: यही endpoint Claude Code, Cursor, Cline और किसी भी OpenAI/Anthropic-compatible क्लाइंट में काम करता है।
ZCode 3.0 एक उल्लेखनीय एजेंटिक IDE है, लेकिन इसकी मूल GLM Coding Plan सब्सक्रिप्शन कोटा पर आधारित है: 5 घंटे की विंडो में 'प्रॉम्पट्स', पीक घंटों में ×3 मल्टीप्लायर और लोअर टियर पर एक समानांतर अनुरोध। लोड जितना अधिक एजेंटिक होगा, यह उतना ही महंगा और अप्रत्याशित होता जाएगा। आधिकारिक BYOK इस समस्या का समाधान करता है: JoinGonka Gateway को custom provider के रूप में कनेक्ट करें — और विकेंद्रीकृत Gonka नेटवर्क की कीमतों पर वास्तविक टोकन के लिए भुगतान करें, जो केंद्रीकृत API से सैकड़ों गुना कम है। Z.ai का ओपन reasoning-model GLM-5.3 Flash — पहले से ही नेटवर्क द्वारा समर्थित है, साथ ही MiniMax M2.7 और DeepSeek V4 Flash भी। मुफ्त शुरुआती टोकन के साथ शुरुआत करें।

अधिक जानना चाहते हैं?

अन्य अनुभागों का अन्वेषण करें या अभी GNK कमाना शुरू करें।

मुफ्त टोकन प्राप्त करें →