ज्ञानकोश अनुभाग ▾
नेविगेशन
▸ यहाँ से शुरू करें भूमिका के अनुसारश्रेणियाँ
- कर्सर + Gonka AI – कोडिंग के लिए सस्ता LLM
- Claude Code + Gonka AI – टर्मिनल के लिए LLM
- OpenClaw + Gonka AI – किफायती AI-एजेंट
- OpenCode + Gonka AI – कोड के लिए मुफ्त AI
- Continue.dev + Gonka AI – VS कोड/JetBrains के लिए AI
- Cline + Gonka AI – VS कोड में AI-एजेंट
- Aider + Gonka AI – AI के साथ युग्म प्रोग्रामिंग
- LangChain + Gonka AI – नाममात्र की लागत पर AI-अनुप्रयोग
- n8n + Gonka AI – सस्ते AI के साथ स्वचालन
- Open WebUI + Gonka AI – अपना ChatGPT
- LibreChat + Gonka AI — ओपन-सोर्स ChatGPT
- Hermes एजेंट + Gonka AI — बहुत कम लागत पर स्वायत्त एजेंट
- Kilo Code + Gonka AI — VS Code में AI-एजेंट
- Roo Code + Gonka AI — VS Code में स्वायत्त AI-एजेंट
- लामाइंडेक्स + गोंका AI - बहुत कम लागत पर RAG-अनुप्रयोग
- पाइडांटिक AI + गोंका - बहुत कम लागत पर टाइप किए गए AI-एजेंट
- वेरसेल AI SDK + गोंका AI - बहुत कम लागत पर टाइपस्क्रिप्ट पर AI-अनुप्रयोग
- टैनस्टैक AI + गोंका - बहुत कम लागत पर टाइपस्क्रिप्ट पर AI-अनुप्रयोग
- API त्वरित शुरुआत — curl, Python, TypeScript
- JoinGonka Gateway — पूर्ण अवलोकन
- प्रबंधन कुंजी — गोनका पर साaएस
- सबसे सस्ता AI API: प्रदाताओं की तुलना 2026
- Cursor Pro रिक्वेस्ट लिमिट समाप्त — विश्लेषण और सस्ता विकल्प
- Claude Code सस्ता है — बिल का विश्लेषण और स्विचिंग
- Cline पैसे जला रहा है — एजेंट इतनी ज्यादा खपत क्यों कर रहा है
- OpenClaw महंगा है — एजेंट टोकन क्यों जलाता है और बचत कैसे करें
- OpenRouter: सस्ता विकल्प — JoinGonka Gateway के साथ तुलना
- कोडिंग 2026 के लिए सर्वश्रेष्ठ AI मॉडल: तुलना और कीमतें
- GitHub Copilot का सस्ता विकल्प बिना लिमिट्स के
- क्रेडिट और लिमिट के बिना किफायती Windsurf विकल्प
- 2026 में AI-एजेंटों के लिए सबसे सस्ता API
- ZCode: GLM Coding Plan के बजाय सस्ता GLM inferencing
- JetBrains IDE + JoinGonka Gateway — क्रेडिट के बजाय अपना endpoint
- GitHub Copilot BYOK — कोटा के बजाय अपने मॉडल
- Zed + JoinGonka Gateway — एडिटर में सस्ता इंफरेंस
- Pi + JoinGonka Gateway — सस्ते इन्फरेंस पर टर्मिनल एजेंट
टूल्स
ZCode: GLM Coding Plan के बजाय सस्ता GLM inferencing
जून 2026 में, Z.ai ने ZCode 3.0 जारी किया — एक डेस्कटॉप एजेंटिक डेवलपमेंट एनवायरनमेंट, जिसे कंपनी खुद «Official Harness for GLM-5.2» कहती है। यह उत्पाद तेजी से चर्चा में आया: अपना एजेंटिक कोर, /goal के माध्यम से स्वायत्त कार्य, multi-agent मोड और सीधे Telegram से रिमोट सेशन प्रबंधन। लेकिन समीक्षाओं के साथ-साथ GLM Coding Plan के पहले सब्सक्राइबरों के सवालों का दौर शुरू हो गया: कोटा पांच घंटे की विंडो में «prompts» के रूप में गिना जाता है, व्यस्त घंटों में खपत तीन गुना हो जाती है, लोअर प्लान में केवल एक पैरेलल रिक्वेस्ट मिलती है, और Hacker News पर काम के व्यस्त दिनों के बाद अचानक ब्लॉक होने की शिकायतें की जा रही हैं।
अच्छी खबर: ZCode आधिकारिक तौर पर custom provider को सपोर्ट करता है — इससे कोई भी OpenAI- या Anthropic-compatible API कनेक्ट किया जा सकता है और सब्सक्रिप्शन कोटों के बजाय वास्तविक टोकन के लिए भुगतान किया जा सकता है। इस गाइड में, हम यह समझेंगे कि ZCode क्या है और GLM Coding Plan कैसे काम करता है, और फिर चरण-दर-चरण ZCode को JoinGonka Gateway पर सेट करेंगे — जो विकेंद्रीकृत नेटवर्क Gonka का एक गेटवे है, जिसकी रजिस्ट्री में GLM-5.2 पहले से ही जोड़ा जा चुका है। परिणाम: वही टूल, वही open-weight मॉडल, लेकिन अर्थव्यवस्था टोकन पर आधारित और केंद्रीकृत API की तुलना में सैकड़ों गुना सस्ती।
ZCode क्या है: Z.ai का एजेंटिक डेवलपमेंट एनवायरनमेंट
ZCode «चैट साइडबार वाला एडिटर» नहीं है, बल्कि एक ADE है: आप लक्ष्य का वर्णन करते हैं, एजेंट प्लान बनाता है, फाइलें एडिट करता है, जांच शुरू करता है और परिणाम तक पुनरावृति करता है। यह macOS और Windows पर डेस्कटॉप एप्लिकेशन के रूप में काम करता है (Linux के लिए बिल्ड — बीटा स्टेटस में)।
वर्जन 3.0 की प्रमुख विशेषताएं:
- ZCode Agent — GLM-5.2 के साथ गहरे एकीकरण वाला अपना एजेंटिक कोर; इसके अलावा थर्ड-पार्टी एजेंट (Claude Code, Codex, Gemini CLI और अन्य) जोड़े जा सकते हैं;
- Goal-मोड (
/goal) — लंबे स्वायत्त कार्य: प्लान → निष्पादन → चरणों द्वारा सत्यापन; - Multi-agent — एक प्रोजेक्ट पर कई एजेंटों का समानांतर काम;
- रिमोट प्रबंधन — Telegram, WeChat और Feishu से सेशन लॉन्च और नियंत्रण: एजेंट आपकी मशीन पर चलता है, और आप फोन से सवालों के जवाब देते हैं।
क्लाइंट खुद मुफ्त है, Z.ai नए उपयोगकर्ताओं को परिचित होने के लिए GLM-5.2 टोकन का दैनिक कोटा देता है। उसके बाद — या तो GLM Coding Plan की सब्सक्रिप्शन लें या अपना API-की (key) इस्तेमाल करें। यहाँ विस्तार से समझना जरूरी है, क्योंकि सब्सक्रिप्शन का स्ट्रक्चर ही उत्पाद का सबसे चर्चित हिस्सा है।
GLM Coding Plan: कीमत, सीमाएं और कोटा
GLM Coding Plan — Z.ai की सब्सक्रिप्शन है, जो ZCode और दो दर्जन थर्ड-पार्टी टूल्स में GLM मॉडल तक पहुंच प्रदान करती है। प्रकाशन के समय (जुलाई 2026) बुनियादी स्ट्रक्चर इस प्रकार दिखता है — लेकिन कीमतें और ऑफर बदलते रहते हैं, z.ai/subscribe की लाइव पेज देखें:
| प्लान | कीमत, $/महीना | कोटा | समानांतर रिक्वेस्ट |
|---|---|---|---|
| Lite | $18 (ऑफर में — ~$12.6 से) | 5 घंटे की विंडो में «prompts» + साप्ताहिक सीमा | 1 |
| Pro | $72 | Lite का ×4 | 1 |
| Max | $160 | Lite का ×16 | 30 तक |
सब्सक्राइबर क्या शिकायत करते हैं (Hacker News और GitHub थ्रेड्स):
- पीक मल्टीप्लायर (Peak Multiplier)। व्यस्त घंटों के दौरान (14:00—18:00 UTC+8 — एशिया में शाम, यूरोप में सुबह-दोपहर) प्रत्येक रिक्वेस्ट कोटा को ×3 के गुणांक के साथ काटती है, और नॉन-पीक समय में — ×2। खर्च की योजना बीजिंग के टाइम जोन के अनुसार बनानी पड़ती है।
- टोकन नहीं, «prompts» का कोटा। यह पारदर्शी नहीं है कि कितने टोकन बचे हैं; थ्रेड्स में ऐसी कहानियां मिलती हैं कि «GLM पर ~17M टोकन खर्च किए — और चार दिनों के लिए ब्लॉक हो गए»।
- Lite और Pro पर एक समानांतर रिक्वेस्ट। एजेंटिक एनवायरनमेंट के लिए यह काफी महसूस होता है: ZCode का अपना multi-agent मोड और कोई भी समानांतर सब-एजेंट कतार (queue) में फंस जाते हैं।
- GLM-5.2 छोटे मॉडलों की तुलना में कोटा तेजी से खर्च करता है — फ्लैगशिप मॉडल अपने मल्टीप्लायर के साथ लिमिट को तेजी से जलाता है।
निष्कर्ष आसान है: सामान्य सोलो-डेवलपमेंट के लिए सब्सक्रिप्शन ईमानदारी से काम करता है। लेकिन आपका मोड जितना «एजेंटिक» होगा — समानांतर कार्य, लंबे स्वायत्त सेशन, रात भर चलने वाले रन — कोटा मॉडल उतना ही लॉटरी में बदल जाता है। विकल्प — वास्तविक टोकन के लिए भुगतान: बिना विंडो, मल्टीप्लायर और कतारों के — जितना एजेंट ने खर्च किया, उतना ही काटा गया। ZCode में अंतर्निहित custom provider मैकेनिज्म यही मॉडल प्रदान करता है, और इसे पांच मिनट में सेटअप किया जा सकता है।
ZCode में BYOK: अपना API-की और custom provider
ZCode में आधिकारिक तौर पर BYOK सपोर्ट दिया गया है: डॉक्यूमेंटेशन स्पष्ट रूप से "OpenAI या Anthropic प्रोटोकॉल के साथ संगत किसी भी सर्विस" को जोड़ने की अनुमति देता है — जिसमें पब्लिक API, कॉर्पोरेट चैनल और यहां तक कि self-hosted इंस्टॉलेशन भी शामिल हैं। इसे तीन तरीकों से कॉन्फ़िगर किया जा सकता है:
- वेलकम स्क्रीन पर Connect बटन → "Set Your API Key";
- मॉडल सिलेक्शन में Manage Models;
- गियर आइकन → Settings → Model Settings → Add Provider.
प्रदाता को OpenAI Base URL और/या Anthropic Base URL के साथ API Key सेट करनी होती है — ZCode उपलब्ध मॉडल्स की सूची खुद ही अपडेट कर लेगा।
तीन आम गलतियां जिनसे अक्सर बचना चाहिए:
- Z.ai के एंडपॉइंट्स अलग-अलग होते हैं। Coding Plan सब्सक्रिप्शन केवल coding-endpoint
https://api.z.ai/api/coding/paas/v4के माध्यम से काम करता है; सब्सक्रिप्शन की के साथ सामान्य/api/paas/v4त्रुटि दिखाएगा — यह 401/429 एरर का सबसे आम कारण है, भले ही प्लान का भुगतान किया गया हो। - "Claude Code में काम करता है ≠ ZCode में काम करेगा"। Claude Code को सेटअप करने वाली एनवायरनमेंट वैरिएबल्स (जैसे
ANTHROPIC_BASE_URL), को ZCode नहीं पढ़ता है: इसमें अपना खुद का प्रदाता सेटिंग्स स्टोरेज होता है। इसे Settings के जरिए ही कॉन्फ़िगर करें। - "मॉडल सेलेक्टर में दिख रहा है ≠ की (key) के पास कोटा है"। मॉडल्स की लिस्ट प्रदाता के API से आती है, लेकिन उपलब्धता बैलेंस और की (key) की लिमिट पर निर्भर करती है।
इसके बाद प्रैक्टिकल शुरू होता है: ZCode से JoinGonka गेटवे को जोड़ें और टोकन के बदले GLM-स्टैक प्राप्त करें।
ZCode में JoinGonka Gateway की सेटिंग: टोकन के बदले GLM
JoinGonka Gateway — विकेंद्रीकृत Gonka नेटवर्क के लिए गेटवे, दो नेटिव प्रोटोकॉल के साथ: OpenAI-संगत /v1/chat/completions और Anthropic Messages /v1/messages। इकोनॉमी — pay-per-token: कोई 5-घंटे की विंडो नहीं, कोई ×3 पीक मल्टीप्लायर नहीं और न ही सिंगल समानांतर अनुरोध की कोई सीमा; खपत डैशबोर्ड में वास्तविक समय में दिखाई देती है, गेटवे प्रॉम्प्ट की सामग्री को स्टोर नहीं करता है।
स्टेप-बाय-स्टेप (वर्तमान कस्टम प्रोवाइडर इंटरफ़ेस):
| स्टेप | एक्शन |
|---|---|
| 1. की | रजिस्टर करें — gate.joingonka.ai/register (नए खातों के लिए — 10M फ्री टोकन), Keys सेक्शन में API-की बनाएं। अधिक जानकारी — API Quick Start में। |
| 2. प्रोवाइडर | ZCode → Settings → Model Settings → Add Provider. Name: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | आपकी jg-… वाली की |
| 5. API फॉर्मेट | Chat completions (/chat/completions) |
| 6. मॉडल | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000। इसी तरह moonshotai/Kimi-K2.6 और MiniMaxAI/MiniMax-M2.7 जोड़े जाते हैं; वर्तमान सूची — GET /v1/models। |
ZCode के पुराने वर्ज़न में इसके बजाय दो अलग-अलग फ़ील्ड हैं: OpenAI Base URL (https://gate.joingonka.ai/v1) और Anthropic Base URL (https://gate.joingonka.ai — पाथ क्लाइंट खुद जोड़ लेगा)।
सत्यापन: बनाए गए मॉडल को चुनें और एजेंट से कोई भी सवाल पूछें। उत्तर मिल गया — तो सब कुछ काम कर रहा है; त्रुटि 401 — की जांचें, 402 — अकाउंट बैलेंस। यदि DeepSeek V4 Flash पर Thought Level Max होने पर «Model request failed» आता है — तो Thought Level को High पर स्विच करें और अनुरोध दोहराएं।
सुझाव: कमांड npx @joingonka/setup --tool zcode नीचे दिए गए फ़ील्ड्स के लिए तैयार मान (base URL, की, मॉडल ID और वर्तमान लिमिट्स) प्रिंट करेगा और लाइव रिक्वेस्ट के साथ जांचेगा कि गेटवे उन्हें स्वीकार करता है या नहीं। ZCode को केवल UI के माध्यम से कॉन्फ़िगर किया जाता है — इसमें कोई ऐसी फ़ाइल नहीं है जिसे सुरक्षित रूप से संपादित किया जा सके, इसलिए मानों को हाथ से दर्ज करना होगा।
कीमतों की तुलना: Coding Plan, Z.ai API, OpenRouter और Gonka
विभिन्न चैनलों पर GLM-inferencing की लागत क्या है (1M टोकन के लिए कीमतें; प्रतिस्पर्धियों की कीमतें जुलाई 2026 के लिए तय की गई हैं, JoinGonka की कीमत API गेटवे से सीधे पेज पर ली जाती है):
| चैनल | इनपुट, $/1M | आउटपुट, $/1M | भुगतान मॉडल |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (कैश्ड इनपुट — $0.26) | $4.40 | टोकन के आधार पर |
| GLM Coding Plan | $18—160/माह | सदस्यता: 'प्रॉम्प्ट' कोटा, पीक पर ×3 मल्टीप्लायर, समानांतर सीमाएं | |
| OpenRouter (z-ai/glm-5.2) | $0.93 | $3.00 | टोकन के आधार पर; GLM-5.2 का कोई मुफ्त विकल्प नहीं है |
| JoinGonka Gateway | $0.0032 | $0.0097 | टोकन के आधार पर, Gonka नेटवर्क |
दो से तीन ऑर्डर की परिमाण का अंतर मार्केटिंग का राउंडिंग नहीं है, बल्कि एक अलग अर्थशास्त्र है: गणना विकेंद्रीकृत नेटवर्क के प्रतिभागियों द्वारा की जाती है, जो डेटा सेंटर मार्जिन पर नहीं, बल्कि वास्तविक काम पर कमाई करते हैं। यह कैसे काम करता है और इसकी प्रयोज्यता की सीमाएं क्या हैं, इसका विस्तृत विश्लेषण सबसे सस्ते AI API पर लेख में दिया गया है।
GLM-5.2 के बारे में निष्पक्ष अस्वीकरण: नेटवर्क मॉडल की सटीक कीमत सक्रियण के समय निर्धारित करेगा (ऊपर दी गई तालिका में - नेटवर्क मॉडल की वर्तमान लाइव कीमत)। इस पेज पर आंकड़े स्वचालित रूप से अपडेट होते हैं, कुछ भी मैन्युअल रूप से पुनर्गणना करने की आवश्यकता नहीं है।
Gonka नेटवर्क में GLM-5.2: स्टेटस और सामान्य सवाल
मॉडल zai-org/GLM-5.2-FP8 को पहले ही Gonka नेटवर्क की ऑन-चेन रजिस्ट्री में जोड़ दिया गया है: कॉन्फ़िगरेशन 400K टोकन तक का संदर्भ विंडो सेट करता है, और मॉडल स्वयं भारी मॉडलों में से है (एक प्रतिकृति के लिए एक टेराबाइट से अधिक वीडियो मेमोरी की आवश्यकता होती है)। वर्तमान में रोलआउट चल रहा है: नेटवर्क नोड्स वेट्स को गर्म (warm up) कर रहे हैं। जैसे ही चेक हरे हो जाएंगे, मॉडल स्वचालित रूप से गेटवे के मॉडल सूची में दिखाई देगा — बेस URL और कुंजी नहीं बदलती है, ZCode में बस सेलेक्टर में इसे चुनना पर्याप्त होगा।
मॉडल के बारे में: MIT लाइसेंस के तहत ओपन वेट्स, ~750B पैरामीटर पर MoE आर्किटेक्चर (प्रति टोकन लगभग 40B सक्रिय), 1M टोकन तक की नेटिव विंडो। Z.ai के आंकड़ों के अनुसार, SWE-bench Pro पर मॉडल 62.1 का स्कोर दिखाता है — जो GPT-5.5 से अधिक है, और FrontierSWE पर Claude Opus 4.8 से लगभग एक प्रतिशत पीछे है। ओपन-वेट मॉडल के लिए, यह कोडिंग में शीर्ष पंक्ति है।
अक्सर पूछे जाने वाले प्रश्न:
- नया मॉडल चालू करने के तुरंत बाद 429 एरर क्यों आते हैं? — यह रोलआउट चरण है: कुछ नोड्स अभी भी वेट्स लोड कर रहे हैं। कुछ सेकंड के बाद अनुरोध दोहराएं — बैलेंसर एक सक्रिय नोड ढूंढ लेगा।
- आज क्या उपलब्ध है? — Kimi K2.6, MiniMax M2.7 और DeepSeek V4 Flash: ये तीनों मॉडल ZCode में उसी कस्टम प्रदाता के माध्यम से काम करते हैं, इस गाइड का कॉन्फ़िगरेशन अभी काम कर रहा है।
- गोपनीयता के बारे में क्या? — गेटवे प्रॉम्प्ट और उत्तर की सामग्री को संग्रहीत नहीं करता है; सांख्यिकी में केवल खपत का कुल योग होता है।
- Coding Plan कब अधिक फायदेमंद है? — यदि आप अकेले काम करते हैं, Lite कोटे के भीतर रहते हैं, और समानांतर एजेंट नहीं चलाते हैं, तो एक निश्चित चेक के साथ सदस्यता सुविधाजनक और पूर्वानुमानित है। अपने प्रोफाइल के अनुसार गणना करें: सक्रिय एजेंट कार्य के दौरान, नेटवर्क के माध्यम से टोकन के लिए भुगतान कई गुना सस्ता होता है, लेकिन हल्के कोड संपादन के लिए अंतर महसूस नहीं हो सकता है।
- क्या यह अन्य उपकरणों के लिए उपयुक्त है? — हाँ: वही एंडपॉइंट Claude Code, Cursor, Cline और किसी भी OpenAI/Anthropic-संगत क्लाइंट में काम करता है।
अधिक जानना चाहते हैं?
अन्य अनुभागों का अन्वेषण करें या अभी GNK कमाना शुरू करें।
10M मुफ्त टोकन प्राप्त करें →