ज्ञानकोश अनुभाग ▾
नेविगेशन
▸ यहाँ से शुरू करें भूमिका के अनुसारश्रेणियाँ
- कर्सर + Gonka AI – कोडिंग के लिए सस्ता LLM
- Claude Code + Gonka AI – टर्मिनल के लिए LLM
- OpenClaw + Gonka AI – किफायती AI-एजेंट
- OpenCode: टर्मिनल में अपना मॉडल
- Continue.dev + Gonka AI – VS कोड/JetBrains के लिए AI
- Cline + Gonka AI – VS कोड में AI-एजेंट
- Aider + Gonka AI – AI के साथ युग्म प्रोग्रामिंग
- LangChain + Gonka AI – नाममात्र की लागत पर AI-अनुप्रयोग
- n8n + Gonka AI – सस्ते AI के साथ स्वचालन
- Open WebUI + Gonka AI – अपना ChatGPT
- LibreChat + Gonka AI — ओपन-सोर्स ChatGPT
- Hermes Agent + DeepSeek, Gonka नेटवर्क पर — स्वायत्त एजेंट कौड़ियों के भाव
- Kilo Code + Gonka AI — VS Code में AI-एजेंट
- Roo Code + Gonka AI — VS Code में स्वायत्त AI-एजेंट
- लामाइंडेक्स + गोंका AI - बहुत कम लागत पर RAG-अनुप्रयोग
- पाइडांटिक AI + गोंका - बहुत कम लागत पर टाइप किए गए AI-एजेंट
- वेरसेल AI SDK + गोंका AI - बहुत कम लागत पर टाइपस्क्रिप्ट पर AI-अनुप्रयोग
- टैनस्टैक AI + गोंका - बहुत कम लागत पर टाइपस्क्रिप्ट पर AI-अनुप्रयोग
- API त्वरित शुरुआत — curl, Python, TypeScript
- JoinGonka Gateway — पूर्ण अवलोकन
- प्रबंधन कुंजी — गोनका पर साaएस
- सबसे सस्ता AI API: प्रदाताओं की तुलना 2026
- AI टोकन और API-की कैसे खरीदें: 2026 में 3 तरीके
- Cursor Pro रिक्वेस्ट लिमिट समाप्त — विश्लेषण और सस्ता विकल्प
- Claude Code सस्ता है — बिल का विश्लेषण और स्विचिंग
- Cline पैसे जला रहा है — एजेंट इतनी ज्यादा खपत क्यों कर रहा है
- OpenClaw महंगा है — एजेंट टोकन क्यों जलाता है और बचत कैसे करें
- OpenRouter: सस्ता विकल्प — JoinGonka Gateway के साथ तुलना
- कोडिंग 2026 के लिए सर्वश्रेष्ठ AI मॉडल: तुलना और कीमतें
- GitHub Copilot का सस्ता विकल्प बिना लिमिट्स के
- क्रेडिट और लिमिट के बिना किफायती Windsurf विकल्प
- 2026 में AI-एजेंटों के लिए सबसे सस्ता API
- ZCode: GLM Coding Plan के बजाय सस्ता GLM inferencing
- JetBrains IDE + JoinGonka Gateway — क्रेडिट के बजाय अपना endpoint
- GitHub Copilot BYOK — कोटा के बजाय अपने मॉडल
- Zed + JoinGonka Gateway — एडिटर में सस्ता इंफरेंस
- Pi + JoinGonka Gateway — सस्ते इन्फरेंस पर टर्मिनल एजेंट
- Codex CLI: सब्सक्रिप्शन के बजाय अपनी चाबी
- DeepSeek Harness: JoinGonka Gateway के माध्यम से अपना प्रोवाइडर
- MiniMax Code: Gonka के माध्यम से अपनी कुंजी पर MiniMax एजेंट
- Warp + JoinGonka Gateway — अपने endpoint पर टर्मिनल एजेंट
- Trae + JoinGonka Gateway — AI-IDE में Gonka नेटवर्क मॉडल
- Cherry Studio + JoinGonka Gateway — डेस्कटॉप AI-क्लाइंट
- omp (Oh My Pi) + JoinGonka Gateway: मॉडल भूमिकाओं वाला एजेंट
- OpenHands + JoinGonka Gateway: अपने एंडपॉइंट पर एजेंट
- qwen-oauth के बंद होने के बाद Qwen Code: JoinGonka Gateway के माध्यम से कार्य
- Goose + JoinGonka Gateway: अपना प्रोवाइडर और keyring में की
- Crush + JoinGonka Gateway: Gonka नेटवर्क मॉडल पर Charm एजेंट
- Zoo Code + JoinGonka Gateway: Roo Code से Gonka मॉडल पर माइग्रेशन
- Kimi Code CLI: Gonka के माध्यम से अपनी कुंजी पर Moonshot AI एजेंट
- Factory Droid + JoinGonka Gateway: Gonka नेटवर्क मॉडल पर BYOK
- MiMo Code + JoinGonka Gateway: Gonka नेटवर्क मॉडल पर Xiaomi एजेंट
टूल्स
ZCode: GLM Coding Plan के बजाय सस्ता GLM inferencing
जून 2026 में, Z.ai ने ZCode 3.0 जारी किया — एक डेस्कटॉप एजेंट विकास वातावरण, जिसे कंपनी स्वयं 'Official Harness for GLM-5.2' कहती है। उत्पाद ने जल्दी ही ध्यान आकर्षित किया: स्वयं का एजेंट कोर, /goal के माध्यम से स्वायत्त कार्य, मल्टी-एजेंट मोड और सीधे Telegram से रिमोट सेशन प्रबंधन। लेकिन समीक्षाओं की लहर के साथ, GLM Coding Plan के पहले ग्राहकों से प्रश्नों की लहर भी आई: कोटा को पांच घंटे की खिड़कियों में 'प्रॉम्प्ट्स' के रूप में गिना जाता है, पीक आवर्स के दौरान खपत तीन गुना बढ़ जाती है, निचले टैरिफ पर केवल एक समानांतर अनुरोध होता है, और Hacker News पर उपयोगकर्ता काम के व्यस्त दिन के बाद अचानक ब्लॉकिंग की शिकायत करते हैं।
अच्छी खबर: ZCode आधिकारिक तौर पर custom provider का समर्थन करता है — इससे कोई भी OpenAI- या Anthropic-संगत API कनेक्ट किया जा सकता है और सब्सक्रिप्शन कोटे के बजाय वास्तविक टोकन के लिए भुगतान किया जा सकता है। इस गाइड में, हम समझेंगे कि ZCode क्या है और GLM Coding Plan कैसे काम करता है, और फिर चरण-दर-चरण JoinGonka Gateway पर ZCode को सेटअप करेंगे — जो विकेंद्रीकृत Gonka नेटवर्क का गेटवे है, जो Z.ai के स्वयं के ओपन रीजनिंग-मॉडल GLM-5.3 Flash को सर्व करता है। परिणाम: वही उपकरण, वही ओपन-वेट मॉडल, लेकिन अर्थव्यवस्था टोकन पर आधारित है और केंद्रीकृत API की तुलना में कई गुना सस्ती है।
ZCode क्या है: Z.ai का एजेंटिक डेवलपमेंट एनवायरनमेंट
ZCode «चैट साइडबार वाला एडिटर» नहीं है, बल्कि एक ADE है: आप लक्ष्य का वर्णन करते हैं, एजेंट प्लान बनाता है, फाइलें एडिट करता है, जांच शुरू करता है और परिणाम तक पुनरावृति करता है। यह macOS और Windows पर डेस्कटॉप एप्लिकेशन के रूप में काम करता है (Linux के लिए बिल्ड — बीटा स्टेटस में)।
वर्जन 3.0 की प्रमुख विशेषताएं:
- ZCode Agent — GLM-5.2 के साथ गहरे एकीकरण वाला अपना एजेंटिक कोर; इसके अलावा थर्ड-पार्टी एजेंट (Claude Code, Codex, Gemini CLI और अन्य) जोड़े जा सकते हैं;
- Goal-मोड (
/goal) — लंबे स्वायत्त कार्य: प्लान → निष्पादन → चरणों द्वारा सत्यापन; - Multi-agent — एक प्रोजेक्ट पर कई एजेंटों का समानांतर काम;
- रिमोट प्रबंधन — Telegram, WeChat और Feishu से सेशन लॉन्च और नियंत्रण: एजेंट आपकी मशीन पर चलता है, और आप फोन से सवालों के जवाब देते हैं।
क्लाइंट खुद मुफ्त है, Z.ai नए उपयोगकर्ताओं को परिचित होने के लिए GLM-5.2 टोकन का दैनिक कोटा देता है। उसके बाद — या तो GLM Coding Plan की सब्सक्रिप्शन लें या अपना API-की (key) इस्तेमाल करें। यहाँ विस्तार से समझना जरूरी है, क्योंकि सब्सक्रिप्शन का स्ट्रक्चर ही उत्पाद का सबसे चर्चित हिस्सा है।
GLM Coding Plan: कीमत, सीमाएं और कोटा
GLM Coding Plan, Z.ai की सब्सक्रिप्शन है जो ZCode और दो दर्जन से ज़्यादा बाहरी टूल्स में GLM मॉडल्स तक पहुँच देती है। प्रकाशन के समय (जुलाई 2026) बेसिक स्लैब ऐसा है — लेकिन कीमतें और ऑफ़र बदलते रहते हैं, z.ai/subscribe का लाइव पेज देखते रहें:
| प्लान | कीमत, $/माह | कोटा | समांतर अनुरोध |
|---|---|---|---|
| Lite | $18 (ऑफ़र में — ~$12.6 से) | 5-घंटे की विंडो में "prompt" + साप्ताहिक सीमा | 1 |
| Pro | $72 | Lite से ×4 | 1 |
| Max | $160 | Lite से ×16 | 30 तक |
सब्सक्राइबर किन बातों की शिकायत करते हैं (Hacker News और GitHub थ्रेड्स):
- पीक मल्टीप्लायर। पीक आवर्स (14:00—18:00 UTC+8 — एशिया की शाम, यूरोप की सुबह-दोपहर) में हर अनुरोध कोटा ×3 गुणांक से काटता है, पीक के बाहर ×2। खर्च की योजना बीजिंग टाइमज़ोन के हिसाब से बनानी पड़ती है।
- कोटा "prompt" में, टोकन में नहीं। बिल्कुल कितने टोकन बचे हैं — यह पारदर्शी नहीं; थ्रेड्स में "GLM पर ~17M टोकन जला दिए — और चार दिन का ब्लॉक मिला" जैसी कहानियाँ मिलती हैं।
- Lite और Pro पर एक समांतर अनुरोध। एजेंटिक माहौल के लिए यह महसूस होता है: ख़ुद ZCode का multi-agent मोड और कोई भी समांतर सब-एजेंट कतार में फँस जाते हैं।
- GLM-5.2 कोटा जल्दी खर्च करता है छोटे मॉडल्स से — फ़्लैगशिप अपने अलग गुणांक से लिमिट जलाता है।
निष्कर्ष सीधा है: शांत सोलो डेवलपमेंट के लिए सब्सक्रिप्शन ईमानदारी से काम करती है। लेकिन आपका मोड जितना ज़्यादा "एजेंटिक" होगा — समांतर काम, लंबे ऑटोनॉमस सेशन, रात के रन — उतनी ही बार कोटा मॉडल लॉटरी बन जाएगा। विकल्प है असली टोकन के लिए भुगतान: बिना विंडो, बिना गुणांक, बिना कतार — एजेंट ने जितना खर्च किया, उतना ही कटा। यही मॉडल ZCode में पहले से मौजूद custom provider मेकैनिज़्म देता है, और सेटअप पाँच मिनट में हो जाता है।
ZCode में BYOK: अपना API-की और custom provider
ZCode में BYOK की सपोर्ट ऑफ़िशियली बिल्ट-इन है: डॉक्युमेंटेशन सीधे इजाज़त देता है कि "OpenAI या Anthropic प्रोटोकॉल से कम्पैटिबल कोई भी सर्विस" जोड़ी जा सकती है — पब्लिक API, कॉर्पोरेट चैनल, यहाँ तक कि self-hosted इंस्टॉलेशन भी। इसे तीन तरीक़ों से सेट किया जाता है:
- वेलकम स्क्रीन पर Connect बटन → "Set Your API Key";
- मॉडल सेलेक्टर में Manage Models;
- गियर आइकन → Settings → Model Settings → Add Provider।
प्रोवाइडर के लिए OpenAI Base URL और/या Anthropic Base URL के साथ API Key सेट करें — उपलब्ध मॉडल्स की लिस्ट ZCode ख़ुद खींच लेगा।
तीन सबसे आम ठोकरें:
- Z.ai के endpoint अलग-अलग हैं। Coding Plan सब्सक्रिप्शन सिर्फ़ coding-endpoint
https://api.z.ai/api/coding/paas/v4से काम करता है; सब्सक्रिप्शन की के साथ आम/api/paas/v4एरर देगा — "प्लान पेड है फिर भी 401/429 आ रहा है" की क्लासिक वजह। - "Claude Code में चलता है ≠ ZCode में चलता है।"
ANTHROPIC_BASE_URLजैसे env वेरिएबल्स, जिनसे Claude Code कॉन्फ़िगर होता है, ZCode नहीं पढ़ता: उसका प्रोवाइडर सेटिंग्स का अपना स्टोर है। सेटिंग्स से ही कॉन्फ़िगर करें। - "मॉडल सेलेक्टर में दिखता है ≠ की के पास क्वोटा है।" मॉडल्स की लिस्ट प्रोवाइडर के API से आती है, और उपलब्धता उस ख़ास की के बैलेंस और लिमिट्स पर निर्भर है।
अब प्रैक्टिस: JoinGonka गेटवे को ZCode से जोड़ते हैं और टोकन्स पर GLM स्टैक पाते हैं।
ZCode में JoinGonka Gateway की सेटिंग: टोकन के बदले GLM
JoinGonka Gateway — एक विकेंद्रीकृत Gonka नेटवर्क का गेटवे है, जिसमें दो नेटिव प्रोटोकॉल हैं: OpenAI-अनुरूप /v1/chat/completions और Anthropic Messages /v1/messages। इकोनॉमी — pay-per-token: कोई 5-घंटे की विंडो नहीं, कोई ×3 पीक मल्टीप्लायर नहीं और कोई एक समानांतर अनुरोध सीमा नहीं; उपयोग डैशबोर्ड में वास्तविक समय में दिखाई देता है, गेटवे प्रॉम्प्ट की सामग्री को स्टोर नहीं करता है।
चरण-दर-चरण (वर्तमान Custom Provider इंटरफ़ेस):
| चरण | कार्य |
|---|---|
| 1. कुंजी | साइन अप करें — gate.joingonka.ai/register (नए खातों के लिए — 3M मुफ्त टोकन), Keys सेक्शन में API-कुंजी बनाएं। अधिक जानकारी — API Quick Start में। |
| 2. प्रदाता | ZCode → Settings → Model Settings → Add Provider। Name: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | आपकी jg-… प्रकार की कुंजी |
| 5. API format | Chat completions (/chat/completions) |
| 6. मॉडल | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000। इसी तरह MiniMaxAI/MiniMax-M2.7 और zai-org/GLM-5.3-Flash भी जोड़े जाते हैं — स्वयं Z.ai का reasoning-मॉडल; वर्तमान सूची और सीमाएँ — GET /v1/models। |
ZCode के पुराने संस्करणों में इसके बजाय दो अलग-अलग फ़ील्ड हैं: OpenAI Base URL (https://gate.joingonka.ai/v1) और Anthropic Base URL (https://gate.joingonka.ai — पथ क्लाइंट स्वयं जोड़ देगा)।
जांच: बनाया गया मॉडल चुनें और एजेंट से कोई भी प्रश्न पूछें। उत्तर आने पर — सब कुछ काम कर रहा है; त्रुटि 401 — कुंजी की जांच करें, 402 — खाता शेष। यदि DeepSeek V4 Flash पर Thought Level Max पर «Model request failed» दिखाई देता है — तो Thought Level को High पर स्विच करें और अनुरोध दोहराएं।
सुझाव: कमांड npx @joingonka/setup --tool zcode इन फ़ील्ड के लिए तैयार मान प्रिंट करेगी — base URL, कुंजी, मॉडल आईडी और इसकी वास्तविक सीमाएँ: संदर्भ विंडो और प्रतिक्रिया सीमा — और लाइव अनुरोध के साथ जांचेगी कि गेटवे उन्हें स्वीकार कर रहा है या नहीं। ZCode स्वयं केवल UI के माध्यम से कॉन्फ़िगर किया जाता है — इसमें कोई ऐसी फ़ाइल नहीं है जिसे सुरक्षित रूप से संपादित किया जा सके, इसलिए मानों को मैन्युअल रूप से डालना होगा।
कीमतों की तुलना: Coding Plan, Z.ai API, OpenRouter और Gonka
विभिन्न चैनलों पर GLM-इंफरेंस की लागत क्या है (1M टोकन के लिए कीमतें; प्रतिस्पर्धियों की कीमतें सितंबर 2026 के अनुसार तय की गई हैं, JoinGonka की कीमत गेटवे API से सीधे पेज पर अपडेट होती है):
| चैनल | इनपुट, $/1M | आउटपुट, $/1M | भुगतान मॉडल |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (कैश इनपुट — $0.26) | $4.40 | टोकन के अनुसार |
| GLM Coding Plan | $18—160/माह | सदस्यता: «प्रॉम्प्ट» कोटा, पीक पर ×3 मल्टीप्लायर, समानांतर सीमाएं | |
| OpenRouter (z-ai/glm-5.2) | $1.40 | $4.40 | टोकन के अनुसार |
| OpenRouter (z-ai/glm-5.3-flash) | $0.09 | $0.30 | टोकन के अनुसार |
| JoinGonka Gateway | $0.0069 | $0.021 | टोकन के अनुसार, Gonka नेटवर्क |
दो से तीन ऑर्डर का अंतर कोई मार्केटिंग राउंडिंग नहीं है, बल्कि एक अलग इकोनॉमी है: गणनाएँ विकेंद्रीकृत नेटवर्क के प्रतिभागी करते हैं, जो डेटा-सेंटर के मार्जिन पर नहीं, बल्कि वास्तविक काम पर कमाई करते हैं। यह कैसे काम करता है और इसके दायरे की सीमाएं क्या हैं, इस पर विस्तृत विश्लेषण — सबसे सस्ते AI API वाले लेख में है।
JoinGonka पंक्ति Gonka नेटवर्क में GLM-5.3 Flash की कीमत है: नेटवर्क के सभी मॉडलों के लिए एक समान टैरिफ है। इस पेज के आंकड़े स्वचालित रूप से अपडेट होते हैं, मैन्युअल रूप से कुछ भी पुनर्गणना करने की आवश्यकता नहीं होगी।
Gonka नेटवर्क में GLM: GLM-5.3 Flash और अक्सर पूछे जाने वाले प्रश्न
Gonka नेटवर्क Z.ai मॉडल को होस्ट करता है: zai-org/GLM-5.3-Flash जिसे गवर्नेंस-प्रपोजल #101 द्वारा स्वीकार किया गया है और इसे MiniMax M2.7 और DeepSeek V4 Flash के साथ गेटवे के माध्यम से प्रदान किया जा रहा है। फ्लैगशिप GLM-5.2, जिसका इस गाइड के शुरुआती संस्करणों में उल्लेख किया गया था, नेटवर्क में शामिल नहीं हुआ — नेटवर्क ने उसी लाइन के एक हल्के और तेज़ मॉडल को चुना है। बेस URL और कुंजी वही हैं: ZCode में बस मॉडल को custom provider में जोड़ें।
मॉडल के बारे में: MIT लाइसेंस के तहत ओपन वेट्स, 320B पैरामीटर्स (प्रति टोकन 18B सक्रिय) के साथ MoE आर्किटेक्चर, हाइब्रिड स्पार्स और लीनियर अटेंशन। मुख्य विशेषता यह एक reasoning-model है: उत्तर देने से पहले यह तर्क (reason) करता है, और एक सरल प्रश्न पर भी तर्क करने में कई सौ टोकन लग जाते हैं। ZCode के लिए इसका मतलब दो चीजें हैं: मॉडल की उत्तर लंबाई सीमा को कम न करें (छोटी प्रतिक्रियाओं के लिए भी 600 टोकन से शुरू करें) और त्वरित संपादन के लिए Thought Level कम करें — API स्तर पर यह reasoning_effort: low है। मॉडल और इसकी सीमाओं का विस्तृत विश्लेषण Gonka नेटवर्क पर GLM-5.3 Flash लेख में है।
अक्सर पूछे जाने वाले प्रश्न:
- नए मॉडल पर 429 या कतार (queue) क्यों होती है? — मॉडल अभी नेटवर्क के कुछ होस्ट्स द्वारा ही सर्विस किया जा रहा है; पीक घंटों के दौरान अनुरोधों को खाली स्लॉट के लिए प्रतीक्षा करनी पड़ सकती है। कुछ सेकंड के बाद अनुरोध दोहराएं — बैलेंसर एक सक्रिय नोड ढूंढ लेगा। वर्तमान स्थिति गेटवे स्टेटस पेज पर उपलब्ध है।
- और क्या उपलब्ध है? — GLM-5.3 Flash के अलावा — MiniMax M2.7 और DeepSeek V4 Flash: तीनों मॉडल ZCode में उसी custom provider के माध्यम से काम करते हैं, इस गाइड का कॉन्फ़िगरेशन पूरी तरह से काम करता है।
- प्राइवेसी का क्या? — गेटवे प्रॉम्पट्स और उत्तरों की सामग्री को संग्रहीत नहीं करता है; आंकड़ों में केवल उपयोग का कुल डेटा होता है।
- Coding Plan कब अधिक फायदेमंद है? — यदि आप अकेले काम करते हैं, Lite कोटा के भीतर रहते हैं और समानांतर एजेंट नहीं चलाते हैं, तो फिक्स्ड प्राइस वाला सब्सक्रिप्शन सुविधाजनक और अनुमानित है। अपने प्रोफाइल के अनुसार गणना करें: सक्रिय एजेंट कार्य के दौरान, नेटवर्क के माध्यम से टोकन के लिए भुगतान काफी सस्ता पड़ता है, दिन में एक-दो बार हल्के कोड संपादन के लिए अंतर महसूस नहीं हो सकता है।
- क्या यह अन्य टूल के लिए उपयुक्त है? — हाँ: यही endpoint Claude Code, Cursor, Cline और किसी भी OpenAI/Anthropic-compatible क्लाइंट में काम करता है।
अधिक जानना चाहते हैं?
अन्य अनुभागों का अन्वेषण करें या अभी GNK कमाना शुरू करें।
मुफ्त टोकन प्राप्त करें →