علم کے مرکز کے حصے ▾
نیویگیشن
▸ یہاں سے شروع کریں کردار کے لحاظ سےزمرہ جات
- Cursor + Gonka AI – کوڈنگ کے لیے سستا LLM
- Claude Code + Gonka AI – ٹرمینل کے لیے LLM
- OpenClaw + Gonka AI – سستے AI ایجنٹس
- OpenCode: ٹرمینل میں اپنا ماڈل
- Continue.dev + Gonka AI – VS Code/JetBrains کے لیے AI
- Cline + Gonka AI – VS Code میں AI ایجنٹ
- Aider + Gonka AI – AI کے ساتھ جوڑا پروگرامنگ
- LangChain + Gonka AI – AI ایپلیکیشنز بہت کم قیمت پر
- n8n + Gonka AI – سستے AI کے ساتھ آٹومیشن
- Open WebUI + Gonka AI – اپنا ChatGPT
- LibreChat + Gonka AI — اوپن سورس ChatGPT
- Hermes Agent + DeepSeek, Gonka نیٹ ورک پر — انتہائی کم قیمت میں خودمختار ایجنٹ
- Kilo Code + Gonka AI — VS Code میں AI ایجنٹ
- Roo Code + Gonka AI — VS Code میں خودمختار AI ایجنٹ
- لاما انڈیکس + گونکا AI — RAG-ایپلی کیشنز صرف چند روپے میں
- PydanticAI + گونکا — ٹائپ شدہ AI-ایجنٹ صرف چند روپے میں
- Vercel AI SDK + گونکا AI — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
- TanStack AI + گونکا — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
- API فوری آغاز — curl, Python, TypeScript
- JoinGonka Gateway — مکمل جائزہ
- مینجمنٹ کیز — Gonka پر SaaS
- سب سے سستا AI API: 2026 کے فراہم کنندگان کا موازنہ
- AI ٹوکن اور API-کی کیسے خریدیں: 2026 کے 3 طریقے
- Cursor Pro کوٹہ ختم — تجزیہ اور سستا متبادل
- Claude Code سستا ہے — بل کا تجزیہ اور تبدیلی
- Cline پیسے ضائع کر رہا ہے — ایجنٹ اتنا زیادہ خرچ کیوں کرتا ہے
- OpenClaw مہنگا ہے — کیوں ایجنٹ ٹوکن ضائع کرتا ہے اور کیسے بچت کریں
- OpenRouter: سستا متبادل — JoinGonka Gateway کے ساتھ موازنہ
- کوڈنگ 2026 کے لیے بہترین AI-ماڈل: موازنہ اور قیمتیں
- حدود کے بغیر GitHub Copilot کا سستا متبادل
- کریڈٹ اور حدود کے بغیر Windsurf کا سستا متبادل
- 2026 میں AI-ایجنٹس کے لیے سب سے سستا API
- ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced
- JetBrains IDE + JoinGonka Gateway — کریڈٹس کے بجائے اپنا endpoint
- GitHub Copilot BYOK — کوٹہ کے بجائے اپنے ماڈلز
- Zed + JoinGonka Gateway — ایڈیٹر میں سستا انفیرنس
- Pi + JoinGonka Gateway — سستے انفرنس پر ٹرمینل ایجنٹ
- Codex CLI: سبسکرپشن کے بجائے اپنی کی (key)
- DeepSeek Harness: JoinGonka Gateway کے ذریعے اپنا پرووائیڈر
- MiniMax Code: Gonka کے ذریعے اپنی کلید استعمال کرتے ہوئے MiniMax ایجنٹ
- Warp + JoinGonka Gateway — آپ کے اپنے endpoint پر ٹرمینل ایجنٹ
- Trae + JoinGonka Gateway — AI-IDE میں Gonka نیٹ ورک ماڈلز
- Cherry Studio + JoinGonka Gateway — ڈیسک ٹاپ AI کلائنٹ
- omp (Oh My Pi) + JoinGonka Gateway: ماڈل رولز کے ساتھ ایجنٹ
- OpenHands + JoinGonka Gateway: اپنے اینڈپوائنٹ پر ایجنٹ
- qwen-oauth بند ہونے کے بعد Qwen Code: JoinGonka Gateway کے ذریعے کام
- Goose + JoinGonka Gateway: اپنا پرووائیڈر اور کی (key) keyring میں
- Crush + JoinGonka Gateway: Gonka نیٹ ورک کے ماڈلز پر Charm ایجنٹ
- Zoo Code + JoinGonka Gateway: Roo Code سے Gonka ماڈلز پر منتقلی
- Kimi Code CLI: Gonka کے ذریعے اپنی کی استعمال کرتے ہوئے Moonshot AI ایجنٹ
- Factory Droid + JoinGonka Gateway: Gonka نیٹ ورک ماڈلز پر BYOK
- MiMo Code + JoinGonka Gateway: Gonka نیٹ ورک ماڈلز پر Xiaomi ایجنٹ
Tools
ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced
جون 2026 میں Z.ai نے ZCode 3.0 جاری کیا—ایک ڈیسک ٹاپ ایجنٹک ڈیولپمنٹ ماحول، جسے کمپنی خود "Official Harness for GLM-5.2" کہتی ہے۔ پروڈکٹ نے تیزی سے توجہ حاصل کی: اپنا ایجنٹک کور، /goal کے ذریعے خود مختار ٹاسک، ملٹی ایجنٹ موڈ اور براہ راست Telegram سے ریموٹ سیشن مینجمنٹ۔ لیکن جائزے کے ساتھ ساتھ GLM Coding Plan کے پہلے سبسکرائبرز کی طرف سے سوالات کا سلسلہ بھی شروع ہوا: کوٹہ پانچ گھنٹے کے ونڈو میں "پرامپٹس" کے طور پر شمار ہوتا ہے، پیک آورز میں خرچ تین گنا ہو جاتا ہے، چھوٹے پلانز میں صرف ایک متوازی درخواست کی اجازت ہے، اور Hacker News پر کام کے مصروف دن کے بعد اچانک بلاک ہونے کی شکایتیں آ رہی ہیں۔
اچھی خبر یہ ہے کہ ZCode سرکاری طور پر custom provider کو سپورٹ کرتا ہے—اس کے ساتھ کوئی بھی OpenAI یا Anthropic سے مطابقت رکھنے والی API منسلک کی جا سکتی ہے اور سبسکرپشن کوٹے کے بجائے اصل ٹوکن کے لیے ادائیگی کی جا سکتی ہے۔ اس گائیڈ میں ہم تجزیہ کریں گے کہ ZCode کیا ہے اور GLM Coding Plan کیسے کام کرتا ہے، اور پھر مرحلہ وار ZCode کو JoinGonka Gateway پر سیٹ اپ کریں گے—Gonka کے وکندریقرت نیٹ ورک کا گیٹ وے، جو Z.ai کا اپنا اوپن ریزننگ ماڈل GLM-5.3 Flash فراہم کرتا ہے۔ نتیجہ: وہی ٹول، وہی open-weight ماڈلز، لیکن اکانومی ٹوکن پر مبنی اور سینٹرلائزڈ API کے مقابلے میں بہت سستی۔
ZCode کیا ہے: Z.ai کا ایجنٹک ڈیولپمنٹ انوائرمنٹ
ZCode کوئی "چیٹ-سائیڈ بار والا ایڈیٹر" نہیں، بلکہ ایک ADE ہے: آپ مقصد طے کرتے ہیں، ایجنٹ پلان بناتا ہے، فائلیں ٹھیک کرتا ہے، ٹیسٹ چلاتا ہے اور نتیجہ آنے تک کام جاری رکھتا ہے۔ یہ macOS اور Windows پر ڈیسک ٹاپ ایپ کے طور پر کام کرتا ہے (Linux ورژن ابھی بیٹا میں ہے)۔
ورژن 3.0 کی اہم صلاحیتیں:
- ZCode Agent — GLM-5.2 کی گہری انٹیگریشن کے ساتھ اپنا ایجنٹک کور؛ اس کے ساتھ تھرڈ پارٹی ایجنٹس بھی منسلک کیے جا سکتے ہیں (Claude Code, Codex, Gemini CLI وغیرہ)؛
- Goal-موڈ (
/goal) — طویل خودکار کام: پلان → عملدرآمد → مرحلہ وار تصدیق؛ - Multi-agent — ایک پروجیکٹ پر متعدد ایجنٹس کا متوازی کام؛
- ریموٹ مینجمنٹ — Telegram, WeChat اور Feishu سے سیشن چلانا اور کنٹرول کرنا: ایجنٹ آپ کی مشین پر کام کرے گا، اور آپ فون سے سوالات کے جواب دیں گے۔
کلائنٹ خود مفت ہے، Z.ai نئے صارفین کو GLM-5.2 آزمانے کے لیے روزانہ ٹوکن کوٹہ دیتا ہے۔ اس کے بعد آپ کو یا تو GLM Coding Plan سبسکرائب کرنا ہوگا، یا اپنا API-key استعمال کرنا ہوگا۔ اور یہیں تفصیلات سمجھنا ضروری ہے، کیونکہ سبسکرپشن ماڈل ہی اس پروڈکٹ کا سب سے اہم موضوع ہے۔
GLM Coding Plan: قیمت، حدود اور کوٹہ
GLM Coding Plan — Z.ai کا سبسکرپشن جو ZCode اور بیس سے زائد بیرونی ٹولز میں GLM ماڈلز تک رسائی دیتا ہے۔ اشاعت کے وقت (جولائی 2026) بنیادی ٹیبل یوں ہے — مگر قیمتیں اور آفرز بدلتی رہتی ہیں، z.ai/subscribe کے لائیو صفحے سے تصدیق کر لیں:
| پلان | قیمت، $/ماہ | کوٹہ | متوازی درخواستیں |
|---|---|---|---|
| Lite | $18 (آفرز میں — تقریباً $12.6 سے) | 5 گھنٹے کی ونڈوز میں «prompt» + ہفتہ وار حد | 1 |
| Pro | $72 | Lite کا ×4 | 1 |
| Max | $160 | Lite کا ×16 | 30 تک |
سبسکرائبرز کس چیز کی شکایت کرتے ہیں (Hacker News اور GitHub تھریڈز):
- پیک آورز کا ملٹی پلائر۔ پیک آورز میں (14:00—18:00 UTC+8 — ایشیا میں شام، یورپ میں صبح-دوپہر) ہر درخواست ×3 گنانک سے کوٹہ کاٹتی ہے، پیک سے باہر ×2۔ اخراجات کی منصوبہ بندی بیجنگ ٹائم زون پر کرنی پڑتی ہے۔
- کوٹہ «prompt» میں، ٹوکنز میں نہیں۔ اصل میں کتنے ٹوکنز باقی ہیں — غیر واضح؛ تھریڈز میں ایسے قصے ملتے ہیں «GLM پر ~17M ٹوکنز استعمال کیے — اور چار دن کا بلاک مل گیا»۔
- Lite اور Pro پر ایک متوازی درخواست۔ ایجنٹ ماحول میں یہ واضح محسوس ہوتا ہے: ZCode کا multi-agent موڈ اور کوئی بھی متوازی سب ایجنٹ قطار میں رک جاتا ہے۔
- GLM-5.2 کوٹہ چھوٹے ماڈلز سے تیز ختم کرتا ہے — فلیگ شپ اپنے ملٹی پلائر کے ساتھ حد جلا دیتا ہے۔
نتیجہ آسان ہے: پرسکون انفرادی ڈویلپمنٹ کے لیے سبسکرپشن ایمانداری سے کام کرتا ہے۔ مگر آپ کا موڈ جتنا زیادہ «ایجنٹ محور» ہو — متوازی کام، طویل خودمختار سیشنز، رات کے رنز — اتنی ہی بار کوٹہ ماڈل لاٹری بن جاتا ہے۔ متبادل — اصل ٹوکنز کی بنیاد پر ادائیگی: ونڈوز، ملٹی پلائرز اور قطاروں کا جھنجھٹ نہیں — ایجنٹ نے جتنا خرچ کیا، اتنا ہی کٹا۔ ZCode میں بلٹ اِن custom provider یہی ماڈل دیتا ہے، اور سیٹ اپ پانچ منٹ کا کام ہے۔
ZCode میں BYOK: اپنا API-key اور custom provider
ZCode میں باضابطہ طور پر BYOK سپورٹ بلٹ اِن ہے: دستاویزات واضح طور پر اجازت دیتی ہیں کہ «OpenAI یا Anthropic پروٹوکولز سے مطابقت رکھنے والی کوئی بھی سروس» شامل کی جا سکتی ہے — پبلک APIs، کارپوریٹ چینلز اور حتیٰ کہ self-hosted انسٹالیشنز بھی۔ تین طریقوں سے کنفیگر کیا جاتا ہے:
- welcome اسکرین پر Connect بٹن → «Set Your API Key»;
- ماڈل سلیکٹر میں Manage Models;
- گیئر آئیکن → Settings → Model Settings → Add Provider۔
پرووائیڈر کو OpenAI Base URL اور/یا Anthropic Base URL کے ساتھ API Key دیا جاتا ہے — دستیاب ماڈلز کی فہرست ZCode خود کھینچ لے گا۔
تین جگہیں جہاں سب سے زیادہ ٹھوکر کھائی جاتی ہے:
- Z.ai کے Endpoint' مختلف ہیں۔ Coding Plan سبسکرپشن صرف coding-endpoint
https://api.z.ai/api/coding/paas/v4کے ذریعے کام کرتی ہے؛ سبسکرپشن کلید کے ساتھ عام/api/paas/v4ایرر دے گا — «پلان پیڈ ہے پھر بھی 401/429 آ رہا ہے» کی کلاسک وجہ۔ - «Claude Code میں چلتا ہے ≠ ZCode میں چلتا ہے۔»
ANTHROPIC_BASE_URLجیسے ماحولیاتی ویری ایبلز جن سے Claude Code کنفیگر کیا جاتا ہے، ZCode انہیں نہیں پڑھتا: اس کا اپنا پرووائیڈر سیٹنگز اسٹور ہے۔ صرف Settings کے ذریعے کنفیگر کریں۔ - «سلیکٹر میں ماڈل نظر آتا ہے ≠ کلید کے پاس کوٹہ ہے۔» ماڈلز کی فہرست پرووائیڈر کے API سے آتی ہے، اور رسائی مخصوص کلید کے بیلنس اور لِمٹس پر منحصر ہے۔
اب عملی حصہ: ZCode میں JoinGonka گیٹ وے منسلک کرتے ہیں اور ٹوکنز کے عوض GLM اسٹیک حاصل کرتے ہیں۔
ZCode میں JoinGonka Gateway کی کنفیگریشن: ٹوکن کے عوض GLM
JoinGonka Gateway — Gonka ڈیسینٹرلائزڈ نیٹ ورک کا ایک گیٹ وے ہے جس میں دو نیٹو پروٹوکولز ہیں: OpenAI سے ہم آہنگ /v1/chat/completions اور Anthropic Messages /v1/messages۔ اکانومی pay-per-token ہے: کوئی 5 گھنٹے کی ونڈو، ×3 پیک ملٹی پلائر، یا ایک متوازی ریکوسٹ کی حد نہیں؛ خرچ ڈیش بورڈ میں ریئل ٹائم میں نظر آتا ہے اور گیٹ وے پرامپٹس کا مواد محفوظ نہیں کرتا۔
مرحلہ وار (موجودہ Custom Provider انٹرفیس):
| مرحلہ | عمل |
|---|---|
| 1. کی | رجسٹر کریں — gate.joingonka.ai/register (نئے اکاؤنٹس کے لیے 3M فری ٹوکنز)، Keys سیکشن میں API-کی بنائیں۔ تفصیلات — API Quick Start میں۔ |
| 2. پرووائیڈر | ZCode → Settings → Model Settings → Add Provider۔ نام: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | آپ کی jg-… فارمیٹ کی کی |
| 5. API format | Chat completions (/chat/completions) |
| 6. ماڈل | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731، Context window 380000۔ اسی طرح MiniMaxAI/MiniMax-M2.7 اور zai-org/GLM-5.3-Flash شامل کریں — Z.ai کا اپنا ریزننگ ماڈل؛ موجودہ فہرست اور حدیں — GET /v1/models۔ |
ZCode کے پرانے ورژنز میں اس کی بجائے دو الگ فیلڈز ہیں: OpenAI Base URL (https://gate.joingonka.ai/v1) اور Anthropic Base URL (https://gate.joingonka.ai — کلائنٹ خود پاتھ شامل کر لے گا)۔
تصدیق: منتخب کردہ ماڈل کے ساتھ ایجنٹ سے کوئی بھی سوال کریں۔ جواب آ گیا تو سب ٹھیک ہے؛ 401 ایرر پر کی چیک کریں، 402 پر اکاؤنٹ بیلنس۔ اگر DeepSeek V4 Flash پر Thought Level Max کے دوران «Model request failed» آتا ہے تو Thought Level کو High پر سوئچ کریں اور دوبارہ کوشش کریں۔
ٹپ۔ npx @joingonka/setup --tool zcode کمانڈ ان فیلڈز کے لیے تیار ویلیوز پرنٹ کرے گی — بیس URL، کی، ماڈل آئی ڈی اور اس کی اصل حدیں: کانٹیکسٹ ونڈو اور رسپانس کی حد — اور ایک لائیو ریکوسٹ کے ذریعے چیک کرے گی کہ گیٹ وے انہیں قبول کر رہا ہے۔ ZCode صرف UI کے ذریعے کنفیگر ہوتا ہے — اس کی کوئی ایسی فائل نہیں ہے جسے محفوظ طریقے سے ایڈٹ کیا جا سکے، اس لیے ویلیوز دستی طور پر درج کرنی ہوں گی۔
قیمتوں کا موازنہ: Coding Plan, Z.ai API, OpenRouter اور Gonka
مختلف چینلز پر GLM-انفرنس کی قیمت (فی 1M ٹوکنز؛ حریفوں کی قیمتیں ستمبر 2026 کے مطابق ہیں، JoinGonka کی قیمت گیٹ وے API سے براہ راست صفحے پر لائیو دکھائی جاتی ہے):
| چینل | ان پٹ، $/1M | آؤٹ پٹ، $/1M | ادائیگی کا ماڈل |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (کیشڈ ان پٹ — $0.26) | $4.40 | ٹوکنز کے لحاظ سے |
| GLM Coding Plan | $18—160/ماہ | سبسکرپشن: "پرامپٹ" کوٹہ، پیک آورز میں ×3 ملٹی پلائر، متوازی حدیں | |
| OpenRouter (z-ai/glm-5.2) | $1.40 | $4.40 | ٹوکنز کے لحاظ سے |
| OpenRouter (z-ai/glm-5.3-flash) | $0.09 | $0.30 | ٹوکنز کے لحاظ سے |
| JoinGonka Gateway | $0.0069 | $0.021 | ٹوکنز کے لحاظ سے، Gonka نیٹ ورک |
دو سے تین درجے کا فرق کوئی مارکیٹنگ راؤنڈنگ نہیں، بلکہ ایک مختلف معیشت ہے: کمپیوٹیشنز ڈی سینٹرلائزڈ نیٹ ورک کے شرکاء انجام دیتے ہیں، جو ڈیٹا سینٹر کے مارجن کے بجائے کام کی بنیاد پر کماتے ہیں۔ اس کا طریقہ کار اور اس کے اطلاق کی حدود کے بارے میں تفصیلی تجزیہ سستے ترین AI API آرٹیکل میں ملاحظہ کریں۔
JoinGonka کی لائن Gonka نیٹ ورک پر GLM-5.3 Flash کی قیمت ہے: نیٹ ورک کے تمام ماڈلز کے لیے یکساں ٹیرف لاگو ہے۔ اس صفحے کے اعداد و شمار خود بخود اپ ڈیٹ ہوتے ہیں، اس لیے دستی طور پر کچھ حساب کرنے کی ضرورت نہیں ہے۔
Gonka نیٹ ورک میں GLM: GLM-5.3 Flash اور عام سوالات
Gonka نیٹ ورک Z.ai ماڈل کی سروس فراہم کرتا ہے: zai-org/GLM-5.3-Flash جسے گورننس پروپوزل #101 کے ذریعے منظور کیا گیا ہے اور اسے MiniMax M2.7 اور DeepSeek V4 Flash کے ساتھ گیٹ وے کے ذریعے پیش کیا جاتا ہے۔ فلیگ شپ GLM-5.2، جس کا ذکر اس گائیڈ کے ابتدائی ورژنز میں تھا، آپریشنل لائن اپ میں شامل نہیں ہوا — نیٹ ورک نے اسی سیریز کے ایک ہلکے اور تیز ماڈل کا انتخاب کیا ہے۔ Base URL اور کی وہی ہے: ZCode میں بس کسٹم پرووائیڈر میں ماڈل کو شامل کرنا کافی ہے۔
ماڈل کے بارے میں: MIT لائسنس کے تحت اوپن ویٹس، 320B پیرامیٹرز پر MoE آرکیٹیکچر (18B ایکٹیو فی ٹوکن)، ہائبرڈ اسپارس اور لکیری توجہ۔ اہم خصوصیت یہ ہے کہ یہ ایک reasoning-ماڈل ہے: جواب دینے سے پہلے یہ سوچتا ہے، اور سوچنے کا عمل سادہ سوالات پر بھی کئی سو ٹوکنز لیتا ہے۔ ZCode کے لیے اس کا مطلب دو چیزیں ہیں: ماڈل کی جواب کی لمبائی کی حد کو بہت کم نہ کریں (چھوٹے جوابات کے لیے بھی 600 ٹوکنز سے) اور فوری تبدیلیوں کے لیے Thought Level کو کم کریں — API کی سطح پر یہ reasoning_effort: low ہے۔ ماڈل اور اس کی حدود کا تفصیلی تجزیہ مضمون Gonka نیٹ ورک پر GLM-5.3 Flash میں موجود ہے۔
اکثر پوچھے گئے سوالات:
- نئے ماڈل پر 429 یا قطار کیوں ہوتی ہے؟ — ماڈل فی الحال نیٹ ورک کے ہوسٹس کے ایک چھوٹے حصے پر چل رہا ہے؛ چوٹی کے اوقات میں درخواستیں خالی سلاٹ کا انتظار کر سکتی ہیں۔ کچھ سیکنڈ بعد دوبارہ کوشش کریں — لوڈ بیلنسر ایک فعال نوڈ تلاش کر لے گا۔ موجودہ حالت گیٹ وے اسٹیٹس پیج پر دیکھیں۔
- اور کیا دستیاب ہے؟ — GLM-5.3 Flash کے علاوہ MiniMax M2.7 اور DeepSeek V4 Flash موجود ہیں: تینوں ماڈلز ZCode میں ایک ہی کسٹم پرووائیڈر کے ذریعے کام کرتے ہیں، اس گائیڈ کی کنفیگریشن مکمل طور پر کارآمد ہے۔
- پرائیویسی کا کیا ہوگا؟ — گیٹ وے پرامپٹس اور جوابات کے مواد کو اسٹور نہیں کرتا؛ اعداد و شمار میں صرف کھپت کے مجموعے ہوتے ہیں۔
- Coding Plan کب زیادہ فائدہ مند ہے؟ — اگر آپ اکیلے کام کرتے ہیں، Lite کوٹے میں رہتے ہیں اور متوازی ایجنٹ نہیں چلاتے، تو فکسڈ پیکیج آسان اور پیش گوئی کے قابل ہے۔ اپنے پروفائل کے مطابق حساب لگائیں: فعال ایجنٹ ورک لوڈ کے ساتھ، نیٹ ورک کے ذریعے ٹوکن کی ادائیگی سینکڑوں گنا سستی پڑتی ہے، جبکہ دن میں ایک دو بار کوڈ میں معمولی تبدیلیوں کے لیے فرق محسوس نہیں ہو سکتا۔
- کیا یہ دیگر ٹولز کے لیے موزوں ہے؟ — جی ہاں: وہی endpoint Claude Code، Cursor، Cline اور کسی بھی OpenAI/Anthropic-مطابقت پذیر کلائنٹ میں کام کرتا ہے۔