علم کے مرکز کے حصے ▾
نیویگیشن
▸ یہاں سے شروع کریں کردار کے لحاظ سےزمرہ جات
- Cursor + Gonka AI – کوڈنگ کے لیے سستا LLM
- Claude Code + Gonka AI – ٹرمینل کے لیے LLM
- OpenClaw + Gonka AI – سستے AI ایجنٹس
- OpenCode + Gonka AI – کوڈ کے لیے مفت AI
- Continue.dev + Gonka AI – VS Code/JetBrains کے لیے AI
- Cline + Gonka AI – VS Code میں AI ایجنٹ
- Aider + Gonka AI – AI کے ساتھ جوڑا پروگرامنگ
- LangChain + Gonka AI – AI ایپلیکیشنز بہت کم قیمت پر
- n8n + Gonka AI – سستے AI کے ساتھ آٹومیشن
- Open WebUI + Gonka AI – اپنا ChatGPT
- LibreChat + Gonka AI — اوپن سورس ChatGPT
- Hermes Agent + Gonka AI — ایک خودمختار ایجنٹ سستے میں
- Kilo Code + Gonka AI — VS Code میں AI ایجنٹ
- Roo Code + Gonka AI — VS Code میں خودمختار AI ایجنٹ
- لاما انڈیکس + گونکا AI — RAG-ایپلی کیشنز صرف چند روپے میں
- PydanticAI + گونکا — ٹائپ شدہ AI-ایجنٹ صرف چند روپے میں
- Vercel AI SDK + گونکا AI — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
- TanStack AI + گونکا — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
- API فوری آغاز — curl, Python, TypeScript
- JoinGonka Gateway — مکمل جائزہ
- مینجمنٹ کیز — Gonka پر SaaS
- سب سے سستا AI API: 2026 کے فراہم کنندگان کا موازنہ
- Cursor Pro کوٹہ ختم — تجزیہ اور سستا متبادل
- Claude Code سستا ہے — بل کا تجزیہ اور تبدیلی
- Cline پیسے ضائع کر رہا ہے — ایجنٹ اتنا زیادہ خرچ کیوں کرتا ہے
- OpenClaw مہنگا ہے — کیوں ایجنٹ ٹوکن ضائع کرتا ہے اور کیسے بچت کریں
- OpenRouter: سستا متبادل — JoinGonka Gateway کے ساتھ موازنہ
- کوڈنگ 2026 کے لیے بہترین AI-ماڈل: موازنہ اور قیمتیں
- حدود کے بغیر GitHub Copilot کا سستا متبادل
- کریڈٹ اور حدود کے بغیر Windsurf کا سستا متبادل
- 2026 میں AI-ایجنٹس کے لیے سب سے سستا API
- ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced
- JetBrains IDE + JoinGonka Gateway — کریڈٹس کے بجائے اپنا endpoint
- GitHub Copilot BYOK — کوٹہ کے بجائے اپنے ماڈلز
- Zed + JoinGonka Gateway — ایڈیٹر میں سستا انفیرنس
- Pi + JoinGonka Gateway — سستے انفرنس پر ٹرمینل ایجنٹ
Tools
ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced
جون 2026 میں Z.ai نے ZCode 3.0 ریلیز کیا — یہ ایک ڈیسک ٹاپ ایجنٹک ڈیولپمنٹ انوائرمنٹ ہے، جسے کمپنی خود "Official Harness for GLM-5.2" کہتی ہے۔ یہ پروڈکٹ تیزی سے مقبول ہوئی: اپنا ایجنٹک کور، /goal کے ذریعے خودکار کام، ملٹی-ایجنٹ موڈ اور براہ راست Telegram سے ریموٹ سیشن مینجمنٹ۔ لیکن جائزے کے ساتھ ساتھ GLM Coding Plan کے سبسکرائبرز سے بہت سے سوالات بھی آئے: کوٹہ پانچ گھنٹے کے ونڈو میں "پرامپٹس" کے طور پر گنا جاتا ہے، پیک آورز میں لاگت تین گنا ہو جاتی ہے، چھوٹے پلانز میں صرف ایک متوازی درخواست (parallel request) کی اجازت ہے، اور Hacker News پر شکایت کی جاتی ہے کہ کام کے دباؤ کے وقت اچانک بلاک مل جاتا ہے۔
اچھی خبر یہ ہے: ZCode باضابطہ طور پر custom provider کو سپورٹ کرتا ہے — یہاں کوئی بھی OpenAI یا Anthropic-ہم آہنگ API منسلک کیا جا سکتا ہے اور سبسکرپشن کوٹہ کے بجائے استعمال شدہ ٹوکنز کی ادائیگی کی جا سکتی ہے۔ اس گائیڈ میں ہم دیکھیں گے کہ ZCode کیا ہے اور GLM Coding Plan کیسے کام کرتا ہے، اور پھر مرحلہ وار ZCode کو JoinGonka Gateway پر سیٹ کریں گے — یہ Gonka ڈی سینٹرلائزڈ نیٹ ورک کا گیٹ وے ہے، جس کی رجسٹری میں GLM-5.2 پہلے سے شامل ہو چکا ہے۔ نتیجہ: وہی ٹول، وہی open-weight ماڈل، لیکن معیشت ٹوکن-بیسڈ ہوگی اور سینٹرلائزڈ API کے مقابلے میں سینکڑوں گنا سستی۔
ZCode کیا ہے: Z.ai کا ایجنٹک ڈیولپمنٹ انوائرمنٹ
ZCode کوئی "چیٹ-سائیڈ بار والا ایڈیٹر" نہیں، بلکہ ایک ADE ہے: آپ مقصد طے کرتے ہیں، ایجنٹ پلان بناتا ہے، فائلیں ٹھیک کرتا ہے، ٹیسٹ چلاتا ہے اور نتیجہ آنے تک کام جاری رکھتا ہے۔ یہ macOS اور Windows پر ڈیسک ٹاپ ایپ کے طور پر کام کرتا ہے (Linux ورژن ابھی بیٹا میں ہے)۔
ورژن 3.0 کی اہم صلاحیتیں:
- ZCode Agent — GLM-5.2 کی گہری انٹیگریشن کے ساتھ اپنا ایجنٹک کور؛ اس کے ساتھ تھرڈ پارٹی ایجنٹس بھی منسلک کیے جا سکتے ہیں (Claude Code, Codex, Gemini CLI وغیرہ)؛
- Goal-موڈ (
/goal) — طویل خودکار کام: پلان → عملدرآمد → مرحلہ وار تصدیق؛ - Multi-agent — ایک پروجیکٹ پر متعدد ایجنٹس کا متوازی کام؛
- ریموٹ مینجمنٹ — Telegram, WeChat اور Feishu سے سیشن چلانا اور کنٹرول کرنا: ایجنٹ آپ کی مشین پر کام کرے گا، اور آپ فون سے سوالات کے جواب دیں گے۔
کلائنٹ خود مفت ہے، Z.ai نئے صارفین کو GLM-5.2 آزمانے کے لیے روزانہ ٹوکن کوٹہ دیتا ہے۔ اس کے بعد آپ کو یا تو GLM Coding Plan سبسکرائب کرنا ہوگا، یا اپنا API-key استعمال کرنا ہوگا۔ اور یہیں تفصیلات سمجھنا ضروری ہے، کیونکہ سبسکرپشن ماڈل ہی اس پروڈکٹ کا سب سے اہم موضوع ہے۔
GLM Coding Plan: قیمت، حدود اور کوٹہ
GLM Coding Plan، Z.ai کی سبسکرپشن ہے جو ZCode اور دیگر ٹولز میں GLM ماڈلز تک رسائی دیتی ہے۔ اشاعت کے وقت (جولائی 2026) بنیادی ڈیٹا کچھ یوں ہے — لیکن قیمتیں اور آفرز تبدیل ہو سکتی ہیں، لہذا z.ai/subscribe کا لائیو صفحہ ہمیشہ چیک کریں:
| پلان | قیمت، $/ماہ | کوٹہ | متوازی درخواستیں |
|---|---|---|---|
| Lite | $18 (آفر میں — تقریباً ~$12.6) | 5 گھنٹے کی ونڈو میں "پرامپٹس" + ہفتہ وار حد | 1 |
| Pro | $72 | Lite کا 4 گنا | 1 |
| Max | $160 | Lite کا 16 گنا | 30 تک |
سبسکرائبرز جن چیزوں کی شکایت کرتے ہیں (Hacker News اور GitHub تھریڈز):
- پیک ملٹی پلائر: پیک آورز میں (14:00—18:00 UTC+8 — ایشیا میں شام، یورپ میں صبح/دوپہر) ہر درخواست 3 گنا کوٹہ کاٹتی ہے، پیک آورز کے باہر 2 گنا۔ بیجنگ کے ٹائم زون کے مطابق خرچ کا پلان کرنا پڑتا ہے۔
- ٹوکنز کے بجائے "پرامپٹ" کوٹہ: یہ غیر واضح ہے کہ کتنا ٹوکن باقی ہے؛ تھریڈز میں لوگوں کی کہانیاں ملتی ہیں جیسے "GLM پر لگ بھگ 17 ملین ٹوکن خرچ کرنے کے بعد چار دنوں کے لیے بلاک ہو گیا"۔
- ایک متوازی درخواست: Lite اور Pro پلان میں۔ ایجنٹک انوائرمنٹ کے لیے یہ کافی محدود ہے: ZCode کا اپنا ملٹی-ایجنٹ موڈ اور کوئی بھی متوازی سب-ایجنٹ کیو میں پھنس جاتا ہے۔
- GLM-5.2 کا تیزی سے خرچ: بڑا ماڈل چھوٹے ماڈلز کی نسبت زیادہ کوٹہ خرچ کرتا ہے۔
مختصر یہ کہ عام سولو ڈیولپمنٹ کے لیے سبسکرپشن ٹھیک کام کرتی ہے۔ لیکن آپ کا کام جتنا زیادہ "ایجنٹک" ہوگا — متوازی ٹاسک، لمبی خودمختار سیشنز، رات کے رنز — کوٹہ ماڈل اتنا ہی لاٹری کی طرح بن جاتا ہے۔ متبادل یہ ہے کہ اصل ٹوکنز کی ادائیگی کی جائے: بغیر کسی ونڈو، ملٹی پلائر یا کیو کے — ایجنٹ جتنا استعمال کرے گا اتنا ہی کٹے گا۔ ZCode کا بلٹ-اِن custom provider یہی ماڈل دیتا ہے، جسے سیٹ اپ کرنا پانچ منٹ کے کام سے زیادہ نہیں ہے۔
ZCode میں BYOK: اپنا API-key اور custom provider
ZCode میں باضابطہ طور پر BYOK سپورٹ شامل ہے: دستاویزات واضح طور پر آپ کو "OpenAI یا Anthropic پروٹوکولز کے ساتھ مطابقت رکھنے والی کسی بھی سروس" کو شامل کرنے کی اجازت دیتی ہیں — جیسے پبلک APIs، کارپوریٹ چینلز، اور یہاں تک کہ self-hosted انسٹالیشنز۔ اسے تین طریقوں سے کنفیگر کیا جا سکتا ہے:
- Welcome اسکرین پر Connect بٹن → «Set Your API Key»;
- ماڈل سلیکٹر میں Manage Models;
- گیئر آئیکن → Settings → Model Settings → Add Provider۔
پرووائیڈر کے لیے OpenAI Base URL اور/یا Anthropic Base URL کے ساتھ API Key فراہم کرنی ہوتی ہے — ZCode خود بخود دستیاب ماڈلز کی فہرست حاصل کر لے گا۔
تین عام غلطیاں جو لوگ اکثر کرتے ہیں:
- Z.ai کے Endpoint مختلف ہیں۔ Coding Plan سبسکرپشن صرف coding-endpoint
https://api.z.ai/api/coding/paas/v4کے ذریعے کام کرتی ہے؛ سبسکرپشن کی کے ساتھ عمومی/api/paas/v4ایرر ریٹرن کرے گا — یہ "میں نے ادائیگی کر دی ہے لیکن 401/429 ایرر مل رہا ہے" مسئلے کی بنیادی وجہ ہے۔ - «Claude Code میں کام کرتا ہے ≠ ZCode میں کام کرتا ہے»۔ وہ انوائرنمنٹ ویری ایبلز جن سے Claude Code کنفیگر کیا جاتا ہے، جیسے
ANTHROPIC_BASE_URL، انہیں ZCode نہیں پڑھتا: اس کا اپنا پرووائیڈر سیٹنگز اسٹوریج ہے۔ سیٹنگز مینو کے ذریعے ہی کنفیگر کریں۔ - «ماڈل سلیکٹر میں نظر آتا ہے ≠ کی (key) میں کوٹہ ہے»۔ ماڈلز کی فہرست پرووائیڈر کے API سے آتی ہے، مگر رسائی کا انحصار متعلقہ کی (key) کے بیلنس اور لمٹس پر ہوتا ہے۔
اگلا قدم عملی استعمال ہے: ZCode میں JoinGonka گیٹ وے کو منسلک کریں اور ٹوکن کے عوض GLM-اسٹیک استعمال کریں۔
ZCode میں JoinGonka Gateway کی کنفیگریشن: ٹوکن کے عوض GLM
JoinGonka Gateway — غیر مرکزی Gonka نیٹ ورک کا گیٹ وے جس میں دو مقامی پروٹوکول ہیں: OpenAI کے ساتھ ہم آہنگ /v1/chat/completions اور Anthropic Messages /v1/messages۔ اکنامک ماڈل pay-per-token ہے: کوئی 5 گھنٹے کی ونڈو نہیں، کوئی ×3 پیک ملٹی پلائر نہیں اور ایک متوازی درخواست کی حد نہیں؛ خرچ ڈیش بورڈ میں حقیقی وقت میں دکھائی دیتا ہے، گیٹ وے پرامپٹ کے مواد کو ذخیرہ نہیں کرتا۔
مرحلہ وار (موجودہ Custom Provider انٹرفیس کے مطابق):
| مرحلہ | عمل |
|---|---|
| 1. کلید | رجسٹر کریں — gate.joingonka.ai/register (نئے اکاؤنٹس کے لیے 10 ملین مفت ٹوکنز)، Keys سیکشن میں ایک API کلید بنائیں۔ تفصیلات — API Quick Start میں دیکھیں۔ |
| 2. پرووائیڈر | ZCode → Settings → Model Settings → Add Provider۔ نام: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | آپ کی jg-… طرز کی کلید |
| 5. API format | Chat completions (/chat/completions) |
| 6. ماڈل | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000۔ اسی طرح moonshotai/Kimi-K2.6 اور MiniMaxAI/MiniMax-M2.7 شامل کیے جا سکتے ہیں؛ موجودہ فہرست — GET /v1/models۔ |
ZCode کے پرانے ورژنز میں اس کے بجائے دو الگ الگ فیلڈز ہیں: OpenAI Base URL (https://gate.joingonka.ai/v1) اور Anthropic Base URL (https://gate.joingonka.ai — کلائنٹ خود پاتھ شامل کر لے گا)۔
تصدیق: تخلیق کردہ ماڈل کو منتخب کریں اور ایجنٹ سے کوئی بھی سوال پوچھیں۔ اگر جواب آئے تو سب ٹھیک ہے؛ 401 ایرر پر کلید چیک کریں، 402 پر اکاؤنٹ کا بیلنس۔ اگر DeepSeek V4 Flash پر Thought Level Max ہونے پر «Model request failed» آتا ہے — تو Thought Level کو High پر سوئچ کریں اور دوبارہ کوشش کریں۔
ٹپ۔ کمانڈ npx @joingonka/setup --tool zcode نیچے دیے گئے فیلڈز کے لیے تیار شدہ اقدار پرنٹ کرے گی اور لائیو درخواست کے ذریعے چیک کرے گی کہ گیٹ وے انہیں قبول کر رہا ہے یا نہیں۔ ZCode کو صرف UI کے ذریعے کنفیگر کیا جاتا ہے — اس لیے اقدار کو دستی طور پر داخل کرنا ہوگا۔
قیمتوں کا موازنہ: Coding Plan, Z.ai API, OpenRouter اور Gonka
مختلف چینلز پر GLM-inference کی قیمت کیا ہے (1M ٹوکنز کے لیے قیمتیں؛ حریفوں کی قیمتیں جولائی 2026 کے لیے مقرر ہیں، JoinGonka کی قیمت API گیٹ وے سے براہ راست صفحے پر آتی ہے):
| چینل | ان پٹ, $/1M | آؤٹ پٹ, $/1M | ادائیگی کا ماڈل |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (کیشڈ ان پٹ — $0.26) | $4.40 | ٹوکن کے حساب سے |
| GLM Coding Plan | $18—160/ماہ | سبسکرپشن: 'پرامپٹ' کوٹہ، پیک پر ×3 ملٹیپلائر، متوازی حدود | |
| OpenRouter (z-ai/glm-5.2) | $0.93 | $3.00 | ٹوکن کے حساب سے؛ GLM-5.2 کا کوئی مفت آپشن نہیں ہے |
| JoinGonka Gateway | $0.0032 | $0.0097 | ٹوکن کے حساب سے، Gonka نیٹ ورک |
دو سے تین آرڈر آف میگنیٹیوڈ کا فرق کوئی مارکیٹنگ راؤنڈنگ نہیں، بلکہ ایک الگ معیشت ہے: کیلکولیشنز وکندریقرت نیٹ ورک کے شرکاء انجام دیتے ہیں، جو ڈیٹا سینٹر کے مارجن پر نہیں، بلکہ خود کام پر کمائی کرتے ہیں۔ یہ کیسے کام کرتا ہے اور اس کی حدود کیا ہیں، اس کا تفصیلی تجزیہ سب سے سستے AI API کے بارے میں مضمون میں موجود ہے۔
GLM-5.2 کے بارے میں صاف ستھرا انتباہ: نیٹ ورک ماڈل کی درست قیمت ایکٹیویشن کے وقت طے کرے گا (اوپر دی گئی ٹیبل میں نیٹ ورک ماڈلز کی موجودہ لائیو قیمت ہے)۔ اس صفحے پر اعداد و شمار خود بخود اپ ڈیٹ ہوتے ہیں، کچھ بھی دستی طور پر دوبارہ کیلکولیٹ کرنے کی ضرورت نہیں ہے۔
Gonka نیٹ ورک پر GLM-5.2: سٹیٹس اور عام سوالات
zai-org/GLM-5.2-FP8 ماڈل پہلے ہی Gonka نیٹ ورک کی on-chain رجسٹری میں شامل کر دیا گیا ہے: کنفیگریشن 400K ٹوکنز تک کی ونڈو سیٹ کرتی ہے، اور یہ ماڈل بھاری ماڈلز میں سے ہے (ہر ریپلیکا کے لیے ایک ٹیرابائٹ سے زیادہ VRAM درکار ہوتی ہے)۔ فی الحال رول آؤٹ جاری ہے: نیٹ ورک نوڈز ویٹس کو وارم اپ کر رہے ہیں۔ جیسے ہی چیکس سبز ہو جائیں گے، ماڈل خود بخود گیٹ وے کی ماڈل لسٹ میں ظاہر ہو جائے گا—بیس URL اور کی تبدیل نہیں ہوتی، ZCode میں صرف سلیکٹر سے اسے منتخب کرنا ہوگا۔
ماڈل کے بارے میں: MIT لائسنس کے تحت اوپن ویٹس، ~750B پیرامیٹرز (فی ٹوکن تقریباً 40B فعال) کے ساتھ MoE آرکیٹیکچر، 1M ٹوکنز تک نیٹیو ونڈو۔ Z.ai کے مطابق، SWE-bench Pro پر ماڈل 62.1 اسکور دکھاتا ہے—جو GPT-5.5 سے زیادہ ہے، اور FrontierSWE پر Claude Opus 4.8 سے تقریباً ایک فیصد پیچھے ہے۔ اوپن-ویٹ ماڈل کے لیے یہ کوڈنگ میں پہلی پوزیشن ہے۔
عام سوالات:
- نیا ماڈل شامل کرنے کے فوراً بعد 429 ایرر کیوں آتے ہیں؟ — یہ رول آؤٹ کا مرحلہ ہے: کچھ نوڈز ابھی ویٹس لوڈ کر رہے ہیں۔ کچھ سیکنڈ بعد درخواست دوبارہ بھیجیں—بیلنسر ایک فعال نوڈ ڈھونڈ لے گا۔
- آج کیا دستیاب ہے؟ — Kimi K2.6, MiniMax M2.7 اور DeepSeek V4 Flash: تینوں ماڈلز ZCode میں اسی custom provider کے ذریعے کام کرتے ہیں، اس گائیڈ کی کنفیگریشن ابھی مکمل طور پر فعال ہے۔
- پرائیویسی کا کیا ہوگا؟ — گیٹ وے پرامپٹس اور جوابات کا مواد محفوظ نہیں کرتا؛ شماریات میں صرف خرچ کا مجموعہ نظر آتا ہے۔
- کب Coding Plan زیادہ فائدہ مند ہے؟ — اگر آپ اکیلے کام کرتے ہیں، Lite کوٹے میں رہتے ہیں اور متوازی ایجنٹس نہیں چلاتے، تو فکسڈ سبسکرپشن آسان اور قابل پیشگوئی ہے۔ اپنے پروفائل کے مطابق حساب لگائیں: فعال ایجنٹ کام میں نیٹ ورک کے ذریعے ٹوکنز کی ادائیگی بہت سستی پڑتی ہے، ہلکی کوڈنگ ایڈیٹنگ میں فرق محسوس نہیں ہو سکتا۔
- کیا یہ دوسرے ٹولز کے لیے بھی موزوں ہے؟ — جی ہاں: وہی endpoint Claude Code, Cursor, Cline اور کسی بھی OpenAI/Anthropic-مطابقت پذیر کلائنٹ میں کام کرتا ہے۔
مزید جاننا چاہتے ہیں؟
دیگر حصوں کو دریافت کریں یا ابھی GNK کمانا شروع کریں۔
10M مفت ٹوکنز حاصل کریں →