علم کے مرکز کے حصے ▾

نیویگیشن

▸ یہاں سے شروع کریں کردار کے لحاظ سے

زمرہ جات

ٹولز 36
لغت 12

Tools

ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced

جون 2026 میں Z.ai نے ZCode 3.0 ریلیز کیا — یہ ایک ڈیسک ٹاپ ایجنٹک ڈیولپمنٹ انوائرمنٹ ہے، جسے کمپنی خود "Official Harness for GLM-5.2" کہتی ہے۔ یہ پروڈکٹ تیزی سے مقبول ہوئی: اپنا ایجنٹک کور، /goal کے ذریعے خودکار کام، ملٹی-ایجنٹ موڈ اور براہ راست Telegram سے ریموٹ سیشن مینجمنٹ۔ لیکن جائزے کے ساتھ ساتھ GLM Coding Plan کے سبسکرائبرز سے بہت سے سوالات بھی آئے: کوٹہ پانچ گھنٹے کے ونڈو میں "پرامپٹس" کے طور پر گنا جاتا ہے، پیک آورز میں لاگت تین گنا ہو جاتی ہے، چھوٹے پلانز میں صرف ایک متوازی درخواست (parallel request) کی اجازت ہے، اور Hacker News پر شکایت کی جاتی ہے کہ کام کے دباؤ کے وقت اچانک بلاک مل جاتا ہے۔

اچھی خبر یہ ہے: ZCode باضابطہ طور پر custom provider کو سپورٹ کرتا ہے — یہاں کوئی بھی OpenAI یا Anthropic-ہم آہنگ API منسلک کیا جا سکتا ہے اور سبسکرپشن کوٹہ کے بجائے استعمال شدہ ٹوکنز کی ادائیگی کی جا سکتی ہے۔ اس گائیڈ میں ہم دیکھیں گے کہ ZCode کیا ہے اور GLM Coding Plan کیسے کام کرتا ہے، اور پھر مرحلہ وار ZCode کو JoinGonka Gateway پر سیٹ کریں گے — یہ Gonka ڈی سینٹرلائزڈ نیٹ ورک کا گیٹ وے ہے، جس کی رجسٹری میں GLM-5.2 پہلے سے شامل ہو چکا ہے۔ نتیجہ: وہی ٹول، وہی open-weight ماڈل، لیکن معیشت ٹوکن-بیسڈ ہوگی اور سینٹرلائزڈ API کے مقابلے میں سینکڑوں گنا سستی۔

ZCode کیا ہے: Z.ai کا ایجنٹک ڈیولپمنٹ انوائرمنٹ

ZCode کوئی "چیٹ-سائیڈ بار والا ایڈیٹر" نہیں، بلکہ ایک ADE ہے: آپ مقصد طے کرتے ہیں، ایجنٹ پلان بناتا ہے، فائلیں ٹھیک کرتا ہے، ٹیسٹ چلاتا ہے اور نتیجہ آنے تک کام جاری رکھتا ہے۔ یہ macOS اور Windows پر ڈیسک ٹاپ ایپ کے طور پر کام کرتا ہے (Linux ورژن ابھی بیٹا میں ہے)۔

ورژن 3.0 کی اہم صلاحیتیں:

  • ZCode Agent — GLM-5.2 کی گہری انٹیگریشن کے ساتھ اپنا ایجنٹک کور؛ اس کے ساتھ تھرڈ پارٹی ایجنٹس بھی منسلک کیے جا سکتے ہیں (Claude Code, Codex, Gemini CLI وغیرہ)؛
  • Goal-موڈ (/goal) — طویل خودکار کام: پلان → عملدرآمد → مرحلہ وار تصدیق؛
  • Multi-agent — ایک پروجیکٹ پر متعدد ایجنٹس کا متوازی کام؛
  • ریموٹ مینجمنٹ — Telegram, WeChat اور Feishu سے سیشن چلانا اور کنٹرول کرنا: ایجنٹ آپ کی مشین پر کام کرے گا، اور آپ فون سے سوالات کے جواب دیں گے۔

کلائنٹ خود مفت ہے، Z.ai نئے صارفین کو GLM-5.2 آزمانے کے لیے روزانہ ٹوکن کوٹہ دیتا ہے۔ اس کے بعد آپ کو یا تو GLM Coding Plan سبسکرائب کرنا ہوگا، یا اپنا API-key استعمال کرنا ہوگا۔ اور یہیں تفصیلات سمجھنا ضروری ہے، کیونکہ سبسکرپشن ماڈل ہی اس پروڈکٹ کا سب سے اہم موضوع ہے۔

GLM Coding Plan: قیمت، حدود اور کوٹہ

GLM Coding Plan، Z.ai کی سبسکرپشن ہے جو ZCode اور دیگر ٹولز میں GLM ماڈلز تک رسائی دیتی ہے۔ اشاعت کے وقت (جولائی 2026) بنیادی ڈیٹا کچھ یوں ہے — لیکن قیمتیں اور آفرز تبدیل ہو سکتی ہیں، لہذا z.ai/subscribe کا لائیو صفحہ ہمیشہ چیک کریں:

پلانقیمت، $/ماہکوٹہمتوازی درخواستیں
Lite$18 (آفر میں — تقریباً ~$12.6)5 گھنٹے کی ونڈو میں "پرامپٹس" + ہفتہ وار حد1
Pro$72Lite کا 4 گنا1
Max$160Lite کا 16 گنا30 تک

سبسکرائبرز جن چیزوں کی شکایت کرتے ہیں (Hacker News اور GitHub تھریڈز):

  • پیک ملٹی پلائر: پیک آورز میں (14:00—18:00 UTC+8 — ایشیا میں شام، یورپ میں صبح/دوپہر) ہر درخواست 3 گنا کوٹہ کاٹتی ہے، پیک آورز کے باہر 2 گنا۔ بیجنگ کے ٹائم زون کے مطابق خرچ کا پلان کرنا پڑتا ہے۔
  • ٹوکنز کے بجائے "پرامپٹ" کوٹہ: یہ غیر واضح ہے کہ کتنا ٹوکن باقی ہے؛ تھریڈز میں لوگوں کی کہانیاں ملتی ہیں جیسے "GLM پر لگ بھگ 17 ملین ٹوکن خرچ کرنے کے بعد چار دنوں کے لیے بلاک ہو گیا"۔
  • ایک متوازی درخواست: Lite اور Pro پلان میں۔ ایجنٹک انوائرمنٹ کے لیے یہ کافی محدود ہے: ZCode کا اپنا ملٹی-ایجنٹ موڈ اور کوئی بھی متوازی سب-ایجنٹ کیو میں پھنس جاتا ہے۔
  • GLM-5.2 کا تیزی سے خرچ: بڑا ماڈل چھوٹے ماڈلز کی نسبت زیادہ کوٹہ خرچ کرتا ہے۔

مختصر یہ کہ عام سولو ڈیولپمنٹ کے لیے سبسکرپشن ٹھیک کام کرتی ہے۔ لیکن آپ کا کام جتنا زیادہ "ایجنٹک" ہوگا — متوازی ٹاسک، لمبی خودمختار سیشنز، رات کے رنز — کوٹہ ماڈل اتنا ہی لاٹری کی طرح بن جاتا ہے۔ متبادل یہ ہے کہ اصل ٹوکنز کی ادائیگی کی جائے: بغیر کسی ونڈو، ملٹی پلائر یا کیو کے — ایجنٹ جتنا استعمال کرے گا اتنا ہی کٹے گا۔ ZCode کا بلٹ-اِن custom provider یہی ماڈل دیتا ہے، جسے سیٹ اپ کرنا پانچ منٹ کے کام سے زیادہ نہیں ہے۔

ZCode میں BYOK: اپنا API-key اور custom provider

ZCode میں باضابطہ طور پر BYOK سپورٹ شامل ہے: دستاویزات واضح طور پر آپ کو "OpenAI یا Anthropic پروٹوکولز کے ساتھ مطابقت رکھنے والی کسی بھی سروس" کو شامل کرنے کی اجازت دیتی ہیں — جیسے پبلک APIs، کارپوریٹ چینلز، اور یہاں تک کہ self-hosted انسٹالیشنز۔ اسے تین طریقوں سے کنفیگر کیا جا سکتا ہے:

  • Welcome اسکرین پر Connect بٹن → «Set Your API Key»;
  • ماڈل سلیکٹر میں Manage Models;
  • گیئر آئیکن → Settings → Model Settings → Add Provider۔

پرووائیڈر کے لیے OpenAI Base URL اور/یا Anthropic Base URL کے ساتھ API Key فراہم کرنی ہوتی ہے — ZCode خود بخود دستیاب ماڈلز کی فہرست حاصل کر لے گا۔

تین عام غلطیاں جو لوگ اکثر کرتے ہیں:

  • Z.ai کے Endpoint مختلف ہیں۔ Coding Plan سبسکرپشن صرف coding-endpoint https://api.z.ai/api/coding/paas/v4 کے ذریعے کام کرتی ہے؛ سبسکرپشن کی کے ساتھ عمومی /api/paas/v4 ایرر ریٹرن کرے گا — یہ "میں نے ادائیگی کر دی ہے لیکن 401/429 ایرر مل رہا ہے" مسئلے کی بنیادی وجہ ہے۔
  • «Claude Code میں کام کرتا ہے ≠ ZCode میں کام کرتا ہے»۔ وہ انوائرنمنٹ ویری ایبلز جن سے Claude Code کنفیگر کیا جاتا ہے، جیسے ANTHROPIC_BASE_URL، انہیں ZCode نہیں پڑھتا: اس کا اپنا پرووائیڈر سیٹنگز اسٹوریج ہے۔ سیٹنگز مینو کے ذریعے ہی کنفیگر کریں۔
  • «ماڈل سلیکٹر میں نظر آتا ہے ≠ کی (key) میں کوٹہ ہے»۔ ماڈلز کی فہرست پرووائیڈر کے API سے آتی ہے، مگر رسائی کا انحصار متعلقہ کی (key) کے بیلنس اور لمٹس پر ہوتا ہے۔

اگلا قدم عملی استعمال ہے: ZCode میں JoinGonka گیٹ وے کو منسلک کریں اور ٹوکن کے عوض GLM-اسٹیک استعمال کریں۔

ZCode میں JoinGonka Gateway کی کنفیگریشن: ٹوکن کے عوض GLM

JoinGonka Gateway — غیر مرکزی Gonka نیٹ ورک کا گیٹ وے جس میں دو مقامی پروٹوکول ہیں: OpenAI کے ساتھ ہم آہنگ /v1/chat/completions اور Anthropic Messages /v1/messages۔ اکنامک ماڈل pay-per-token ہے: کوئی 5 گھنٹے کی ونڈو نہیں، کوئی ×3 پیک ملٹی پلائر نہیں اور ایک متوازی درخواست کی حد نہیں؛ خرچ ڈیش بورڈ میں حقیقی وقت میں دکھائی دیتا ہے، گیٹ وے پرامپٹ کے مواد کو ذخیرہ نہیں کرتا۔

مرحلہ وار (موجودہ Custom Provider انٹرفیس کے مطابق):

مرحلہعمل
1. کلیدرجسٹر کریں — gate.joingonka.ai/register (نئے اکاؤنٹس کے لیے 10 ملین مفت ٹوکنز)، Keys سیکشن میں ایک API کلید بنائیں۔ تفصیلات — API Quick Start میں دیکھیں۔
2. پرووائیڈرZCode → Settings → Model Settings → Add Provider۔ نام: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyآپ کی jg-… طرز کی کلید
5. API formatChat completions (/chat/completions)
6. ماڈلAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000۔ اسی طرح moonshotai/Kimi-K2.6 اور MiniMaxAI/MiniMax-M2.7 شامل کیے جا سکتے ہیں؛ موجودہ فہرست — GET /v1/models۔

ZCode کے پرانے ورژنز میں اس کے بجائے دو الگ الگ فیلڈز ہیں: OpenAI Base URL (https://gate.joingonka.ai/v1) اور Anthropic Base URL (https://gate.joingonka.ai — کلائنٹ خود پاتھ شامل کر لے گا)۔

تصدیق: تخلیق کردہ ماڈل کو منتخب کریں اور ایجنٹ سے کوئی بھی سوال پوچھیں۔ اگر جواب آئے تو سب ٹھیک ہے؛ 401 ایرر پر کلید چیک کریں، 402 پر اکاؤنٹ کا بیلنس۔ اگر DeepSeek V4 Flash پر Thought Level Max ہونے پر «Model request failed» آتا ہے — تو Thought Level کو High پر سوئچ کریں اور دوبارہ کوشش کریں۔

ٹپ۔ کمانڈ npx @joingonka/setup --tool zcode نیچے دیے گئے فیلڈز کے لیے تیار شدہ اقدار پرنٹ کرے گی اور لائیو درخواست کے ذریعے چیک کرے گی کہ گیٹ وے انہیں قبول کر رہا ہے یا نہیں۔ ZCode کو صرف UI کے ذریعے کنفیگر کیا جاتا ہے — اس لیے اقدار کو دستی طور پر داخل کرنا ہوگا۔

قیمتوں کا موازنہ: Coding Plan, Z.ai API, OpenRouter اور Gonka

مختلف چینلز پر GLM-inference کی قیمت کیا ہے (1M ٹوکنز کے لیے قیمتیں؛ حریفوں کی قیمتیں جولائی 2026 کے لیے مقرر ہیں، JoinGonka کی قیمت API گیٹ وے سے براہ راست صفحے پر آتی ہے):

چینلان پٹ, $/1Mآؤٹ پٹ, $/1Mادائیگی کا ماڈل
Z.ai API (GLM-5.2)$1.40 (کیشڈ ان پٹ — $0.26)$4.40ٹوکن کے حساب سے
GLM Coding Plan$18—160/ماہسبسکرپشن: 'پرامپٹ' کوٹہ، پیک پر ×3 ملٹیپلائر، متوازی حدود
OpenRouter (z-ai/glm-5.2)$0.93$3.00ٹوکن کے حساب سے؛ GLM-5.2 کا کوئی مفت آپشن نہیں ہے
JoinGonka Gateway$0.0032$0.0097ٹوکن کے حساب سے، Gonka نیٹ ورک

دو سے تین آرڈر آف میگنیٹیوڈ کا فرق کوئی مارکیٹنگ راؤنڈنگ نہیں، بلکہ ایک الگ معیشت ہے: کیلکولیشنز وکندریقرت نیٹ ورک کے شرکاء انجام دیتے ہیں، جو ڈیٹا سینٹر کے مارجن پر نہیں، بلکہ خود کام پر کمائی کرتے ہیں۔ یہ کیسے کام کرتا ہے اور اس کی حدود کیا ہیں، اس کا تفصیلی تجزیہ سب سے سستے AI API کے بارے میں مضمون میں موجود ہے۔

GLM-5.2 کے بارے میں صاف ستھرا انتباہ: نیٹ ورک ماڈل کی درست قیمت ایکٹیویشن کے وقت طے کرے گا (اوپر دی گئی ٹیبل میں نیٹ ورک ماڈلز کی موجودہ لائیو قیمت ہے)۔ اس صفحے پر اعداد و شمار خود بخود اپ ڈیٹ ہوتے ہیں، کچھ بھی دستی طور پر دوبارہ کیلکولیٹ کرنے کی ضرورت نہیں ہے۔

Gonka نیٹ ورک پر GLM-5.2: سٹیٹس اور عام سوالات

zai-org/GLM-5.2-FP8 ماڈل پہلے ہی Gonka نیٹ ورک کی on-chain رجسٹری میں شامل کر دیا گیا ہے: کنفیگریشن 400K ٹوکنز تک کی ونڈو سیٹ کرتی ہے، اور یہ ماڈل بھاری ماڈلز میں سے ہے (ہر ریپلیکا کے لیے ایک ٹیرابائٹ سے زیادہ VRAM درکار ہوتی ہے)۔ فی الحال رول آؤٹ جاری ہے: نیٹ ورک نوڈز ویٹس کو وارم اپ کر رہے ہیں۔ جیسے ہی چیکس سبز ہو جائیں گے، ماڈل خود بخود گیٹ وے کی ماڈل لسٹ میں ظاہر ہو جائے گا—بیس URL اور کی تبدیل نہیں ہوتی، ZCode میں صرف سلیکٹر سے اسے منتخب کرنا ہوگا۔

ماڈل کے بارے میں: MIT لائسنس کے تحت اوپن ویٹس، ~750B پیرامیٹرز (فی ٹوکن تقریباً 40B فعال) کے ساتھ MoE آرکیٹیکچر، 1M ٹوکنز تک نیٹیو ونڈو۔ Z.ai کے مطابق، SWE-bench Pro پر ماڈل 62.1 اسکور دکھاتا ہے—جو GPT-5.5 سے زیادہ ہے، اور FrontierSWE پر Claude Opus 4.8 سے تقریباً ایک فیصد پیچھے ہے۔ اوپن-ویٹ ماڈل کے لیے یہ کوڈنگ میں پہلی پوزیشن ہے۔

عام سوالات:

  • نیا ماڈل شامل کرنے کے فوراً بعد 429 ایرر کیوں آتے ہیں؟ — یہ رول آؤٹ کا مرحلہ ہے: کچھ نوڈز ابھی ویٹس لوڈ کر رہے ہیں۔ کچھ سیکنڈ بعد درخواست دوبارہ بھیجیں—بیلنسر ایک فعال نوڈ ڈھونڈ لے گا۔
  • آج کیا دستیاب ہے؟ — Kimi K2.6, MiniMax M2.7 اور DeepSeek V4 Flash: تینوں ماڈلز ZCode میں اسی custom provider کے ذریعے کام کرتے ہیں، اس گائیڈ کی کنفیگریشن ابھی مکمل طور پر فعال ہے۔
  • پرائیویسی کا کیا ہوگا؟ — گیٹ وے پرامپٹس اور جوابات کا مواد محفوظ نہیں کرتا؛ شماریات میں صرف خرچ کا مجموعہ نظر آتا ہے۔
  • کب Coding Plan زیادہ فائدہ مند ہے؟ — اگر آپ اکیلے کام کرتے ہیں، Lite کوٹے میں رہتے ہیں اور متوازی ایجنٹس نہیں چلاتے، تو فکسڈ سبسکرپشن آسان اور قابل پیشگوئی ہے۔ اپنے پروفائل کے مطابق حساب لگائیں: فعال ایجنٹ کام میں نیٹ ورک کے ذریعے ٹوکنز کی ادائیگی بہت سستی پڑتی ہے، ہلکی کوڈنگ ایڈیٹنگ میں فرق محسوس نہیں ہو سکتا۔
  • کیا یہ دوسرے ٹولز کے لیے بھی موزوں ہے؟ — جی ہاں: وہی endpoint Claude Code, Cursor, Cline اور کسی بھی OpenAI/Anthropic-مطابقت پذیر کلائنٹ میں کام کرتا ہے۔
ZCode 3.0 ایک قابل ذکر ایجنٹ پر مبنی IDE ہے، لیکن اس کی مقامی GLM Coding Plan سبسکرپشن کوٹہ پر مبنی ہے: 5 گھنٹے کی ونڈوز میں "prompts"، پیک اوقات کے دوران ×3 ملٹیپلائر اور نچلے ٹیرف پر ایک متوازی درخواست۔ جتنا زیادہ ورک بوجھ ایجنٹ پر مبنی ہوگا، اتنا ہی یہ مہنگا اور غیر متوقع ہوگا۔ آفیشل BYOK مسئلے کا حل پیش کرتا ہے: JoinGonka Gateway کو custom provider کے طور پر منسلک کریں - اور وکندریقرت Gonka نیٹ ورک کی قیمتوں پر حقیقی ٹوکنز کے لیے ادائیگی کریں، جو مرکزی API کے مقابلے میں سینکڑوں گنا کم ہیں۔ GLM-5.2 پہلے ہی نیٹ ورک رجسٹری میں موجود ہے اور آپ کے ماڈل سلیکٹر میں خود بخود ظاہر ہو جائے گا، جبکہ Kimi K2.6, MiniMax M2.7 اور DeepSeek V4 Flash آج ہی کام کر رہے ہیں۔ 10M مفت ٹوکنز کے ساتھ شروعات کریں۔

مزید جاننا چاہتے ہیں؟

دیگر حصوں کو دریافت کریں یا ابھی GNK کمانا شروع کریں۔

10M مفت ٹوکنز حاصل کریں →