علم کے مرکز کے حصے ▾

نیویگیشن

▸ یہاں سے شروع کریں کردار کے لحاظ سے

زمرہ جات

ٹولز 52
لغت 12

Tools

ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced

جون 2026 میں Z.ai نے ZCode 3.0 جاری کیا—ایک ڈیسک ٹاپ ایجنٹک ڈیولپمنٹ ماحول، جسے کمپنی خود "Official Harness for GLM-5.2" کہتی ہے۔ پروڈکٹ نے تیزی سے توجہ حاصل کی: اپنا ایجنٹک کور، /goal کے ذریعے خود مختار ٹاسک، ملٹی ایجنٹ موڈ اور براہ راست Telegram سے ریموٹ سیشن مینجمنٹ۔ لیکن جائزے کے ساتھ ساتھ GLM Coding Plan کے پہلے سبسکرائبرز کی طرف سے سوالات کا سلسلہ بھی شروع ہوا: کوٹہ پانچ گھنٹے کے ونڈو میں "پرامپٹس" کے طور پر شمار ہوتا ہے، پیک آورز میں خرچ تین گنا ہو جاتا ہے، چھوٹے پلانز میں صرف ایک متوازی درخواست کی اجازت ہے، اور Hacker News پر کام کے مصروف دن کے بعد اچانک بلاک ہونے کی شکایتیں آ رہی ہیں۔

اچھی خبر یہ ہے کہ ZCode سرکاری طور پر custom provider کو سپورٹ کرتا ہے—اس کے ساتھ کوئی بھی OpenAI یا Anthropic سے مطابقت رکھنے والی API منسلک کی جا سکتی ہے اور سبسکرپشن کوٹے کے بجائے اصل ٹوکن کے لیے ادائیگی کی جا سکتی ہے۔ اس گائیڈ میں ہم تجزیہ کریں گے کہ ZCode کیا ہے اور GLM Coding Plan کیسے کام کرتا ہے، اور پھر مرحلہ وار ZCode کو JoinGonka Gateway پر سیٹ اپ کریں گے—Gonka کے وکندریقرت نیٹ ورک کا گیٹ وے، جو Z.ai کا اپنا اوپن ریزننگ ماڈل GLM-5.3 Flash فراہم کرتا ہے۔ نتیجہ: وہی ٹول، وہی open-weight ماڈلز، لیکن اکانومی ٹوکن پر مبنی اور سینٹرلائزڈ API کے مقابلے میں بہت سستی۔

ZCode کیا ہے: Z.ai کا ایجنٹک ڈیولپمنٹ انوائرمنٹ

ZCode کوئی "چیٹ-سائیڈ بار والا ایڈیٹر" نہیں، بلکہ ایک ADE ہے: آپ مقصد طے کرتے ہیں، ایجنٹ پلان بناتا ہے، فائلیں ٹھیک کرتا ہے، ٹیسٹ چلاتا ہے اور نتیجہ آنے تک کام جاری رکھتا ہے۔ یہ macOS اور Windows پر ڈیسک ٹاپ ایپ کے طور پر کام کرتا ہے (Linux ورژن ابھی بیٹا میں ہے)۔

ورژن 3.0 کی اہم صلاحیتیں:

  • ZCode Agent — GLM-5.2 کی گہری انٹیگریشن کے ساتھ اپنا ایجنٹک کور؛ اس کے ساتھ تھرڈ پارٹی ایجنٹس بھی منسلک کیے جا سکتے ہیں (Claude Code, Codex, Gemini CLI وغیرہ)؛
  • Goal-موڈ (/goal) — طویل خودکار کام: پلان → عملدرآمد → مرحلہ وار تصدیق؛
  • Multi-agent — ایک پروجیکٹ پر متعدد ایجنٹس کا متوازی کام؛
  • ریموٹ مینجمنٹ — Telegram, WeChat اور Feishu سے سیشن چلانا اور کنٹرول کرنا: ایجنٹ آپ کی مشین پر کام کرے گا، اور آپ فون سے سوالات کے جواب دیں گے۔

کلائنٹ خود مفت ہے، Z.ai نئے صارفین کو GLM-5.2 آزمانے کے لیے روزانہ ٹوکن کوٹہ دیتا ہے۔ اس کے بعد آپ کو یا تو GLM Coding Plan سبسکرائب کرنا ہوگا، یا اپنا API-key استعمال کرنا ہوگا۔ اور یہیں تفصیلات سمجھنا ضروری ہے، کیونکہ سبسکرپشن ماڈل ہی اس پروڈکٹ کا سب سے اہم موضوع ہے۔

GLM Coding Plan: قیمت، حدود اور کوٹہ

GLM Coding Plan — Z.ai کا سبسکرپشن جو ZCode اور بیس سے زائد بیرونی ٹولز میں GLM ماڈلز تک رسائی دیتا ہے۔ اشاعت کے وقت (جولائی 2026) بنیادی ٹیبل یوں ہے — مگر قیمتیں اور آفرز بدلتی رہتی ہیں، z.ai/subscribe کے لائیو صفحے سے تصدیق کر لیں:

پلانقیمت، $/ماہکوٹہمتوازی درخواستیں
Lite$18 (آفرز میں — تقریباً $12.6 سے)5 گھنٹے کی ونڈوز میں «prompt» + ہفتہ وار حد1
Pro$72Lite کا ×41
Max$160Lite کا ×1630 تک

سبسکرائبرز کس چیز کی شکایت کرتے ہیں (Hacker News اور GitHub تھریڈز):

  • پیک آورز کا ملٹی پلائر۔ پیک آورز میں (14:00—18:00 UTC+8 — ایشیا میں شام، یورپ میں صبح-دوپہر) ہر درخواست ×3 گنانک سے کوٹہ کاٹتی ہے، پیک سے باہر ×2۔ اخراجات کی منصوبہ بندی بیجنگ ٹائم زون پر کرنی پڑتی ہے۔
  • کوٹہ «prompt» میں، ٹوکنز میں نہیں۔ اصل میں کتنے ٹوکنز باقی ہیں — غیر واضح؛ تھریڈز میں ایسے قصے ملتے ہیں «GLM پر ~17M ٹوکنز استعمال کیے — اور چار دن کا بلاک مل گیا»۔
  • Lite اور Pro پر ایک متوازی درخواست۔ ایجنٹ ماحول میں یہ واضح محسوس ہوتا ہے: ZCode کا multi-agent موڈ اور کوئی بھی متوازی سب ایجنٹ قطار میں رک جاتا ہے۔
  • GLM-5.2 کوٹہ چھوٹے ماڈلز سے تیز ختم کرتا ہے — فلیگ شپ اپنے ملٹی پلائر کے ساتھ حد جلا دیتا ہے۔

نتیجہ آسان ہے: پرسکون انفرادی ڈویلپمنٹ کے لیے سبسکرپشن ایمانداری سے کام کرتا ہے۔ مگر آپ کا موڈ جتنا زیادہ «ایجنٹ محور» ہو — متوازی کام، طویل خودمختار سیشنز، رات کے رنز — اتنی ہی بار کوٹہ ماڈل لاٹری بن جاتا ہے۔ متبادل — اصل ٹوکنز کی بنیاد پر ادائیگی: ونڈوز، ملٹی پلائرز اور قطاروں کا جھنجھٹ نہیں — ایجنٹ نے جتنا خرچ کیا، اتنا ہی کٹا۔ ZCode میں بلٹ اِن custom provider یہی ماڈل دیتا ہے، اور سیٹ اپ پانچ منٹ کا کام ہے۔

ZCode میں BYOK: اپنا API-key اور custom provider

ZCode میں باضابطہ طور پر BYOK سپورٹ بلٹ اِن ہے: دستاویزات واضح طور پر اجازت دیتی ہیں کہ «OpenAI یا Anthropic پروٹوکولز سے مطابقت رکھنے والی کوئی بھی سروس» شامل کی جا سکتی ہے — پبلک APIs، کارپوریٹ چینلز اور حتیٰ کہ self-hosted انسٹالیشنز بھی۔ تین طریقوں سے کنفیگر کیا جاتا ہے:

  • welcome اسکرین پر Connect بٹن → «Set Your API Key»;
  • ماڈل سلیکٹر میں Manage Models;
  • گیئر آئیکن → Settings → Model Settings → Add Provider۔

پرووائیڈر کو OpenAI Base URL اور/یا Anthropic Base URL کے ساتھ API Key دیا جاتا ہے — دستیاب ماڈلز کی فہرست ZCode خود کھینچ لے گا۔

تین جگہیں جہاں سب سے زیادہ ٹھوکر کھائی جاتی ہے:

  • Z.ai کے Endpoint' مختلف ہیں۔ Coding Plan سبسکرپشن صرف coding-endpoint https://api.z.ai/api/coding/paas/v4 کے ذریعے کام کرتی ہے؛ سبسکرپشن کلید کے ساتھ عام /api/paas/v4 ایرر دے گا — «پلان پیڈ ہے پھر بھی 401/429 آ رہا ہے» کی کلاسک وجہ۔
  • «Claude Code میں چلتا ہے ≠ ZCode میں چلتا ہے۔» ANTHROPIC_BASE_URL جیسے ماحولیاتی ویری ایبلز جن سے Claude Code کنفیگر کیا جاتا ہے، ZCode انہیں نہیں پڑھتا: اس کا اپنا پرووائیڈر سیٹنگز اسٹور ہے۔ صرف Settings کے ذریعے کنفیگر کریں۔
  • «سلیکٹر میں ماڈل نظر آتا ہے ≠ کلید کے پاس کوٹہ ہے۔» ماڈلز کی فہرست پرووائیڈر کے API سے آتی ہے، اور رسائی مخصوص کلید کے بیلنس اور لِمٹس پر منحصر ہے۔

اب عملی حصہ: ZCode میں JoinGonka گیٹ وے منسلک کرتے ہیں اور ٹوکنز کے عوض GLM اسٹیک حاصل کرتے ہیں۔

ZCode میں JoinGonka Gateway کی کنفیگریشن: ٹوکن کے عوض GLM

JoinGonka Gateway — Gonka ڈیسینٹرلائزڈ نیٹ ورک کا ایک گیٹ وے ہے جس میں دو نیٹو پروٹوکولز ہیں: OpenAI سے ہم آہنگ /v1/chat/completions اور Anthropic Messages /v1/messages۔ اکانومی pay-per-token ہے: کوئی 5 گھنٹے کی ونڈو، ×3 پیک ملٹی پلائر، یا ایک متوازی ریکوسٹ کی حد نہیں؛ خرچ ڈیش بورڈ میں ریئل ٹائم میں نظر آتا ہے اور گیٹ وے پرامپٹس کا مواد محفوظ نہیں کرتا۔

مرحلہ وار (موجودہ Custom Provider انٹرفیس):

مرحلہعمل
1. کیرجسٹر کریں — gate.joingonka.ai/register (نئے اکاؤنٹس کے لیے 3M فری ٹوکنز)، Keys سیکشن میں API-کی بنائیں۔ تفصیلات — API Quick Start میں۔
2. پرووائیڈرZCode → Settings → Model Settings → Add Provider۔ نام: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyآپ کی jg-… فارمیٹ کی کی
5. API formatChat completions (/chat/completions)
6. ماڈلAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731، Context window 380000۔ اسی طرح MiniMaxAI/MiniMax-M2.7 اور zai-org/GLM-5.3-Flash شامل کریں — Z.ai کا اپنا ریزننگ ماڈل؛ موجودہ فہرست اور حدیں — GET /v1/models۔

ZCode کے پرانے ورژنز میں اس کی بجائے دو الگ فیلڈز ہیں: OpenAI Base URL (https://gate.joingonka.ai/v1) اور Anthropic Base URL (https://gate.joingonka.ai — کلائنٹ خود پاتھ شامل کر لے گا)۔

تصدیق: منتخب کردہ ماڈل کے ساتھ ایجنٹ سے کوئی بھی سوال کریں۔ جواب آ گیا تو سب ٹھیک ہے؛ 401 ایرر پر کی چیک کریں، 402 پر اکاؤنٹ بیلنس۔ اگر DeepSeek V4 Flash پر Thought Level Max کے دوران «Model request failed» آتا ہے تو Thought Level کو High پر سوئچ کریں اور دوبارہ کوشش کریں۔

ٹپ۔ npx @joingonka/setup --tool zcode کمانڈ ان فیلڈز کے لیے تیار ویلیوز پرنٹ کرے گی — بیس URL، کی، ماڈل آئی ڈی اور اس کی اصل حدیں: کانٹیکسٹ ونڈو اور رسپانس کی حد — اور ایک لائیو ریکوسٹ کے ذریعے چیک کرے گی کہ گیٹ وے انہیں قبول کر رہا ہے۔ ZCode صرف UI کے ذریعے کنفیگر ہوتا ہے — اس کی کوئی ایسی فائل نہیں ہے جسے محفوظ طریقے سے ایڈٹ کیا جا سکے، اس لیے ویلیوز دستی طور پر درج کرنی ہوں گی۔

قیمتوں کا موازنہ: Coding Plan, Z.ai API, OpenRouter اور Gonka

مختلف چینلز پر GLM-انفرنس کی قیمت (فی 1M ٹوکنز؛ حریفوں کی قیمتیں ستمبر 2026 کے مطابق ہیں، JoinGonka کی قیمت گیٹ وے API سے براہ راست صفحے پر لائیو دکھائی جاتی ہے):

چینلان پٹ، $/1Mآؤٹ پٹ، $/1Mادائیگی کا ماڈل
Z.ai API (GLM-5.2)$1.40 (کیشڈ ان پٹ — $0.26)$4.40ٹوکنز کے لحاظ سے
GLM Coding Plan$18—160/ماہسبسکرپشن: "پرامپٹ" کوٹہ، پیک آورز میں ×3 ملٹی پلائر، متوازی حدیں
OpenRouter (z-ai/glm-5.2)$1.40$4.40ٹوکنز کے لحاظ سے
OpenRouter (z-ai/glm-5.3-flash)$0.09$0.30ٹوکنز کے لحاظ سے
JoinGonka Gateway$0.0069$0.021ٹوکنز کے لحاظ سے، Gonka نیٹ ورک

دو سے تین درجے کا فرق کوئی مارکیٹنگ راؤنڈنگ نہیں، بلکہ ایک مختلف معیشت ہے: کمپیوٹیشنز ڈی سینٹرلائزڈ نیٹ ورک کے شرکاء انجام دیتے ہیں، جو ڈیٹا سینٹر کے مارجن کے بجائے کام کی بنیاد پر کماتے ہیں۔ اس کا طریقہ کار اور اس کے اطلاق کی حدود کے بارے میں تفصیلی تجزیہ سستے ترین AI API آرٹیکل میں ملاحظہ کریں۔

JoinGonka کی لائن Gonka نیٹ ورک پر GLM-5.3 Flash کی قیمت ہے: نیٹ ورک کے تمام ماڈلز کے لیے یکساں ٹیرف لاگو ہے۔ اس صفحے کے اعداد و شمار خود بخود اپ ڈیٹ ہوتے ہیں، اس لیے دستی طور پر کچھ حساب کرنے کی ضرورت نہیں ہے۔

Gonka نیٹ ورک میں GLM: GLM-5.3 Flash اور عام سوالات

Gonka نیٹ ورک Z.ai ماڈل کی سروس فراہم کرتا ہے: zai-org/GLM-5.3-Flash جسے گورننس پروپوزل #101 کے ذریعے منظور کیا گیا ہے اور اسے MiniMax M2.7 اور DeepSeek V4 Flash کے ساتھ گیٹ وے کے ذریعے پیش کیا جاتا ہے۔ فلیگ شپ GLM-5.2، جس کا ذکر اس گائیڈ کے ابتدائی ورژنز میں تھا، آپریشنل لائن اپ میں شامل نہیں ہوا — نیٹ ورک نے اسی سیریز کے ایک ہلکے اور تیز ماڈل کا انتخاب کیا ہے۔ Base URL اور کی وہی ہے: ZCode میں بس کسٹم پرووائیڈر میں ماڈل کو شامل کرنا کافی ہے۔

ماڈل کے بارے میں: MIT لائسنس کے تحت اوپن ویٹس، 320B پیرامیٹرز پر MoE آرکیٹیکچر (18B ایکٹیو فی ٹوکن)، ہائبرڈ اسپارس اور لکیری توجہ۔ اہم خصوصیت یہ ہے کہ یہ ایک reasoning-ماڈل ہے: جواب دینے سے پہلے یہ سوچتا ہے، اور سوچنے کا عمل سادہ سوالات پر بھی کئی سو ٹوکنز لیتا ہے۔ ZCode کے لیے اس کا مطلب دو چیزیں ہیں: ماڈل کی جواب کی لمبائی کی حد کو بہت کم نہ کریں (چھوٹے جوابات کے لیے بھی 600 ٹوکنز سے) اور فوری تبدیلیوں کے لیے Thought Level کو کم کریں — API کی سطح پر یہ reasoning_effort: low ہے۔ ماڈل اور اس کی حدود کا تفصیلی تجزیہ مضمون Gonka نیٹ ورک پر GLM-5.3 Flash میں موجود ہے۔

اکثر پوچھے گئے سوالات:

  • نئے ماڈل پر 429 یا قطار کیوں ہوتی ہے؟ — ماڈل فی الحال نیٹ ورک کے ہوسٹس کے ایک چھوٹے حصے پر چل رہا ہے؛ چوٹی کے اوقات میں درخواستیں خالی سلاٹ کا انتظار کر سکتی ہیں۔ کچھ سیکنڈ بعد دوبارہ کوشش کریں — لوڈ بیلنسر ایک فعال نوڈ تلاش کر لے گا۔ موجودہ حالت گیٹ وے اسٹیٹس پیج پر دیکھیں۔
  • اور کیا دستیاب ہے؟ — GLM-5.3 Flash کے علاوہ MiniMax M2.7 اور DeepSeek V4 Flash موجود ہیں: تینوں ماڈلز ZCode میں ایک ہی کسٹم پرووائیڈر کے ذریعے کام کرتے ہیں، اس گائیڈ کی کنفیگریشن مکمل طور پر کارآمد ہے۔
  • پرائیویسی کا کیا ہوگا؟ — گیٹ وے پرامپٹس اور جوابات کے مواد کو اسٹور نہیں کرتا؛ اعداد و شمار میں صرف کھپت کے مجموعے ہوتے ہیں۔
  • Coding Plan کب زیادہ فائدہ مند ہے؟ — اگر آپ اکیلے کام کرتے ہیں، Lite کوٹے میں رہتے ہیں اور متوازی ایجنٹ نہیں چلاتے، تو فکسڈ پیکیج آسان اور پیش گوئی کے قابل ہے۔ اپنے پروفائل کے مطابق حساب لگائیں: فعال ایجنٹ ورک لوڈ کے ساتھ، نیٹ ورک کے ذریعے ٹوکن کی ادائیگی سینکڑوں گنا سستی پڑتی ہے، جبکہ دن میں ایک دو بار کوڈ میں معمولی تبدیلیوں کے لیے فرق محسوس نہیں ہو سکتا۔
  • کیا یہ دیگر ٹولز کے لیے موزوں ہے؟ — جی ہاں: وہی endpoint Claude Code، Cursor، Cline اور کسی بھی OpenAI/Anthropic-مطابقت پذیر کلائنٹ میں کام کرتا ہے۔
ZCode 3.0 ایک قابل ذکر ایجنٹ IDE ہے، لیکن اس کا مقامی GLM Coding Plan کوٹہ پر مبنی ہے: 5 گھنٹے کی ونڈوز میں 'پرامپٹس'، چوٹی کے اوقات میں ×3 ملٹیپلائر اور نچلے ٹیرز پر صرف ایک متوازی درخواست۔ جتنا زیادہ ایجنٹ لوڈ ہوگا، یہ اتنا ہی مہنگا اور غیر متوقع ہوگا۔ آفیشل BYOK اس مسئلے کو حل کرتا ہے: JoinGonka Gateway کو کسٹم پرووائیڈر کے طور پر کنیکٹ کریں — اور Gonka کے غیر مرکزی نیٹ ورک کی قیمتوں پر اصل ٹوکنز کے لیے ادائیگی کریں، جو مرکزی APIs سے سیکڑوں گنا کم ہیں۔ GLM-5.3 Flash — Z.ai کا اپنا اوپن reasoning-ماڈل — نیٹ ورک پر پہلے سے موجود ہے، اس کے ساتھ MiniMax M2.7 اور DeepSeek V4 Flash بھی دستیاب ہیں۔ مفت ابتدائی ٹوکنز سے شروعات کریں۔

مزید جاننا چاہتے ہیں؟

دیگر حصوں کو دریافت کریں یا ابھی GNK کمانا شروع کریں۔

مفت ٹوکن حاصل کریں →