علم کے مرکز کے حصے ▾
نیویگیشن
▸ یہاں سے شروع کریں کردار کے لحاظ سےزمرہ جات
- گونکا نیٹ ورک کا فن تعمیر: اسپرنٹ، ٹرانسفر ایجنٹس، ڈیلکو
- ڈویلپرز: GNK کیسے کمائیں
- خود ہوسٹنگ: مرحلہ بہ مرحلہ گائیڈ
- Gonka کے لیے GPU کا انتخاب: ہارڈ ویئر کی سفارشات
- Qwen3-235B: وہ ماڈل جسے پہلے Gonka سرو کرتا تھا
- Kimi K2.6: ماڈل جو پہلے Gonka کے زیر انتظام تھا
- MiniMax M2.7: Gonka نیٹ ورک ماڈل
- DeepSeek V4 Flash: 380K کانٹیکسٹ کے ساتھ Gonka نیٹ ورک ماڈل
- GLM-5.3 Flash: Gonka نیٹ ورک میں Z.ai کا reasoning-ماڈل
ٹیکنالوجی
DeepSeek V4 Flash: 380K کانٹیکسٹ کے ساتھ Gonka نیٹ ورک ماڈل
اگست 2026 میں Gonka نیٹ ورک میں تیسرا فعال ماڈل — DeepSeek V4 Flash — شامل ہوا۔ اسے شامل کرنے کی governance تجویز #94 kaitaku.ai ٹیم نے پیش کی، جو کمیونٹی میں ML نوڈز کی آپٹیمائزیشن کے لیے مشہور ہے: انہوں نے ایسے تجربات کیے جنہوں نے ماڈل کی Proof of Compute اور نیٹ ورک ویلیڈیشن کے ساتھ مطابقت کی تصدیق کی، اور 12 اگست کو تجویز ووٹنگ کے ذریعے منظور ہوئی۔ اگلے ہی دن ماڈل درخواستیں سنبھالنے لگا۔
صارفین کے لیے یہ صلاحیتوں میں نمایاں اضافہ ہے: DeepSeek V4 Flash کا کانٹیکسٹ ونڈو 380 000 ٹوکنز ہے — نیٹ ورک میں سب سے طویل میں سے ایک (MiniMax M2.7 سے تقریباً دوگنا؛ صرف GLM-5.3 Flash اس سے تھوڑا طویل ہے — 390 000)، بلٹ-ان ریزننگ اور مکمل ٹول کالنگ۔ آئیے جانتے ہیں یہ ماڈل کیا ہے، اسے کس نے بنایا، Gonka نیٹ ورک میں اس کی خصوصیات کیا ہیں، بینچ مارکس کیا دکھاتے ہیں — اور کب اسے نیٹ ورک کے دیگر دو ماڈلز کے بجائے چننا چاہیے۔
DeepSeek V4 Flash کیا ہے اور اس کے پیچھے کون ہے
DeepSeek ہانگزو کی ایک چینی AI لیب ہے، جو V3 اور R1 کی ریلیز کے بعد عالمی سطح پر مشہور ہوئی: R1 نے 2025 کے اوائل میں ثابت کیا کہ ایک اوپن ماڈل اپنے بجٹ کے ایک حصے کے ساتھ بند فلیگشپ ماڈلز کا مقابلہ کر سکتا ہے۔ اپریل 2026 میں DeepSeek نے دو ماڈلز کی V4 فیملی جاری کی: ہیوی V4 Pro اور لائٹ V4 Flash۔ دونوں اوپن (MIT لائسنس) ہیں اور MoE آرکیٹیکچر پر مبنی ہیں۔
V4 Flash میں 284 بلین پیرامیٹرز ہیں، جن میں سے ہر ٹوکن کے لیے تقریباً 13 بلین پیرامیٹرز فعال ہوتے ہیں۔ یہ سپارسٹی ماڈل کو تیز اور سستا بناتی ہے: اسے 'گھنے' (dense) جائنٹس کی نسبت بہت کم ویڈیو میموری کی ضرورت ہوتی ہے، اور جنریشن کی رفتار زیادہ ہے۔
Gonka نیٹ ورک میں V4-Flash-0731 ورژن چل رہا ہے — 31 جولائی 2026 کا ری پوسٹ ٹرینڈ بلڈ۔ آرکیٹیکچر اور سائز میں تبدیلی نہیں کی گئی، لیکن ایجنٹ کے کاموں میں معیار تیزی سے بڑھا ہے: DeepSeek کے شائع کردہ 9 ایجنٹ اور کوڈنگ بینچ مارکس کے مطابق، 0731 بلڈ یہاں تک کہ ان کے اپنے فلیگ شپ V4 Pro پریویو ورژن کو بھی پیچھے چھوڑ دیتا ہے۔ ایمانداری کے لیے ایک اہم انتباہ: ان اعدادوشمار کا کچھ حصہ DeepSeek کی اپنی ٹیسٹ لیب کی پیمائش ہے، جو ابھی تک عوامی طور پر جاری نہیں کی گئی، لہذا آزادانہ ریپلیکیشن ابھی باقی ہے۔ بند ماڈلز کے فرنٹیئر کے ساتھ خلیج اب بھی موجود ہے: Claude Opus 4.8 کا مقابلہ یہ 0731 بلڈ کسی بھی 9 بینچ مارک میں نہیں کر پاتا — لیکن اس کی قیمت بہت کم ہے، اور یہی اس کا جوہر ہے: کم قیمت میں زیادہ سے زیادہ ایجنٹ کوالٹی۔
Gonka نیٹ ورک میں DeepSeek V4 Flash کی خصوصیات
نیٹ ورک کے دیگر ماڈلز کی طرح، ماڈل کی out of the box خصوصیات اور کسی مخصوص ڈیپلائمنٹ کے عملی پیرامیٹرز میں فرق کرنا ضروری ہے: یہ نیٹ ورک کے GPU ہوسٹس پر vLLM انفرنس کنفیگریشن طے کرتی ہے۔ ہمارے Gateway کے ذریعے حقیقی اقدار:
- کانٹیکسٹ ونڈو: 380 000 ٹوکنز — Gonka نیٹ ورک میں سب سے طویل میں سے ایک (صرف GLM-5.3 Flash زیادہ — 390 000)۔ ہم نے اسے تجرباتی طور پر جانچا: 381 000 ٹوکنز کے ان پٹ والی درخواست قبول اور کئی دہائیوں سیکنڈوں میں پروسیس ہوئی۔ V4 Flash کی آرکیٹیکچر خود 1 ملین ٹوکنز تک کانٹیکسٹ سپورٹ کرتی ہے؛ نیٹ ورک میں عملی حد ہوسٹ کنفیگریشن طے کرتی ہے (انفرنس ونڈو 400 000)۔
- زیادہ سے زیادہ آؤٹ پٹ: فی جواب 32 768 ٹوکنز — نیٹ ورک میں سب سے بڑی حد: MiniMax M2.7 اور GLM-5.3 Flash میں یہ چار گنا کم — 8 192؛ دونوں صورتوں میں یہ گیٹ وے کنفیگریشن ہے، ماڈل کی حد نہیں۔
- ریزننگ اور ٹول کالنگ: ماڈل ریزننگ اور ٹول انووکیشن پارسرز کے ساتھ ڈیپلائے کیا گیا ہے — ایجنٹک سیناریوز (Cursor, Claude Code, LangChain) فوراً کام کرتے ہیں؛ ہم نے OpenAI- اور Anthropic-کمپیٹیبل راستوں پر کثیر المرحلہ ٹول سیناریوز چلائے۔
- ہوسٹ VRAM کی ضرورت: تقریباً 280 GB — نیٹ ورک کا سب سے ہلکا ماڈل (موازنے کے لیے: MiniMax M2.7 — 320 GB، GLM-5.3 Flash — 560 GB)۔ ہارڈویئر کی حد جتنی کم، ہوسٹس کے لیے ماڈل ڈیپلائے کرنا اتنا ہی آسان — نیٹ ورک میں اس کی دستیابی کے لیے یہ اچھی علامت ہے۔
Gonka نیٹ ورک میں انفرنس کی قیمت ماڈل کے انتخاب پر منحصر نہیں: DeepSeek V4 Flash MiniMax M2.7 اور GLM-5.3 Flash کی طرح اسی ریٹ پر دستیاب ہے — JoinGonka Gateway کے ذریعے فی ملین ان پٹ پر $0.0069 اور فی ملین آؤٹ پٹ پر $0.021۔ موازنے کے لیے: OpenRouter پر تیسرے فریق فراہم کنندگان وہی ماڈل فی ملین $0.06/$0.12 سے دیتے ہیں، جبکہ خود DeepSeek نے ستمبر 2026 تک اپنے API سے V4 Flash 0731 واپس لے لیا — اب اس کی درخواستیں DeepSeek-V4.1-Flash سنبھالتا ہے، پیک اوقات میں $0.30/$1.20 پر۔ نیٹ ورک کی معاشیات — الگ موضوع: قیمت کمپیوٹیشنل کام کی تصفیہ سے طے ہوتی ہے، وینڈر کی قیمت سے نہیں۔
DeepSeek V4 Flash، MiniMax M2.7 اور GLM-5.3 Flash — موازنہ
نیٹ ورک میں تین فعال ماڈلز ہیں — DeepSeek V4 Flash، MiniMax M2.7 اور GLM-5.3 Flash (Kimi K2.6 کو ستمبر 2026 میں نیٹ ورک سے نکال دیا گیا تھا، اور GLM-5.2 جو طویل عرصے سے رجسٹر میں تھی، کبھی بھی فعال ٹیم کا حصہ نہیں بنی)۔ مختصر موازنہ:
| پیرامیٹر | DeepSeek V4 Flash | MiniMax M2.7 | GLM-5.3 Flash |
|---|---|---|---|
| نیٹ ورک میں کونٹیکسٹ | 380,000 | 200,000 | 390,000 |
| آؤٹ پٹ فی جواب | 32,768 | 8,192 | 8,192، بشمول reasoning |
| آرکیٹیکچر | MoE 284B (~13B فعال) | MoE + لکیری توجہ | MoE 320B (~18B فعال)، ہائبرڈ توجہ |
| VRAM فی نوڈ | 280 GB | 320 GB | 560 GB |
| مضبوط پہلو | طویل کونٹیکسٹ، reasoning، رفتار | روزمرہ ڈیولپمنٹ، استحکام | پیچیدہ منطق، کوڈ کا تجزیہ، "سوچنے" والے کام |
| گیٹ وے کے ذریعے قیمت | ایک جیسی — $0.0069 ان پٹ / $0.021 آؤٹ پٹ فی 1M | ||
ایک جیسی قیمت کا عملی نتیجہ: آپ بغیر بجٹ کی فکر کیے کام کے لحاظ سے ماڈل منتخب کر سکتے ہیں۔ بڑے پرامپٹس جن کے لیے تیز جواب اور سب سے زیادہ آؤٹ پٹ درکار ہو — DeepSeek V4 Flash؛ ایسے کام جہاں پیچیدہ منطق پر غور کرنا ہو (اور نیٹ ورک کی سب سے طویل کونٹیکسٹ چاہیے) — GLM-5.3 Flash؛ ہر دن کے لیے قابل بھروسہ ورک ہارس — MiniMax M2.7۔
V4-Flash-0731 بینچ مارک: بلڈ کیا ظاہر کرتی ہے
0731 بلڈ کے شائع شدہ اہم نتائج (DeepSeek اور آزاد ایگریگیٹرز کے مطابق):
- SWE-bench Verified: 79.0% — حقیقی GitHub ٹاسکس کا حل؛ یہ سطح ایک سال پہلے صرف بند (closed) فلیگ شپ ماڈلز کے لیے دستیاب تھی۔ موازنہ کے لیے: Kimi K2.6، جسے نیٹ ورک پہلے استعمال کرتا تھا، کا اسکور 71.3% تھا۔
- GPQA Diamond: 88.1% — سائنسی گریجویٹ سطح کے سوالات؛ جدید استدلال (reasoning) موڈ ملٹی اسٹیپ ٹاسکس میں درستگی بڑھاتا ہے۔
- Terminal Bench 2.1: 82.7 — بطور ایجنٹ ٹرمینل میں کام؛ Flash پریویو ورژن کا اسکور 61.8 اور V4 Pro Preview کا 72.1 تھا۔
- DeepSWE: 54.4 — DeepSeek کا نیا سخت بینچ مارک جس میں تقریباً صفر غلط مثبت (false positives) ہیں؛ یہ وینڈر کا ڈیٹا ہے، اسٹینڈ ابھی شائع نہیں ہوا — اس لیے اسے احتیاط کے ساتھ دیکھیں۔
شفاف حدود: نو ایجنٹ بینچ مارکس میں 0731 بلڈ اپنے V4 Pro Preview سے آگے نکل گیا ہے، لیکن Claude Opus 4.8 سے پیچھے ہے (اوسطاً 6 پوائنٹس کا فرق)۔ تاہم، ٹوکن کی قیمت کے لحاظ سے یہ ماڈل Opus سے دو گنا سستا ہے، اور Gonka نیٹ ورک کے ذریعے یہ OpenRouter پر موجود دیگر تھرڈ پارٹی پرووائیڈرز کے مقابلے میں تقریباً 9 گنا سستا ہے۔ یہی "فرنٹیر کے قریب معیار اور کم قیمت" کا تناسب اسے دلچسپ بناتا ہے: تفصیلی آزادانہ پیمائش دیکھنے کے لیے Artificial Analysis، اور ماڈل کے ویٹس اور کارڈ کے لیے Hugging Face دیکھیں۔
JoinGonka Gateway کے ذریعے DeepSeek V4 Flash کیسے استعمال کریں
یہ ماڈل JoinGonka Gateway کے ذریعے OpenAI- اور Anthropic-سازگار API پر دستیاب ہے۔ ماڈل شناخت کنندہ: deepseek-ai/DeepSeek-V4-Flash-0731۔
سب سے تیز طریقہ — ایک کمانڈ والا انسٹالر، جو آپ کے ٹول (Claude Code، OpenClaw، Cline، opencode، Aider اور دیگر) کو فوراً اسی ماڈل پر سیٹ کر دے گا:
npx @joingonka/setup --model deepseekجہاں انسٹالر خود کنفگ لکھتا ہے (Claude Code، Codex CLI، OpenClaw، opencode، Kilo Code، Hermes، Pi اور دیگر)، وہاں DeepSeek V4 Flash فلیگ کے بغیر ہی ڈیفالٹ ہے۔ فلیگ پہلے سے سیٹ شدہ ٹول کو سوئچ کرنے کے لیے اور وہاں درکار ہے جہاں انسٹالر پیسٹ کرنے کی قدریں چھاپتا ہے (Cursor، Cline، Aider)۔ نیٹ ورک کے باقی ماڈلز بھی اسی طرح منتخب کیے جاتے ہیں: --model minimax اور --model glm۔
براہ راست API کال (OpenAI فارمیٹ):
curl https://gate.joingonka.ai/v1/chat/completions \
-H "Authorization: Bearer jg-your-key" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-ai/DeepSeek-V4-Flash-0731","messages":[{"role":"user","content":"Hello!"}]}'رجسٹریشن پر آپ کو 3M مفت ٹوکنز ملتے ہیں — 380K کانٹیکسٹ کے ساتھ یہ موقع ہے کہ ماڈل کو فوراً حقیقی بڑی دستاویزات اور کوڈ بیسز پر آزمایا جائے۔ Python اور TypeScript میں مرحلہ وار مثالیں — API Quickstart میں؛ رجسٹریشن کے بغیر مفت چیٹ میں ماڈلز کی فہرست سے DeepSeek V4 Flash منتخب کر کے آزما سکتے ہیں۔
DeepSeek V4 Flash کب منتخب کریں — عملی منظرنامے
اس ماڈل کے لیے مضبوط منظرنامے:
- بڑی دستاویزات اور مکمل کوڈ بیسز۔ 380,000 ٹوکنز — یہ تقریباً 280,000 الفاظ ہیں: سالانہ رپورٹ، قانونی دستاویزات کا پیکج یا اوسط ریپوزٹری ایک ہی درخواست میں فٹ ہو جاتا ہے، بغیر ٹکڑوں میں کاٹے اور حصوں کے درمیان تعلق کھوئے بغیر۔
- لمبے ایجنٹ سیشنز۔ ایک خودمختار ایجنٹ جو فائلیں پڑھتا ہے، ٹولز کال کرتا ہے اور تاریخ جمع کرتا ہے، سب سے تیزی سے کانٹیکسٹ کی حد پر پہنچ جاتا ہے — 380K ٹوکنز کا ذخیرہ میموری ری سیٹ کے بغیر نمایاں طور پر طویل سیشنز کا مطلب ہے۔
- بڑی سلیکشنز کے ساتھ RAG۔ کانٹیکسٹ میں جتنے زیادہ متعلقہ دستاویزات فٹ ہوں گے، تلاش کی درستگی پر انحصار اتنا ہی کم ہوگا۔
- استدلال والے کام۔ Reasoning موڈ ریاضی، سائنس اور کثیر المرحل منطق میں اضافہ دیتا ہے — ایک عام ماڈل کی قیمت پر۔
کب نیٹ ورک کا کوئی اور ماڈل زیادہ معقول ہے: ایسے کاموں کے لیے جہاں پیچیدہ منطق پر غور کرنا ہو، GLM-5.3 Flash موجود ہے — نیٹ ورک کا reasoning ماڈل (ڈیولپمنٹ کے لیے ماڈلز کا تفصیلی تجزیہ — کوڈ کے لیے بہترین ماڈلز کے مضمون میں)، اور MiniMax M2.7 روزمرہ کے کاموں کے لیے ایک آزمودہ ورک ہارس ہے۔ یکساں قیمت کی بدولت آزادانہ تجربہ کیا جا سکتا ہے — ماڈل تبدیل کرنا درخواست میں صرف ایک لائن ہے۔
مزید جاننا چاہتے ہیں؟
دیگر حصوں کو دریافت کریں یا ابھی GNK کمانا شروع کریں۔
Gateway کے ذریعے DeepSeek V4 Flash آزمائیں →