ڈیپسیک نے ایک ماڈل جاری کیا ہے جو ایک ملین ٹوکنز کے کنٹیکس کو پروسیس کرتا ہے اور دو سال پہلے جاری کیے گئے کچھ اوپن سورس ماڈلز سے کم پیرامیٹرز کو فعال کرتا ہے۔ 10 ستمبر کو لانچ کیا گیا V4.1-Flash، چینی AI اسٹارٹ اپ کی آخری کوشش ہے جس کا مقصد بڑے زبانی ماڈلز کی مالیات کو دوبارہ تعریف کرنا ہے۔
یہ ماڈل 552 ارب پیرامیٹرز کو ایک مکسچر آف ایکسپرٹس (MoE) آرکیٹیکچر میں پیک کرتا ہے، لیکن صرف تقریباً 8 ارب پیرامیٹرز کو ان پٹ کاموں کے لیے اور 16 ارب پیرامیٹرز کو آؤٹ پٹ کے لیے فائر کرتا ہے۔ نتیجہ ایک ایسا ماڈل ہے جو اس کے فعال کمپیوٹ فٹ پرنٹ سے کہیں زیادہ طاقت رکھتا ہے۔
جس ساخت کی وجہ سے یہ کام کرتا ہے
V4.1-Flash ایک ایسی غیر متوازن سببی اینکوڈر-ڈیکوڈر آرکیٹیکچر پیش کرتا ہے جسے DeepSeek نے ڈیزائن کیا ہے، جو ان پٹ کو معالجہ کرتا ہے اور ہر کام کے لیے الگ الگ بہترین طریقوں کے ذریعے آؤٹ پٹ جنریٹ کرتا ہے، ایک منفرد پائپ لائن سے گزر کر نہیں۔
کنٹیکس ونڈو 1 ملین ٹوکن تک پھیل جاتی ہے۔ اس بہت بڑے کنٹیکس کی حمایت کے لیے ایک KV کیش استعمال ہوتی ہے جو ہر ٹوکن کے لیے تقریباً 890 بائٹس استعمال کرتی ہے، جو پچھلے V4-Flash ماڈل کی ضرورت کا تقریباً ایک چوتھائی حصہ ہے۔
یہ کیش کمی اس سے زیادہ اہم ہے جتنا کہ سننے میں آتی ہے۔ KV کیش وہ میموری باٹل نیک ہے جو یہ طے کرتا ہے کہ ایک ماڈل ایک ساتھ کتنے صارفین کو سروس دے سکتا ہے اور ان کی بات چیت کتنی لمبی چل سکتی ہے۔ اسے 75 فیصد کم کرنا کامیابی کا مطلب ہے کہ آپریٹرز ایک ہی ہارڈ ویئر پر تقریباً چار گنا زیادہ صارفین کو سروس دے سکتے ہیں، یا اپنے GPU کلسٹرز کو اپ گریڈ کئے بغیر چار گنا لمبے کانٹیکسٹس کو ہینڈل کر سکتے ہیں۔
بینچ مارکس پر، ڈیپسیک کا دعویٰ ہے کہ V4.1-Flash اپنے ہی V4-Pro ماڈل کو پار کر جاتا ہے اور GPT-5.6 اور Kimi K3 کے ساتھ براہ راست مقابلہ کرتا ہے۔ کمپنی پہلے ہی V4-Pro سے درخواستوں کو نئے ماڈل پر ری ڈائریکٹ کر رہی ہے، جس کے لیے اپڈیٹڈ قیمتیں 14 ستمبر سے لاگو ہو جائیں گی۔
کھلے وزن، کھلی حکمت عملی
ڈیپسیک نے ہگنگ فیس پر مدل کے وزن کو ایم آئی ٹی لائسنس کے تحت جاری کیا ہے۔ نیا مدل "deepseek-flash" اینڈ پوائنٹ کے ذریعے ڈیپسیک کی API کے ذریعے دستیاب ہے۔ کھلے وزن اور API تک رسائی کا ترکیبی اثر ایک دو راستہ اپنائی کا باعث بنتا ہے: وہ ڈویلپرز جو اپنی اپنی انفراسٹرکچر پر انفرنس کو چلانا چاہتے ہیں، وہ مقامی طور پر ڈاؤن لوڈ اور ڈپلوی کر سکتے ہیں، جبکہ جو لوگ مینجڈ سروسز کو ترجیح دیتے ہیں، وہ ڈیپسیک کے نئے قیمتی طبقات پر API کو کال کر سکتے ہیں۔
آئی پی او کے اثرات اور مقابلہ کی پوزیشن
V4.1-Flash کے لانچ کا وقت کوئی تصادفی بات نہیں ہے۔ توقع ہے کہ DeepSeek شانگھائی کے STAR مارکیٹ پر لسٹ ہوگا، اور مسلسل ٹیکنیکل ترقی کا مظاہرہ ایسا کام ہے جو رودشو پریزنٹیشنز کو زیادہ قانع کرنے میں مدد دیتا ہے۔
V4.1-Flash میں اندراز کی گئی بہ متعدد امکانات، جو بصورتی اور متنی ڈیٹا دونوں پر مشتمل ہیں، OpenAI اور Moonshot AI جیسے مقابلہ کرنے والوں کے لیے فرق کے مواقع کو کم کردیتی ہیں، جو Kimi K3 تیار کرتے ہیں۔
