ڈیپسیک نے 552B پیرامیٹرز اور 1M ٹوکن کنٹیکسٹ ونڈو کے ساتھ V4.1-Flash ماڈل لانچ کیا

iconCryptoBriefing
بانٹیں
AI summary iconخلاصہ
ڈیپسیک نے 10 ستمبر کو V4.1-Flash ماڈل کے ساتھ ایک نیا ٹوکن لسٹنگ جاری کی، جس میں 552B پیرامیٹرز اور 1M ٹوکن کا کنٹیکس ونڈو شامل ہے۔ یہ ماڈل MoE آرکیٹیکچر استعمال کرتا ہے، جس میں ان پٹ کے لیے 8B اور آؤٹ پٹ کے لیے 16B فعال ہوتے ہیں۔ اس نے ایک نا متوازن Causal Encoder-Decoder ڈیزائن شامل کیا ہے اور KV کیش کے استعمال کو 75% تک کم کر دیا ہے۔ یہ ماڈل DeepSeek V4-Pro کو پیچھے چھوڑ دیتا ہے اور 14 ستمبر سے اپڈیٹڈ قیمت کے ساتھ API کے ذریعے دستیاب ہے۔ وزن Hugging Face پر MIT لائسنس کے تحت اوپن سورس کر دیے گئے ہیں، جو ڈویلپرز اور ٹریڈرز کے لیے نئے ٹوکن لانچ کی خبریں فراہم کرتے ہیں۔

ڈیپسیک نے ایک ماڈل جاری کیا ہے جو ایک ملین ٹوکنز کے کنٹیکس کو پروسیس کرتا ہے اور دو سال پہلے جاری کیے گئے کچھ اوپن سورس ماڈلز سے کم پیرامیٹرز کو فعال کرتا ہے۔ 10 ستمبر کو لانچ کیا گیا V4.1-Flash، چینی AI اسٹارٹ اپ کی آخری کوشش ہے جس کا مقصد بڑے زبانی ماڈلز کی مالیات کو دوبارہ تعریف کرنا ہے۔

یہ ماڈل 552 ارب پیرامیٹرز کو ایک مکسچر آف ایکسپرٹس (MoE) آرکیٹیکچر میں پیک کرتا ہے، لیکن صرف تقریباً 8 ارب پیرامیٹرز کو ان پٹ کاموں کے لیے اور 16 ارب پیرامیٹرز کو آؤٹ پٹ کے لیے فائر کرتا ہے۔ نتیجہ ایک ایسا ماڈل ہے جو اس کے فعال کمپیوٹ فٹ پرنٹ سے کہیں زیادہ طاقت رکھتا ہے۔

جس ساخت کی وجہ سے یہ کام کرتا ہے

V4.1-Flash ایک ایسی غیر متوازن سببی اینکوڈر-ڈیکوڈر آرکیٹیکچر پیش کرتا ہے جسے DeepSeek نے ڈیزائن کیا ہے، جو ان پٹ کو معالجہ کرتا ہے اور ہر کام کے لیے الگ الگ بہترین طریقوں کے ذریعے آؤٹ پٹ جنریٹ کرتا ہے، ایک منفرد پائپ لائن سے گزر کر نہیں۔

اعلان

کنٹیکس ونڈو 1 ملین ٹوکن تک پھیل جاتی ہے۔ اس بہت بڑے کنٹیکس کی حمایت کے لیے ایک KV کیش استعمال ہوتی ہے جو ہر ٹوکن کے لیے تقریباً 890 بائٹس استعمال کرتی ہے، جو پچھلے V4-Flash ماڈل کی ضرورت کا تقریباً ایک چوتھائی حصہ ہے۔

یہ کیش کمی اس سے زیادہ اہم ہے جتنا کہ سننے میں آتی ہے۔ KV کیش وہ میموری باٹل نیک ہے جو یہ طے کرتا ہے کہ ایک ماڈل ایک ساتھ کتنے صارفین کو سروس دے سکتا ہے اور ان کی بات چیت کتنی لمبی چل سکتی ہے۔ اسے 75 فیصد کم کرنا کامیابی کا مطلب ہے کہ آپریٹرز ایک ہی ہارڈ ویئر پر تقریباً چار گنا زیادہ صارفین کو سروس دے سکتے ہیں، یا اپنے GPU کلسٹرز کو اپ گریڈ کئے بغیر چار گنا لمبے کانٹیکسٹس کو ہینڈل کر سکتے ہیں۔

بینچ مارکس پر، ڈیپسیک کا دعویٰ ہے کہ V4.1-Flash اپنے ہی V4-Pro ماڈل کو پار کر جاتا ہے اور GPT-5.6 اور Kimi K3 کے ساتھ براہ راست مقابلہ کرتا ہے۔ کمپنی پہلے ہی V4-Pro سے درخواستوں کو نئے ماڈل پر ری ڈائریکٹ کر رہی ہے، جس کے لیے اپڈیٹڈ قیمتیں 14 ستمبر سے لاگو ہو جائیں گی۔

کھلے وزن، کھلی حکمت عملی

ڈیپسیک نے ہگنگ فیس پر مدل کے وزن کو ایم آئی ٹی لائسنس کے تحت جاری کیا ہے۔ نیا مدل "deepseek-flash" اینڈ پوائنٹ کے ذریعے ڈیپسیک کی API کے ذریعے دستیاب ہے۔ کھلے وزن اور API تک رسائی کا ترکیبی اثر ایک دو راستہ اپنائی کا باعث بنتا ہے: وہ ڈویلپرز جو اپنی اپنی انفراسٹرکچر پر انفرنس کو چلانا چاہتے ہیں، وہ مقامی طور پر ڈاؤن لوڈ اور ڈپلوی کر سکتے ہیں، جبکہ جو لوگ مینجڈ سروسز کو ترجیح دیتے ہیں، وہ ڈیپسیک کے نئے قیمتی طبقات پر API کو کال کر سکتے ہیں۔

آئی پی او کے اثرات اور مقابلہ کی پوزیشن

V4.1-Flash کے لانچ کا وقت کوئی تصادفی بات نہیں ہے۔ توقع ہے کہ DeepSeek شانگھائی کے STAR مارکیٹ پر لسٹ ہوگا، اور مسلسل ٹیکنیکل ترقی کا مظاہرہ ایسا کام ہے جو رودشو پریزنٹیشنز کو زیادہ قانع کرنے میں مدد دیتا ہے۔

V4.1-Flash میں اندراز کی گئی بہ متعدد امکانات، جو بصورتی اور متنی ڈیٹا دونوں پر مشتمل ہیں، OpenAI اور Moonshot AI جیسے مقابلہ کرنے والوں کے لیے فرق کے مواقع کو کم کردیتی ہیں، جو Kimi K3 تیار کرتے ہیں۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔