الی بابا 125B Qwen 3.8-Flash-Next کو MoE کے ذریعے ہر ٹوکن کے لیے 6B پیرامیٹرز کے ساتھ ٹیز کر رہا ہے

iconChainGPT
بانٹیں
AI summary iconخلاصہ
علی بابا نے Qwen 3.8-Flash-Next کے ٹوکن لانچ کی خبر کا اعلان کیا ہے، جو اس ویڈنیز کو جاری کیا جائے گا۔ اس ماڈل میں 125B پیرامیٹرز ہیں لیکن MoE کا استعمال کرتے ہوئے ہر ٹوکن پر صرف 6B فعال ہوتے ہیں۔ Hugging Face اور علی بابا اسے Qwen 4 کا پریویو کہتے ہیں۔ اب تک کوئی بینچ مارک دستیاب نہیں ہیں۔ اوپن-ویٹ ڈیزائن نئے ٹوکن لسٹنگز اور آن-چین ٹولز کو سپورٹ کر سکتا ہے۔ پرفارمنس اور لاگت کی کارآمدی اب تک تصدیق شدہ نہیں ہیں۔

ہیڈ لائن: علی بابا نے Qwen 3.8-Flash-Next کا ایک 125 ارب پیرامیٹر کا پیش خدمت پیش کیا ہے — جو ہر ٹوکن پر صرف 6 ارب پیرامیٹر فعال کرتا ہے، جس سے Qwen 4 کی طرف اشارہ ہوتا ہے علی بابا اس ونڈزڈے کو Qwen 3.8-Flash-Next کا اعلان کرے گا — جسے کمپنی نے ایک مکمل فلگشپ ماڈل کے بجائے اگلی نسل کے Qwen 4 آرکیٹیکچر کا ابتدائی پیش خدمت قرار دیا ہے۔ علی بابا کی ٹیم اور ایک گردش کرتے ہوئے ٹویٹ کے مطابق، یہ ماڈل 125 ارب پیرامیٹرز پر مشتمل ہے لیکن رپورٹس کے مطابق ہر ٹوکن پر صرف تقریباً 6 ارب پیرامیٹرز فعال ہوتے ہیں (ٹویٹ میں " +51B N-gram " کمپوننٹ کا بھی ذکر کیا گیا تھا)۔ ان اعداد و شمار اور ماڈل کی عملی کارکردگی ابھی تصدیق شدہ نہیں ہیں؛ علی بابا اور Hugging Face دونوں نے اس رلیز کو آرکیٹیکچر کا ابتدائی جائزہ قرار دیا ہے اور انہوں نے سائڈ بائی سائڈ بینچ مارکس کے اعداد و شمار شائع نہیں کئے۔ کیوں ان اعداد و شمار کا اہمیت ہے - پیرامیٹرز وہ نکات ہوتے ہیں جن کو ماڈل سیکھنے اور تطبیق دینے کے لیے استعمال کرتا ہے۔ زیادہ پیرامیٹرز عام طور پر زیادہ صلاحیت کا مظہر ہوتے ہیں لیکن ساتھ ہی زیادہ کمپوٹنگ لاگت بھی۔ - یہاں کا جادو مکسچر آف اسپرٹس (MoE) آرکیٹیکچر میں ہے: بجائے اس بڑے نیٹ ورک کے ہر حصے کو ہر ان پٹ پر چلانے کے، ماڈل ہر درخواست کو تھوڑے سے مخصوص "ماہر" سب ماڈلز کے مجموعے کو رُٹ کرتا ہے۔ اس سے 125 ارب پیرامیٹر والا ماڈل کمپوٹنگ لاگت کے لحاظ سے بہت چھوٹے ماڈل جیسا رفتار دکھا سکتا ہے، صرف ہر ٹوکن کے لیے متعلقہ ماہرین فعال کرتے ہوئے۔ مختصر طور پر: اگر دعوؤں کا MoE رویہ صحیح ثابت ہوا تو، تقریباً فرنٹیر صلاحیت ممکنہ طور پر عام کمپوٹنگ لاگت پر حاصل ہو سکتی ہے۔ علی بابا کا دعوٰی اور جو غیر واضح ہے - علی بابا Qwen 3.8-Flash-Next کو متھمودل (multimodal) قرار دे� رہا ہے اور اسے آنے والے Qwen 4 ڈि�زائن پر بنایا جانے والا بتا رہا ہے، جسے جلد شائع کرنے سے ڈولپرز مکمل فملی کے لیے تیار ہو سکتے ہیں۔ - Hugging Face، جہاں وزن ظاہر ہونے کا تصور ہے، بھی اسے Qwen 4 آرکیٹیکچر کا ابتدائی جائزہ قرار دे� رہا ہے۔ - تاحال مستقل بینچ مارکس، Qwen 3 لائن یا مغربی مقابلین کے ساتھ سیدھا مقابلہ نہیں جاری کئے گئے، لہذا کارکردگی اور وسائل کا توازن ابھی تک تصورات پر مبنی ہے۔ حوالہ: چین کا اوپن وِٹ مومینٹم چین کا اوپن وِٹ منظر بڑھتا جارہا ہے۔ حالیہ غیر نامعلوم اور ادارتی رلز (ایک رازدار Ox Alpha ماڈل جس نے Anthropic کے Fable پر بعض کوڈنگ ٹيسٹس میں بڑھتار حاصل کيا، اور علی بابا، DeepSeek اور Moonshot سے اوپن وزن) نے طاقتور ماڈلز کو قابلِ ڈاؤن لوڈ، فائن ٹون اور مقامی طور پر رنnable بناديا۔ اوپن وزن بند API پر انحصار کو کم کرتے ہیں، هوسٹنگ لاگت کم کرتے ہيں، اور ڈولپرز کو حساس مواد تھرڈ پارٹي سروسز ميں بھيجنے سے روکتे هيں — جو عام AI اور crypto منصوبوں دونوں کे لئے اهم عوامل هين۔ crypto سن سنیداران كى ليه دلچسپي رखني چاهيئي - آن-چین آلوز اور بوٹس: سستي، مقامي طور پر رنnable بڑي ماڈلز آن-چين ايجلز، آڈيٹنگ آلوز، ٹريڊنگ اور MEV حيلوں کو مستقل API فees بغیر قوت دे سكتي هين۔ - خفية ركھنا اور حفاظت: ماڈلز کو خود هوسٹ كرنا خفية كليز، لينج كي نمائش يا مخصوص تجارتى سگنلز كى خفية ركھنا كى خطرات كم كرتا هـي۔ - غیر مرکزية AI انفرااسٹرکچر: اوپن وزن غیر مرکزية انفرنس ليرز اور قابلِ اعتبار مختصر آراکلز کي ترقى ميں تيسري طرف كى منحصرية سے بچنे ميں مدد كرسكتي هين۔ - تحفظ: جب تک بینچ مارکس اور عملی لاگت کے اعداد و شمار ظاہر نہيں ہوتے، فرض کرنا زودرساندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندوزاندو آخرِ خبر Qwen 3.8-Flash-Next Qwen 4 کے ڈِزائن فلسفه کا ابتدائی جائزہ بنایا جارها ہے — جس ميں مکسچر آف اسپرٹس (MoE) كى كارآمدى اور متھمودل صلاحية كى وعده دى جارهي هـي۔ يه رليز قابلِ ذكر هـي كيوكى، اگر دعويه صحيح ثابت هوي تو، ~6B فعال پيراميترز والي 125B پيراميتر MoE ماڈل كى اوپن وزن، ترقى كارون اور crypto منصوبون كى ليه طاقتور AI كى استعمال كى دسترسى عام كرسكتي هـي۔ لे�كين، هميں تصدقي بينچ ماركس اور عملى اختبارات كى ضرورت هـي تاكه يه دعويه ثابت هوسكـي۔ علني رليز، Hugging Face وزن، اور مستقل جائزون كى طرف نظر ركهيئـي۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔