علی نے Qwen 3.8 Flash ماڈل جاری کیا اور اسے اوپن سورس کر دیا ہے، جس میں 125B MoE آرکیٹیکچر استعمال کیا گیا ہے، جس میں ہر ٹوکن کے لیے صرف تقریباً 6B پیرامیٹرز فعال ہوتے ہیں، اور یہ ماڈل 262144 ٹوکن کے کنٹیکس کو نیچے سے ہی سپورٹ کرتا ہے، جسے YaRN کے ذریعے 1M ٹوکن تک وسعت دی جا سکتی ہے۔ اس ماڈل کی نوآوری اس بات میں ہے کہ اسے کنسومر لیول 4090 GPU پر چلایا جا سکتا ہے، جس سے ڈیٹا سنٹر لیول لمبے متن ماڈلز کو کنسومر لیول ہارڈویئر پر منتقل کرنے کا راستہ کھل گیا ہے۔ اس کی قیمت مزید مقابلہ کرنے والی ہے: ہر ملین ٹوکن ان پٹ کے لیے 0.8 یوان اور آؤٹ پٹ کے لیے 2.7 یوان، جو DeepSeek-V4-Flash کی قیمت کا تینوں حصوں میں سے ایک حصہ ہے۔ تجرباتی جانچ سے پتہ چلتا ہے کہ ماڈل 2 منٹ میں چار پلیٹ فارمز کے لیے متن تحریر کر سکتا ہے، اور 4 منٹ میں میٹنگ ریکارڈز نکالنا، ٹیبلز کو ترتیب دینا اور ای میلز بنانا۔ Qwen 3.8 Flash اب千問 آفس پلیٹ فارم پر دستیاب ہے، اور API انٹرفیس بھی فوراً دستیاب ہے۔ اسی دن Zhizhi نے GLM-5.3-Flash کو بھی اوپن سورس کر دیا، جس کا پرفارمنس Claire Opus 4.8 کے برابر پایا گیا، جبکہ اس کی قیمت اس کا اربعونواں حصہ ہے۔مضمون کے مصنف، ماخذ: کوانٹم ٹریک
Alibaba Qwen کا نیا ماڈل، نئی سطح تک پہنچ گیا ہے۔
انہوں نے Qwen 3.8 Flash-Next کو جاری اور اوپن سورس کیا، جو نہ صرف DeepSeek-V4-Flash کی قیمت کو فوراً پیچھے چھوڑ دیتا ہے، بلکہ جاری ہوتے ہی Huggingface پر ٹاپ پوزیشن حاصل کر لیا!

ٹویٹر پر صارفین بھی بہت متحرک ہو گئے، اور کچھ انجینئرز نے اپنے تجرباتی ویڈیوز شیئر کر کے کہا کہ بہت عالی!
Qwen 3.8 Flash نے VRAM کی رکاوٹ کو ختم کر دیا،ڈیٹا سینٹر لیول کا لمبا متن بڑا ماڈل، کنسیومر لیول 4090 گرافکس کارڈ پر بھی چل رہا ہے!
کچھ لوگ پہلے ہی اسے اپنے کام میں استعمال کر چکے ہیں۔
اس نے صرف 8 منٹ میں پائیتھن پروگرامنگ، متعدد جدولوں کا تجزیہ اور رپورٹس کی تیاری کا پورا ورک فلو مکمل کر لیا:

بُوتا افیکٹس بھی کوئی مسئلہ نہیں:

واہ، کیا یہ اتنی دلچسپ ہے؟ ہمیں بھی اسے آزمانا چاہیے۔

ہر ایک ملین ٹوکن ان پٹ صرف 0.8 یوان
Qwen3.8-Flash 125B MoE آرکیٹیکچر استعمال کرتا ہے، جس میں ہر Token کے لیے صرف تقریباً 6B پیرامیٹرز فعال ہوتے ہیں، اور یہ اصل میں 262144 Token کے کنٹیکس کو سپورٹ کرتا ہے، اور YaRN کے ذریعے 1M Token تک وسعت دی جا سکتی ہے۔
اس کے علاوہ، یہ Qwen4 کے نئے آرکیٹیکچر کا ایک پہلے سے ہی پیش گوئی ہے۔
Qwen 3.7 Plus کے مقابلے میں، Qwen 3.8 Flash نے صرف ایک تہائی پیرامیٹرز کو فعال کیا ہے، اور تربیت کا خرچ صرف اس کا ایک نوواں حصہ ہے، جبکہ جنرل، ریاضی کا استدلال، اور پروگرامنگ جیسی صلاحیتیں زیادہ طاقتور ہیں۔
زیادہ سخت بات قیمت ہے، Qwen 3.8 Flash کے لیے ہر ملین ٹوکن کے ان پٹ کے لیے صرف 0.8 یوان، آؤٹ پٹ کے لیے 2.7 یوان، کیش میچنگ کے لیے 0.1 یوان، جو DeepSeek-V4-Flash کی قیمت کا ایک تہائی سے کم ہے۔
یہ تو拼多多 کی کٹی ڈیو کے مقابلے میں بہت زیادہ ہے (بushi

ٹھیک ہے، ٹھیک ہے، چونکہ قیمت اس حد تک پہنچ چکی ہے، تو ہم کوئی تھام نہیں رکھیں گے، براہ راست طاقت لگائیں جائے، اور دو عملی ٹیسٹ کے ذریعے Qwen 3.8 Flash کی آفس کے ماحول میں عملی صلاحیت کا جائزہ لیں۔
Real Test 1: Design four copy variations for a camera product, tailored to different platform styles
ہم نے "سائبر ناٹیشن چیلنج" کا انعقاد کیا، جس میں Qwen 3.8 Flash کو 1 یوان کے بجٹ کے اندر، ایک تقریباً دس ہزار الفاظ کی کیمرہ مصنوعات کی معلومات کو Xiaohongshu، Weibo، Douyin اور WeChat Moments کے لیے ریکارڈ کرنے کا کام دیا گیا تاکہ یہ دیکھا جا سکے کہ یہ کتنے کام مکمل کر سکتا ہے۔
ہدایات درج ذیل ہیں:

میں نے پرومپٹ کا ارسال کرنے کے بعد صرف دو منٹ سے کم وقت میں کمپنی کے ٹی اسٹ ڈرائنگ روم میں پانی بھرا۔
واپس آ کر دیکھا، چار مختلف پلیٹ فارمز کے متن پورے لکھ دیے گئے ہیں، اور برانڈ، اسٹائل، اور ٹاپک ہیش ٹیگز کو بہت اچھی طرح سے ٹارگٹ کیا گیا ہے (صرف میں اتنی لمبی پوسٹ نہیں کرتا، hhh):




چار متنوں کو دو منٹ سے کم میں مکمل کر لیا، "سائبر ورکر" کی ہنرمندی ٹھیک ہے۔
لیکن دفتری ماحول میں جو حقیقی طور پر پریشان کن ہوتا ہے، وہ مصنوعات لکھنا نہیں بلکہ میٹنگ کے بعد کون سب کچھ سنبھالے گا۔
اس لیے، ہم نے اسے دوسرا کام دیا، جس میں اس کی عملی دفتری صلاحیت کا امتحان لیا گیا۔
دوسرا عملی ٹیسٹ: ایک مصنوعات کی ہفتہ وار میٹنگ کو قابل عمل منصوبہ میں تبدیل کریں
ہم نے "智能客服Agent V2.0 需求与技术评审会" کے عنوان کے تحت، ایک وسیع اصل میٹنگ ریکارڈ تیار کیا جس میں لوگوں کو زیادہ تر ہفتہ وار میٹنگ کے بعد ملنے والے، ہم آواز کے غلط الفاظ اور بے نقاب بات چیت سے بھرا ہوا مواد شامل ہے، اور Qwen3.8-Flash نے ایک بار میں خلاصہ نکالنا، جدول بنانا اور میٹنگ کے بعد کی ای میل بھیجنا تینوں کام انجام دیے۔
△ تصویر AI کے ذریعہ تخلیق کی گئی، "token" کو "偷啃" سمجھنا بہت زندگی بھری بات ہے
ہدایات درج ذیل ہیں:

ڈیفالٹ موڈ میں، 4 منٹ سے کم وقت میں، Qwen3.8-Flash نے تمام کاموں کو مکمل کر لیا، اور پانچ مرکزی نتائج کی خلاصہ، ٹیبل کے کاموں کا تقسیم، ای میل کا فارمیٹ سب درست تھا، اور رسیورز بھی میٹنگ کے مواد کے مطابق تھے۔



△ کچھ ٹیسٹ نتائج کے گراف
اس نے اس کی درخواست کیے ب بغیر ہی اجلاس میں ابھی تک حل نہ ہونے والے معاملات کو خود سے ہمیں واضح کر دیا، جس سے ہم اگلے اجلاس میں ان پر بحث جاری رکھ سکیں، جیسے:

اور اب تک میرا لِمٹ ختم نہیں ہوا!
آہاہا، ایک آزادانہ محسوس کرنا بہت اچھا لگتا ہے۔
اب، Qwen 3.8 Flash کو "چین ون آفس" پلیٹ فارم پر شروع کیا گیا ہے، اور API ایپی کو بھی فوری طور پر دستیاب کر دیا گیا ہے، آپ اسے آزمائیں!

ایک اور بات
ممالکی بڑے ماڈلز کی قیمت کی جنگ زیادہ تیز ہو گئی ہے۔
قریب قریب Qwen 3.8 Flash کے اوپن سورس ہونے کے ایک ہی وقت پر، Zhipu نے GLM-5 سیریز کا پہلا نیٹیو ملٹی مودل مدل GLM-5.3-Flash اوپن سورس کر دیا، جو پہلے انٹرنیٹ پر وائرل ہونے والا "نیو لائی" لارج مڈل Ox Alpha ہے۔
جائزے میں، اس ماڈل کی کارکردگی Claude Opus 4.8 کے برابر ہے، لیکن قیمت GLM-5.3 کی 1/10 پر کم کر دی گئی ہے۔

اور GLM-5.3-Flash نے دو ہفتے کے لیے آدھی قیمت کا آفر بھی فراہم کیا ہے، جس کا مطلب ہے کہ عرضہ کے دوران GLM-5.3-Flash کی قیمت GLM-5.3 کی 1/20 اور Opus4.8 کی 1/40 ہوگی۔

اس کے علاوہ، Qwen 3.8 Flash اور GLM-5.3-Flash کا ایک مشترکہ نقطہ یہ ہے کہ دونوں نے اس بار DeepSeek-V4-Flash کو بہت کم قیمت پر حیران کر دیا (DeepSeek شکایت کرتے ہوئے چلے گئے):
△DeepSeek-V4-Flash، Qwen 3.8 Flash، GLM-5.3-Flash کی قیمتوں کا موازنہ گراف
بے نقاب، بہت زیادہ مقابلہ۔
