Qwen 3.8 Flash کی لاگت DeepSeek-V4-Flash کی ایک تہائی تک کم ہو گئی

iconMetaEra
بانٹیں
AI summary iconخلاصہ
علی بابا کا Qwen 3.8 Flash، جو اب Qwen Office پلیٹ فارم پر دستیاب ہے، 125B MoE کے ساتھ ہر ٹوکن پر 6B فعال پیرامیٹرز فراہم کرتا ہے۔ یہ 262,144 ٹوکنز کو نیٹیو طور پر سپورٹ کرتا ہے اور 4090 GPU پر چلتا ہے۔ اس کی قیمت 0.8 RMB فی ملین ان پٹ ٹوکن ہے، جو DeepSeek-V4-Flash کی قیمت کا ایک تہائی ہے۔ آلٹ کوائنز کو ٹریک کرنے والے ٹریڈرز اسے ایک اہم ترقی سمجھ سکتے ہیں۔ یہ ماڈل پیچیدہ کاموں کو چار منٹ سے کم وقت میں مکمل کرتا ہے اور API تیار ہے۔ اسی دن، Zhipu نے GLM-5.3-Flash کو اوپن سورس کر دیا، جس کی قیمت Claude Opus 4.8 کی ایک بیسواں حصہ ہے۔ مارکیٹ جذبات، جن میں خوف اور لالچ کا انڈیکس شamil ہے، اس قسم کے لاگت محفوظ ماڈلز کے آنے سے بدل سکتے ہیں۔
علی نے Qwen 3.8 Flash ماڈل جاری کیا اور اسے اوپن سورس کر دیا ہے، جس میں 125B MoE آرکیٹیکچر استعمال کیا گیا ہے، جس میں ہر ٹوکن کے لیے صرف تقریباً 6B پیرامیٹرز فعال ہوتے ہیں، اور یہ ماڈل 262144 ٹوکن کے کنٹیکس کو نیچے سے ہی سپورٹ کرتا ہے، جسے YaRN کے ذریعے 1M ٹوکن تک وسعت دی جا سکتی ہے۔ اس ماڈل کی نوآوری اس بات میں ہے کہ اسے کنسومر لیول 4090 GPU پر چلایا جا سکتا ہے، جس سے ڈیٹا سنٹر لیول لمبے متن ماڈلز کو کنسومر لیول ہارڈویئر پر منتقل کرنے کا راستہ کھل گیا ہے۔ اس کی قیمت مزید مقابلہ کرنے والی ہے: ہر ملین ٹوکن ان پٹ کے لیے 0.8 یوان اور آؤٹ پٹ کے لیے 2.7 یوان، جو DeepSeek-V4-Flash کی قیمت کا تینوں حصوں میں سے ایک حصہ ہے۔ تجرباتی جانچ سے پتہ چلتا ہے کہ ماڈل 2 منٹ میں چار پلیٹ فارمز کے لیے متن تحریر کر سکتا ہے، اور 4 منٹ میں میٹنگ ریکارڈز نکالنا، ٹیبلز کو ترتیب دینا اور ای میلز بنانا۔ Qwen 3.8 Flash اب千問 آفس پلیٹ فارم پر دستیاب ہے، اور API انٹرفیس بھی فوراً دستیاب ہے۔ اسی دن Zhizhi نے GLM-5.3-Flash کو بھی اوپن سورس کر دیا، جس کا پرفارمنس Claire Opus 4.8 کے برابر پایا گیا، جبکہ اس کی قیمت اس کا اربعونواں حصہ ہے۔

مضمون کے مصنف، ماخذ: کوانٹم ٹریک

Alibaba Qwen کا نیا ماڈل، نئی سطح تک پہنچ گیا ہے۔

انہوں نے Qwen 3.8 Flash-Next کو جاری اور اوپن سورس کیا، جو نہ صرف DeepSeek-V4-Flash کی قیمت کو فوراً پیچھے چھوڑ دیتا ہے، بلکہ جاری ہوتے ہی Huggingface پر ٹاپ پوزیشن حاصل کر لیا!

تصویر

ٹویٹر پر صارفین بھی بہت متحرک ہو گئے، اور کچھ انجینئرز نے اپنے تجرباتی ویڈیوز شیئر کر کے کہا کہ بہت عالی!

Qwen 3.8 Flash نے VRAM کی رکاوٹ کو ختم کر دیا،ڈیٹا سینٹر لیول کا لمبا متن بڑا ماڈل، کنسیومر لیول 4090 گرافکس کارڈ پر بھی چل رہا ہے!

تصویر

کچھ لوگ پہلے ہی اسے اپنے کام میں استعمال کر چکے ہیں۔

اس نے صرف 8 منٹ میں پائیتھن پروگرامنگ، متعدد جدولوں کا تجزیہ اور رپورٹس کی تیاری کا پورا ورک فلو مکمل کر لیا:

تصویر

بُوتا افیکٹس بھی کوئی مسئلہ نہیں:

تصویر

واہ، کیا یہ اتنی دلچسپ ہے؟ ہمیں بھی اسے آزمانا چاہیے۔

تصویر

ہر ایک ملین ٹوکن ان پٹ صرف 0.8 یوان

Qwen3.8-Flash 125B MoE آرکیٹیکچر استعمال کرتا ہے، جس میں ہر Token کے لیے صرف تقریباً 6B پیرامیٹرز فعال ہوتے ہیں، اور یہ اصل میں 262144 Token کے کنٹیکس کو سپورٹ کرتا ہے، اور YaRN کے ذریعے 1M Token تک وسعت دی جا سکتی ہے۔

اس کے علاوہ، یہ Qwen4 کے نئے آرکیٹیکچر کا ایک پہلے سے ہی پیش گوئی ہے۔

Qwen 3.7 Plus کے مقابلے میں، Qwen 3.8 Flash نے صرف ایک تہائی پیرامیٹرز کو فعال کیا ہے، اور تربیت کا خرچ صرف اس کا ایک نوواں حصہ ہے، جبکہ جنرل، ریاضی کا استدلال، اور پروگرامنگ جیسی صلاحیتیں زیادہ طاقتور ہیں۔

زیادہ سخت بات قیمت ہے، Qwen 3.8 Flash کے لیے ہر ملین ٹوکن کے ان پٹ کے لیے صرف 0.8 یوان، آؤٹ پٹ کے لیے 2.7 یوان، کیش میچنگ کے لیے 0.1 یوان، جو DeepSeek-V4-Flash کی قیمت کا ایک تہائی سے کم ہے۔

یہ تو拼多多 کی کٹی ڈیو کے مقابلے میں بہت زیادہ ہے (بushi

تصویر

ٹھیک ہے، ٹھیک ہے، چونکہ قیمت اس حد تک پہنچ چکی ہے، تو ہم کوئی تھام نہیں رکھیں گے، براہ راست طاقت لگائیں جائے، اور دو عملی ٹیسٹ کے ذریعے Qwen 3.8 Flash کی آفس کے ماحول میں عملی صلاحیت کا جائزہ لیں۔

Real Test 1: Design four copy variations for a camera product, tailored to different platform styles

ہم نے "سائبر ناٹیشن چیلنج" کا انعقاد کیا، جس میں Qwen 3.8 Flash کو 1 یوان کے بجٹ کے اندر، ایک تقریباً دس ہزار الفاظ کی کیمرہ مصنوعات کی معلومات کو Xiaohongshu، Weibo، Douyin اور WeChat Moments کے لیے ریکارڈ کرنے کا کام دیا گیا تاکہ یہ دیکھا جا سکے کہ یہ کتنے کام مکمل کر سکتا ہے۔

ہدایات درج ذیل ہیں:

تصویر

میں نے پرومپٹ کا ارسال کرنے کے بعد صرف دو منٹ سے کم وقت میں کمپنی کے ٹی اسٹ ڈرائنگ روم میں پانی بھرا۔

واپس آ کر دیکھا، چار مختلف پلیٹ فارمز کے متن پورے لکھ دیے گئے ہیں، اور برانڈ، اسٹائل، اور ٹاپک ہیش ٹیگز کو بہت اچھی طرح سے ٹارگٹ کیا گیا ہے (صرف میں اتنی لمبی پوسٹ نہیں کرتا، hhh):

تصویر

تصویر

تصویر

تصویر

چار متنوں کو دو منٹ سے کم میں مکمل کر لیا، "سائبر ورکر" کی ہنرمندی ٹھیک ہے۔

لیکن دفتری ماحول میں جو حقیقی طور پر پریشان کن ہوتا ہے، وہ مصنوعات لکھنا نہیں بلکہ میٹنگ کے بعد کون سب کچھ سنبھالے گا۔

اس لیے، ہم نے اسے دوسرا کام دیا، جس میں اس کی عملی دفتری صلاحیت کا امتحان لیا گیا۔

دوسرا عملی ٹیسٹ: ایک مصنوعات کی ہفتہ وار میٹنگ کو قابل عمل منصوبہ میں تبدیل کریں

ہم نے "智能客服Agent V2.0 需求与技术评审会" کے عنوان کے تحت، ایک وسیع اصل میٹنگ ریکارڈ تیار کیا جس میں لوگوں کو زیادہ تر ہفتہ وار میٹنگ کے بعد ملنے والے، ہم آواز کے غلط الفاظ اور بے نقاب بات چیت سے بھرا ہوا مواد شامل ہے، اور Qwen3.8-Flash نے ایک بار میں خلاصہ نکالنا، جدول بنانا اور میٹنگ کے بعد کی ای میل بھیجنا تینوں کام انجام دیے۔

تصویر△ تصویر AI کے ذریعہ تخلیق کی گئی، "token" کو "偷啃" سمجھنا بہت زندگی بھری بات ہے

ہدایات درج ذیل ہیں:

تصویر

ڈیفالٹ موڈ میں، 4 منٹ سے کم وقت میں، Qwen3.8-Flash نے تمام کاموں کو مکمل کر لیا، اور پانچ مرکزی نتائج کی خلاصہ، ٹیبل کے کاموں کا تقسیم، ای میل کا فارمیٹ سب درست تھا، اور رسیورز بھی میٹنگ کے مواد کے مطابق تھے۔

تصویر

تصویر

تصویر

تصویر△ کچھ ٹیسٹ نتائج کے گراف

اس نے اس کی درخواست کیے ب بغیر ہی اجلاس میں ابھی تک حل نہ ہونے والے معاملات کو خود سے ہمیں واضح کر دیا، جس سے ہم اگلے اجلاس میں ان پر بحث جاری رکھ سکیں، جیسے:

تصویر

اور اب تک میرا لِمٹ ختم نہیں ہوا!

آہاہا، ایک آزادانہ محسوس کرنا بہت اچھا لگتا ہے۔

اب، Qwen 3.8 Flash کو "چین ون آفس" پلیٹ فارم پر شروع کیا گیا ہے، اور API ایپی کو بھی فوری طور پر دستیاب کر دیا گیا ہے، آپ اسے آزمائیں!

تصویر

ایک اور بات

ممالکی بڑے ماڈلز کی قیمت کی جنگ زیادہ تیز ہو گئی ہے۔

قریب قریب Qwen 3.8 Flash کے اوپن سورس ہونے کے ایک ہی وقت پر، Zhipu نے GLM-5 سیریز کا پہلا نیٹیو ملٹی مودل مدل GLM-5.3-Flash اوپن سورس کر دیا، جو پہلے انٹرنیٹ پر وائرل ہونے والا "نیو لائی" لارج مڈل Ox Alpha ہے۔

جائزے میں، اس ماڈل کی کارکردگی Claude Opus 4.8 کے برابر ہے، لیکن قیمت GLM-5.3 کی 1/10 پر کم کر دی گئی ہے۔

تصویر

اور GLM-5.3-Flash نے دو ہفتے کے لیے آدھی قیمت کا آفر بھی فراہم کیا ہے، جس کا مطلب ہے کہ عرضہ کے دوران GLM-5.3-Flash کی قیمت GLM-5.3 کی 1/20 اور Opus4.8 کی 1/40 ہوگی۔

تصویر

اس کے علاوہ، Qwen 3.8 Flash اور GLM-5.3-Flash کا ایک مشترکہ نقطہ یہ ہے کہ دونوں نے اس بار DeepSeek-V4-Flash کو بہت کم قیمت پر حیران کر دیا (DeepSeek شکایت کرتے ہوئے چلے گئے):

تصویر△DeepSeek-V4-Flash، Qwen 3.8 Flash، GLM-5.3-Flash کی قیمتوں کا موازنہ گراف

بے نقاب، بہت زیادہ مقابلہ۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔