أطلقت علي بابا وفتحت مصدر نموذج Qwen 3.8 Flash، الذي يستخدم بنية MoE بحجم 125B، ويُفعّل حوالي 6B معلمة فقط لكل رمز، ويدعم أصلًا سياقًا بطول 262144 رمزًا، ويمكن توسيعه إلى 1M رمز عبر YaRN. يتميز هذا النموذج بقدرته على التشغيل على بطاقة رسوميات 4090 استهلاكية، مما يحقق نقل نماذج النصوص الطويلة من مستوى مراكز البيانات إلى الأجهزة الاستهلاكية. كما يتميز بسعر تنافسي: 0.8 يوان لكل مليون رمز إدخال و2.7 يوان لكل مليون رمز إخراج، أي ثلث سعر DeepSeek-V4-Flash. أظهرت الاختبارات العملية أن النموذج يمكنه إكمال كتابة نصوص لأربع منصات في دقيقتين، واستخلاص سجلات الاجتماعات وتنظيم الجداول وإنشاء البريد الإلكتروني في أربع دقائق. تم إطلاق Qwen 3.8 Flash على منصة Qwen Office، مع فتح واجهات برمجة التطبيقات في نفس الوقت. وفي نفس اليوم، فتحت Zhipu مصدر نموذج GLM-5.3-Flash، الذي أظهر أداءً مماثلاً لـ Claude Opus 4.8 بسعر يعادل واحدًا من أربعين من سعره.مؤلف المقال، المصدر: Quantum Bit
النموذج الجديد من علي بابا كوان ون، رفع المستوى إلى مستوى جديد.
أطلقوا وفتحوا مصدر Qwen 3.8 Flash-Next، الذي ليس فقط يُسحق سعر DeepSeek-V4-Flash مباشرة، بل حصل على المركز الأول على Huggingface فور إصداره!

كما اشتعلت منصات تويتر، بل وأظهر مهندسون مقاطع فيديو تجريبية حقيقية مُعجبين:
Qwen 3.8 Flash قدّمت تجربة لا مثيل لها في تقليل حدود VRAM،نموذج لغوي ضخم مخصص للنصوص الطويلة على مستوى مراكز البيانات، ويمكن تشغيله الآن على بطاقة رسوميات 4090 للمستهلكين!
لا يزال هناك أشخاص استخدموه بحماس في عملهم.
في أقل من 8 دقائق، أكمل سلسلة كاملة من سير العمل تشمل برمجة بايثون وتحليل جداول متعددة وإنشاء تقارير بحثية:

ولا تشكل تأثيرات الباجا أي مشكلة:

واو، هل هو حقًا بهذه الإثارة؟ بالطبع علينا أن نجربه أيضًا.

فقط 0.8 يوان لكل مليون وحدة مدخلة
يستخدم Qwen3.8-Flash بنية MoE بحجم 125B، مع تفعيل حوالي 6B معلمة فقط لكل رمز، ويدعم أصليًا سياقًا بطول 262144 رمز، ويمكن توسيعه عبر YaRN إلى 1M رمز.
في الوقت نفسه، إنه تجربة مبكرة للبنية الجديدة لـ Qwen4.
بالمقارنة مع Qwen 3.7 Plus، لا يقتصر Qwen 3.8 Flash على خفض عدد المعلمات المُفعّلة إلى الثلث، بل يقلل أيضًا تكلفة التدريب إلى واحد من التسعة، مع تحسين قدراته العامة، والاستدلال الرياضي، والبرمجة بشكل أكبر.
الأكثر إثارةً هو السعر: فقط 0.8 يوان لكل مليون رمز مدخل لـ Qwen 3.8 Flash، و2.7 يوان لكل مليون رمز مخرج، و0.1 يوان للاستجابة من الخزانة، بأقل سعر يصل إلى ثلث سعر DeepSeek-V4-Flash.
أكبر بكثير من خفض السعر على Pinduoduo (بليس)

حسنًا، بما أن السعر وصل إلى هذا الحد، فلن نتردد، وسنقوم مباشرة بتطبيق قوة حقيقية باستخدام تجربتين عمليتين لاختبار قدرة Qwen 3.8 Flash الفعلية في سيناريوهات المكتب.
اختبار عملي 1: تصميم أربعة نصوص مخصصة لمنتجات الكاميرا تناسب منصات بأساليب مختلفة
قمنا بتصميم "تحدي كتابة النصوص الرياضية" حيث قام Qwen 3.8 Flash بتعديل ملف منتج كاميرا يقارب عشرة آلاف كلمة ضمن ميزانية قدرها يوان واحد واحد، لرؤية كم مهمة يمكنه إكمالها على منصات Xiaohongshu وWeibo وDouyin وCircle of Friends.
النص التوجيهي كالتالي:

بعد إرسال تعليمات التشغيل، ذهبت إلى مطبخ الشركة لأملأ كوبًا من الماء، واستغرق الأمر أقل من دقيقتين.
عند العودة، وجدت أن نصوصًا أربعًا من منصات مختلفة قد اكتملت بالفعل، وقد تم تضمين العلامة التجارية والأسلوب ووسوم الموضوع بدقة (ما عدا أنني لن أنشر مثل هذه المشاركات الطويلة على فيسبوك hhh):




أنهيت أربع نصوص في أقل من دقيقتين، إن سرعة "عامل السيبراني" تعتبر كافية.
لكن ما يسبب الإرهاق الحقيقي في بيئة العمل غالبًا ليس كتابة النصوص، بل من سيقوم بترتيب الفوضى بعد انتهاء الاجتماع.
لذلك، قمنا بتعيين وظيفة ثانية له لاختبار قدراته العملية في بيئة العمل.
التجربة العملية الثانية: تحويل اجتماع أسبوعي للمنتج إلى خطة قابلة للتنفيذ
نحن نعيد إنتاج نص اجتماعي أولي بطول عشرة آلاف كلمة، يحتوي على أخطاء إملائية متشابهة صوتيًا ومحادثات عابرة، بعنوان "اجتماع مراجعة المتطلبات والتقنية لوكيل خدمة العملاء الذكي V2.0"، ونجح Qwen3.8-Flash في إنجاز ثلاث مهام دفعة واحدة: استخلاص الملخص، وتنظيم الجداول، وإرسال بريد إلكتروني للإشعار بعد الاجتماع.
△ الصورة مولدة بواسطة الذكاء الاصطناعي، أن تسمع "token" كـ"偷啃" هو حقًا شيء مرتبط بالحياة جدًا
النص التوجيهي كالتالي:

في الوضع الافتراضي، أكمل Qwen3.8-Flash جميع المهام في أقل من 4 دقائق، مع دقة تامة في تلخيص الاستنتاجات الخمسة الأساسية، وتوزيع المحتوى في الجدول، وصيغة البريد الإلكتروني القياسية، وتوافق المرسل إليهم مع محتوى الاجتماع.



△ بعض صور نتائج الاختبار
حتى دون طلب ذلك، فإنها تُنظّم لنا تلقائيًا البنود التي لم يتم التوصل إلى نتائج بشأنها في الاجتماع، لتسهيل مواصلة المناقشة في الاجتماع القادم، be like:

وحتى هذه النقطة، لم أستهلك حدودي بعد!
Hahaha, الشعور بالحرية الكاملة هذا رائع حقًا.
الآن، تم إطلاق Qwen 3.8 Flash لأول مرة على منصة "Qiwen Office"، وقد تم فتح واجهات برمجة التطبيقات أيضًا، يمكنكم تجربتها الآن!

شيء واحد إضافي
حرب الأسعار بين النماذج الكبيرة المحلية أصبحت أكثر شدة.
في نفس الوقت تقريبًا الذي تم فيه إصدار Qwen 3.8 Flash مفتوح المصدر، أطلقت Zhipu أيضًا أول نموذج متعدد الوسائط أصلي من سلسلة GLM-5، وهو GLM-5.3-Flash، المعروف سابقًا بالنموذج الكبير "Niu Lai" Ox Alpha.
في التقييم، أداء النموذج يعادل Claude Opus 4.8، مع سعر مخفض إلى واحد من عشرة من سعر GLM-5.3.

كما أن GLM-5.3-Flash تقدم بسخاء عرضًا بخصم 50% لمدة أسبوعين، مما يعني أن سعر GLM-5.3-Flash خلال فترة العرض سيكون فقط 1/20 من سعر GLM-5.3 و1/40 من سعر Opus4.8.

بالإضافة إلى ذلك، فإن Qwen 3.8 Flash و GLM-5.3-Flash لديهما نقطة مشتركة أخرى، وهي أن كليهما هاجما DeepSeek-V4-Flash بسعر منخفض جدًا وأخذاه على حين غرة (غادر DeepSeek وهو يشكو):
△ مخطط مقارنة أسعار DeepSeek-V4-Flash و Qwen 3.8 Flash و GLM-5.3-Flash
لا شيء يمكن قوله، إنه مرهق جدًا.
