رسالة ChainThink، 5 أغسطس، وفقًا للإعلان الرسمي، تم فتح أوزان Ling-3.0-flash من InclusionAI، مع توفير الإصدار الأصلي BF16 والإصدار المكمّل FP8.
كلا الإصدارين يستخدمان ترخيص MIT، وقد تم نشرهما على Hugging Face وModelScope، ويدعمان النشر الذاتي عبر SGLang أو vLLM.
في هذا السياق، يبلغ حجم نسخة BF16 حوالي 255 جيجابايت، بينما تبلغ نسخة FP8 حوالي 128 جيجابايت، أي أن الحجم يقارب الانخفاض إلى النصف. تُخزّن نسخة FP8 المعلمات بدقة أقل، مما يقلل من متطلبات التخزين وذاكرة العرض؛
في الاختبارات الأربعة المدرجة رسمياً، كان أقصى فرق بين FP8 وBF16 هو 1.57 نقطة.
يبلغ إجمالي معلمات Ling-3.0-flash 124 مليار، مع تفعيل 51 مليار معلمة لكل توليد، ويدعم سياقًا قدره 256 ألف رمز، وهو موجه بشكل أساسي لمهام الوكلاء مثل البرمجة والبحث والدراسة المتعمقة واستدعاء الأدوات.
وفقًا للتقييم الرسمي، يصل هذا النموذج إلى مستوى أو يتجاوز نموذج التريليون معلمة السابق Ring-2.6-1T في معظم المعايير.
