رسالة ChainThink، 5 أغسطس، استخدمت شركة الأمن Aikido عامل تدقيق الكود لاختبار 7 نماذج، تغطي Qwen3.8-Max وClaude Opus 5 وKimi K3 Max وDeepSeek V4 Flash وGPT-5.6 Sol وLuna وTerra.
يتضمن الاختبار 32 ثغرة أمنية معلنة حديثًا، وتم تشغيل كل نموذج ثلاث مرات. وجد Qwen3.8-Max ما مجموعه 26 ثغرة عبر الجولات الثلاث، بنسبة استرجاع 81.3٪، ليحتل المرتبة الأولى بالتساوي مع Claude Opus 5.
درجة F1 الشاملة لـ Qwen3.8-Max هي 83.2٪، وهي أقل قليلاً من Opus 5 وKimi K3 Max وGPT-5.6 Sol.
إن استقرار أدائها في كل جولة ضعيف، حيث تم العثور على 10 ثغرات فقط على مدار ثلاث جولات متتالية من أصل 26 ثغرة، بينما كان عدد الثغرات المكتشفة في Opus 5 و Sol هو 19.
من حيث التكلفة، تبلغ التكلفة الإجمالية لـ Qwen3.8-Max حوالي 821 دولارًا، وهي تقريبًا نصف تكلفة Opus 5 وSol، لكنها خمسة أضعاف تكلفة DeepSeek V4 Flash.
