اختبار السيبراني الأمريكي يُظهر أن Kimi K3 متخلف عن أبرز النماذج الذكية الأمريكية

iconBeInCrypto
مشاركة
AI summary iconملخص
كشف تقييم من حكومة الولايات المتحدة أن كيمي K3، المطور من قبل مونشوت أي آي، يتأخر عن نماذج الذكاء الاصطناعي الأمريكية الرائدة في القدرات السيبرانية. وأظهرت الاختبارات التي أجرتها مركز معايير وابتكار الذكاء الاصطناعي (CAISI) بالشراكة مع شريك بريطاني أن كيمي K3 حصل على 32% في اختبار ExploitBench، مقابل 76% للنماذج الأمريكية الرائدة. وفشل في التحكم الكامل في آلة مستهدفة في جميع الاختبارات الـ41، بينما نجحت أفضل النماذج الأمريكية في 20 منها. وجاءت هذه النتائج بعد أن اتهم مسؤولون أمريكيون مونشوت باستخدام تقنيات أمريكية مسروقة في تطوير كيمي K3. ويمكن أن تؤثر النتائج على جهود CFT وتوافق تركيز MiCA على الشفافية التكنولوجية.

وضعت الحكومة الأمريكية أحدث نموذج ذكاء اصطناعي صيني في اختبار قرصنة. ووجدت أن نموذج Moonshot AI Kimi K3 يقع بعيدًا عن أفضل النماذج الأمريكية.

أجرى مركز معايير وابتكار الذكاء الاصطناعي (CAISI)، وهي وكالة أمريكية، الاختبارات مع شريك بريطاني. جاءت النتائج بعد يوم واحد فقط من اتهام واشنطن مونشوت ببناء Kimi K3 باستخدام تقنية أمريكية مسروقة.

مدعوم
مدعوم

Kimi K3 لا تلبي معايير الأمن السيبراني الأمريكي

شارك قطاع التجارة النتائج يوم الخميس. وقال إن كيمي K3 جاءت دون مستوى النماذج الأمريكية الرائدة، مع الإشارة إلى اختبار مشترك test مع خبراء بريطانيين.

أطلق Moonshot Kimi K3 في 16 يوليو. كان الطلب مرتفعًا جدًا لدرجة أنه اضطر إلى إيقاف التسجيلات الجديدة خلال يومين.

أدى الإطلاق أيضًا إلى إرباك أسهم شركات الرقائق الأمريكية وأثار شكوكًا جديدة حول تقدم أمريكا في مجال الذكاء الاصطناعي.

اختبار واحد، يُسمى ExploitBench، يستخدم ثغرات متصفح Chrome الحقيقية التي طورتها جامعة كارنيغي ميلون. حصل Kimi K3 على 32%. وهذا تجاوز نموذج GLM-5.2 الصيني الذي حصل على 24%. لكنه تأخر عن أفضل النماذج الأمريكية التي وصلت إلى حوالي 76%.

قدرة تطوير الاستغلال
اختبار على مقاييس قدرة تطوير الاستغلال. المصدر: NIST
مدعوم
مدعوم

أصعب خطوة هي أخذ السيطرة الكاملة على جهاز الهدف. فشل كيمي K3 في هذه الخطوة في جميع الاختبارات الـ41. نجحت أفضل النماذج الأمريكية في تنفيذها في 20 حالة.

اختبار آخر، يُسمى The Last Ones، هو هجوم افتراضي على شبكة شركة يتكون من 32 خطوة. يحتاج خبير بشري إلى حوالي 20 ساعة لإكماله. ووصل Kimi K3 في المتوسط إلى الخطوة 17. ووصلت أفضل النماذج الأمريكية إلى الخطوة 28.5. وأكمل Kimi K3 الاختبار بالكامل مرة واحدة فقط من أصل 10 محاولات.

يُزعم أن أفضل الأنظمة الأمريكية قامت بذلك ست أو سبع مرات.

لكن الفجوة قد تبدو أكبر مما هي عليه

لكن الأرقام لا تروي القصة كاملة. تحتوي الملاحظات الصغيرة الخاصة بالتقرير على عدة شروط.

أولاً، تم اختبار النماذج الأمريكية مع تعطيل مرشحات السلامة الخاصة بها. هذا الإعداد يُظهر قوتها الكاملة. تحتفظ النسخ العامة بهذه المرشحات مفعّلة. لذا فإن درجات الولايات المتحدة تمثل الحالة المثلى، وليس الواقع الفعلي.

كما دعا الفريق إلى إنهاء العمل مبكرًا ومحدودًا. فقد تقييم Kimi K3 على اختبار واحد فقط ونفّذ فقط جزءًا من مجموعة الاختبارات الكاملة. لذا فإن تقييمه غير مستقر. بعض الاختبارات خاصة أيضًا، لذا لا يمكن للخارجيين التحقق من العمل.

هناك أيضًا عدم توافق أساسي. كيمي K3 هو نموذج مفتوح يمكن لأي شخص تنزيله. النماذج الأمريكية هي أنظمة مغلقة وخصوصية. وجد المعهد البريطاني found أن النماذج المفتوحة عادة ما تكون متأخرة بأربعة إلى سبعة أشهر عن أفضل النماذج المغلقة. سيتم إجراء اختبار كامل على كيمي K3 فقط بعد إصدار Moonshot له للجمهور.

هذه الاختبارات ليست هجمات حقيقية أيضًا. لم يكن هناك دفاعات بشرية ولا إنذارات في الشبكة الوهمية. ومع ذلك، تفوق Kimi K3 على أحدث نموذج مفتوح رائد. كما أكمل الهجوم الكامل مرة واحدة.

التوقيت والمصدر يثيران أيضًا أسئلة. كان CAISI سابقًا معهد الأمن الأمريكي للذكاء الاصطناعي. أعادت إدارة ترامب تسميةهذا المعهد في يونيو 2025. وهو يقع في نفس الإدارة التي تحد من مبيعات الرقائق الأمريكية للصين. وجاء تقريره عن منافس صيني بعد يوم واحد فقط من ادعاء السرقة.

الحماية الضعيفة لا تزال ترفع المخاطر

ومع ذلك، فإن الدرجات المنخفضة لا تعني أن Kimi K3 آمن. فقد وجد الاختبار أن ضوابطه لم تمنعه من محاولة بناء ثغرات أو الهجوم على الأنظمة.

هذا مهم بسبب ما يلي. تخطط مونشوت لإطلاق النموذج الكامل في 27 يوليو. بمجرد إصداره، لا يمكن سحبه. يمكن لأي شخص تنزيله وإزالة مرشحات الأمان.

يأتي الاختبار أيضًا بعد ادعاء سرقة. يقول واشنطن إن مونشوت بنت Kimi K3 على تقنيات الذكاء الاصطناعي الأمريكية المسروقة. وقال رئيس التكنولوجيا في البيت الأبيض مايكل كراتسيوس إن الشركة نسخت سرًا Claude Fable 5 من Anthropic. الحيلة، المسمّاة التقطير، تدرّب نموذجًا جديدًا على إجابات نموذج أقوى.

يدعم أنثروبيك هذا الادعاء. في فبراير، تتبّع أكثر من 3.4 مليون محادثة Claude إلى Moonshot من خلال مئات الحسابات الوهمية. وحذّر من أن النماذج المنسوخة تفقد ضوابط الأمان الأصلية. هذه هي نفس نقطة الضعف التي اكتشفها هذا الاختبار للتو.

لا يزال الولايات المتحدة تنفق 23 مرة أكثر على الذكاء الاصطناعي مقارنة بالصين. لكن المختبرات الصينية تواصل تقليص الفجوة. الاختبار الحقيقي يأتي عندما يُطرح Kimi K3 للجمهور، ويمكن للخبراء الخارجيين التحقق من الادعاءات بأنفسهم.

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.