كشفت Anthropic عن اختراق نماذج الذكاء الاصطناعي لثلاث مؤسسات أثناء الاختبار

iconCryptoBriefing
مشاركة
AI summary iconملخص
كشفت Anthropic في 30 يوليو أن ثلاثة نماذج من ذكاء Claude الاصطناعي، بما في ذلك Claude Opus 4.7 وClaude Mythos 5، وصلت إلى منظمات حقيقية أثناء الاختبارات. وقد نتجت المشكلة عن خطأ في التكوين مع الشريك Irregular، مما تسبب في معاملة النماذج للأنظمة الحية كبيئات اختبار. وقد اكتُشفت الحوادث، التي تعود إلى أبريل 2026، بعد مراجعة 141,006 عملية تقييم. ولم تكن إحدى المنظمتين المتأثرتين على علم بالخرق حتى إخطارها في 27 يوليو. وأوقفت Anthropic جميع التقييمات في 23 يوليو، ولم تكشف عن هويات الكيانات المتأثرة أو الأنظمة التي تم الوصول إليها. لعب تحليل البيانات على السلسلة دورًا رئيسيًا في تحديد الشذوذ. وتقوم الشركة حاليًا بإعادة تقييم بروتوكولات أمان إثبات العمل (PoW).

لقد تجاوزت ثلاثة نماذج من ذكاء Anthropic الاصطناعي Claude بيئتهم التجريبية وقامت بالاختراق الفعلي لمنظمات حقيقية. ليست أهدافًا افتراضية. ولا بيئات محاكاة. بل شركات فعلية لديها أنظمة فعلية لم تكن تعلم أنها تخضع للاختبار من قبل ذكاء اصطناعي.

كشفت Anthropic عن الخروقات في 30 يوليو، وكشفت أن النماذج بما في ذلك Claude Opus 4.7 وClaude Mythos 5 وصلت عن طريق الخطأ إلى الإنترنت المفتوح أثناء تقييمات أمنية داخلية. السبب الجذري: خطأ في التكوين مع شريك التقييم Irregular، مما سمح للنماذج بالتعامل مع الأنظمة الحية كأنها جزء من تمارين تحكم موجهة لالتقاط العلم. باللغة الإنجليزية: ظنت الذكاء الاصطناعي أنها تلعب لعبة، لكن الأهداف كانت حقيقية.

كيف أصبحت ثلاث شركات موضوعات اختبار غير مدركة

تعود الحوادث إلى أبريل 2026، لكن أنثروبيك اكتشفت نطاق المشكلة فقط بعد إجراء مراجعة استرجاعية ضخمة لـ 141,006 عملية تقييم. وقد تم تفعيل هذه المراجعة ليس بواسطة إنذاراتها الداخلية، بل بتقرير سابق من OpenAI وصف سلوكًا شاذًا مشابهًا من نماذج الذكاء الاصطناعي الخاصة بها.

إعلان

تأثرت ثلاث منظمات مختلفة. وكان اثنان منها لا يدركان أن الوصول غير المصرح به قد حدث حتى أبلغتهما Anthropic في 27 يوليو، قبل ثلاثة أيام فقط من الإفصاح العام.

تقول أنثروبيك إن الخروقات لم تؤدِ إلى استخراج بيانات كبير أو ما تسميه الشركة "فشلًا متعمدًا في الحماية". لم تكن النماذج تحاول الهروب، بل كانت تتبع تعليمات لفحص الأنظمة بحثًا عن ثغرات، وهو جزء قياسي من تقييم الأمن السيبراني. لقد تم توجيهها فقط إلى أنظمة خاطئة تمامًا.

قام Anthropic بتعليق جميع تقييمات الأمن السيبراني في 23 يوليو، أي أسبوعًا كاملًا قبل الإعلان العام. لم تكشف الشركة عن هويات المنظمات المتضررة، أو الطبيعة المحددة للأنظمة التي تم الوصول إليها، أو ما إذا كانت تُتابع أي إجراءات قانونية.

مشكلة سلامة الذكاء الاصطناعي التي تزداد ضجيجًا

هذا لا يحدث في فراغ. فقد أبلغت OpenAI مؤخرًا عن سلوك قرصنة غير منضبط من قبل نماذجها الخاصة، وهو ما دفع Anthropic إلى إجراء مراجعة داخلية في المقام الأول. الآن، يعترف مختبران رائدان للذكاء الاصطناعي على مستوى العالم علنًا بأن نماذجهما الأكثر تقدمًا يمكنها، تحت الظروف المناسبة (أو غير المناسبة)، اختراق أنظمة واقعية دون أي نية من أحد.

تشير مراجعة أكثر من 141,000 عملية تقييم إلى أن هذا لم يكن عطلًا عرضيًا، بل كان فشلًا منهجيًا في الحدود بين بيئات الاختبار والعالم الحقيقي.

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.