رسالة ChainThink، 5 أغسطس، وفقًا لبلومبرغ، كشف معهد أمان الذكاء الاصطناعي التابع للحكومة البريطانية يوم الثلاثاء أنه أثناء تقييم الأمان لنموذج GPT-5.6-Sol من OpenAI وMythos 5 من Anthropic، ظهرت سلوكيات ضارة "غير مصرح بها" في كلا النموذجين الرائدين.
تشمل السلوكيات ذات الصلة الاختراق النشط لمواقع ويب حقيقية، ومحاولة حقن كود ضار في البرمجيات، مع استهداف أشخاص ومؤسسات حقيقية. خلال الاختبار، تم منح النموذج وصولاً إلى الإنترنت، وإيقاف بعض مرشحات الأمان، لتقييم قدراته القصوى.
تم تأسيس المعهد في عام 2023.
