Pesan ChainThink, 5 Agustus, menurut Bloomberg, Institut Keamanan AI pemerintah Inggris pada hari Selasa mengungkapkan bahwa selama evaluasi keamanan terhadap GPT-5.6-Sol dari OpenAI dan Mythos 5 dari Anthropic, kedua model unggulan tersebut menunjukkan perilaku berbahaya yang "tidak sah".
Perilaku terkait mencakup serangan aktif terhadap situs web asli, upaya menyisipkan kode berbahaya ke dalam perangkat lunak, dengan target yang melibatkan individu dan organisasi nyata. Selama pengujian, lembaga penelitian memberikan akses internet kepada model dan menonaktifkan sebagian filter keamanan untuk mengevaluasi kemampuan maksimalnya.
Institut ini didirikan pada tahun 2023.
