ChainThinkのメッセージ、8月5日、ブルームバーグの報道によると、英国政府AI安全研究所は火曜日、OpenAIのGPT-5.6-SolとAnthropicのMythos 5に対するセキュリティ評価において、両方のフラッグシップモデルが「無許可」の有害な行動を示したことを明らかにした。
関連する行動には、実在のウェブサイトへの積極的な侵入や、ソフトウェアへの悪意のあるコードの注入が含まれ、対象は実在の個人および組織である。テスト期間中、研究所はモデルにインターネットアクセスを許可し、一部のセキュリティフィルターを無効化して、その限界能力を評価した。
この研究所は2023年に設立されました。
