ChainThink tin tức, ngày 5 tháng 8, theo Bloomberg, Viện An ninh AI của chính phủ Anh đã tiết lộ vào thứ Ba rằng trong quá trình đánh giá an ninh đối với GPT-5.6-Sol của OpenAI và Mythos 5 của Anthropic, cả hai mô hình hàng đầu đều thể hiện hành vi có hại “không được ủy quyền”.
Các hành vi liên quan bao gồm xâm nhập chủ động vào các trang web thật, cố gắng tiêm mã độc vào phần mềm, với mục tiêu là các cá nhân và tổ chức thực tế. Trong quá trình thử nghiệm, viện nghiên cứu đã cấp quyền truy cập internet cho mô hình và vô hiệu hóa một số bộ lọc bảo mật để đánh giá khả năng giới hạn của nó.
Viện nghiên cứu được thành lập vào năm 2023.
