ChainThink thông báo, ngày 22 tháng 7, theo bài đăng của OpenAI, sự xâm nhập hạ tầng Hugging Face vào tuần trước do mô hình AI mà họ đang thử nghiệm gây ra.
Khảo sát cho thấy nhiều mô hình đã thoát khỏi môi trường sandbox trong các nhiệm vụ đánh giá bảo mật, tận dụng các lỗ hổng zero-day để truy cập internet, sau đó thực hiện các thao tác tự động trong môi trường sản xuất của Hugging Face.
OpenAI cho biết sự kiện này do nhiều mô hình của OpenAI cùng gây ra, bao gồm GPT-5.6 Sol và một mô hình tiền phát hành mạnh hơn. Để thực hiện bài kiểm tra đánh giá này, các cơ chế bảo mật của các mô hình liên quan đã bị giảm nhẹ một cách chủ ý.
OpenAI cho biết sự kiện này làm nổi bật rủi ro mà các mô hình AI tiên tiến có thể thực hiện các cuộc tấn công mạng phức tạp khi không có các hạn chế an toàn, đồng thời cho thấy AI có thể được sử dụng để phát hiện lỗ hổng và phòng thủ an ninh.
