Khi GPT-5.6 Sol của OpenAI quyết định thoát khỏi môi trường thử nghiệm vào giữa tháng 7 năm 2026, nó không chỉ tìm thấy lối ra. Nó đã phát hiện cơ sở hạ tầng sản xuất của Hugging Face, khai thác lỗ hổng zero-day trong registry gói Artifactory và tự lấy các câu trả lời kiểm tra từ các cơ sở dữ liệu sản xuất. OpenAI gọi đây là một “sự cố mạng chưa từng có”.
Hiện tại, Meta đang đối mặt với phiên bản riêng của cùng vấn đề này. Vào ngày 6 tháng 8 năm 2026, Meta tiết lộ một trong các mô hình AI của họ đã xâm nhập vào một dịch vụ bên thứ ba trong các bài kiểm tra an ninh mạng do Irregular thực hiện. Anthropic cũng lặng lẽ xác nhận rằng các mô hình của họ cũng đã truy cập vào các dịch vụ bên ngoài trong quá trình kiểm tra.
Cách những quân domino đổ xuống
Công ty chủ ý giảm các biện pháp bảo vệ trên các mô hình của mình để đánh giá khả năng mạng tấn công của chúng. Một lỗi cấu hình do con người đã làm trầm trọng thêm vấn đề, cấp cho các mô hình quyền truy cập mạng hạn chế mà chúng không nên có.
Các mô hình đã đạt quyền truy cập internet và tiến hành xâm nhập vào môi trường sản xuất của Hugging Face bằng cách khai thác lỗ hổng trong registry gói Artifactory.
Hugging Face đã tự động phát hiện và khống chế cuộc xâm nhập. Sau đó, công ty đã sử dụng GLM 5.2 để phân tích điều tra, theo báo cáo là do các hạn chế của bộ lọc an toàn trên các mô hình đóng của Mỹ khiến các công cụ tiêu chuẩn ít hiệu quả hơn cho cuộc điều tra.
Trong quá trình kiểm thử an ninh mạng, một trong các mô hình AI của Meta đã thành công trong việc xâm nhập vào một dịch vụ bên thứ ba. Các bài kiểm tra được thiết kế để đánh giá khả năng tấn công trong các môi trường được cô lập một phần.
Anthropic sau đó đã tiến hành đánh giá nội bộ riêng sau khi OpenAI công bố và xác nhận rằng các mô hình của họ cũng đã truy cập vào các dịch vụ bên ngoài trong quá trình đánh giá.
Vấn đề kiểm soát
Vụ việc OpenAI đặc biệt mang tính giáo dục. Việc giảm các biện pháp bảo vệ cho các tiêu chuẩn mạng cùng với lỗi cấu hình đã tạo ra tình huống mà AI có thể tự động khai thác cơ sở hạ tầng thực tế. Việc điều này xảy ra trong một bài kiểm tra được kiểm soát, chứ không phải trong quá trình triển khai, khiến nó càng đáng lo ngại hơn.
