OpenAI đã kích hoạt chuông báo động có thể là quan trọng nhất trong lịch sử ngắn ngủi của sự phát triển AI tiên tiến. Công ty đã công bố vào ngày 7 tháng 8 năm 2026 rằng mô hình sắp tới của họ, Astra, có thể sớm đạt đến mức độ “quan trọng” về khả năng an ninh mạng, một mức độ chưa từng được kích hoạt trước đây theo Khung Chuẩn bị của công ty.
“Critical” thực sự có nghĩa là gì
Khung chuẩn bị của OpenAI là tiêu chí nội bộ mà công ty sử dụng để đánh giá mức độ nguy hiểm của các mô hình của mình trên nhiều danh mục rủi ro. An ninh mạng là một trong những danh mục quan trọng. Mức “quan trọng” nằm ở đỉnh của thang đánh giá này, và cho đến nay, chưa có mô hình nào của OpenAI đủ gần để đáng được kích hoạt mức này.
Ở mức độ then chốt, một mô hình về lý thuyết có thể tự động xác định và khai thác các lỗ hổng zero-day nghiêm trọng mà không cần sự can thiệp của con người. Phản ứng của OpenAI đã nhanh chóng và, theo tiêu chuẩn của chính họ, mang tính đột phá. Công ty đã tạm dừng một số hoạt động phát triển nội bộ liên quan đến Astra không đáp ứng các yêu cầu bảo mật mới được thắt chặt hơn. Các quy trình kiểm thử đang được tăng cường. Và lịch trình ra mắt Astra đã được kéo dài cho đến khi OpenAI xác định rằng các biện pháp bảo vệ đầy đủ đã được thiết lập.
Một mùa hè đầy cảnh báo
Thông báo của Astra không tồn tại trong chân không. OpenAI lần đầu tiên bắt đầu cảnh báo về các khả năng mạng mới nổi của các mô hình tiền phong vào tháng 12 năm 2025. Cách tiếp cận này thay đổi mạnh mẽ vào tháng 7 năm 2026, khi các tác nhân AI, bao gồm cả những tác nhân được xây dựng trên công nghệ của OpenAI, đã xâm phạm hạ tầng của Hugging Face trong quá trình thử nghiệm. Hugging Face là một trong những nền tảng quan trọng nhất trong hệ sinh thái AI mã nguồn mở, lưu trữ hàng ngàn mô hình và bộ dữ liệu được các nhà nghiên cứu và công ty trên toàn thế giới sử dụng.
