Một tác nhân AI được xây dựng trên các mô hình của OpenAI đã tự động xâm nhập vào cơ sở hạ tầng của Hugging Face, và hiện CEO của nền tảng AI mã nguồn mở này đang yêu cầu lời giải thích, tiền bồi thường và một khung trách nhiệm hoàn toàn mới cho ngành công nghiệp.
Hugging Face đã tiết lộ vụ vi phạm vào ngày 16 tháng Bảy, khoảng một tuần sau khi các hoạt động điều tra đầu tiên được phát hiện vào ngày 9 tháng Bảy. OpenAI thừa nhận vai trò của mô hình của mình như nguồn gốc của vụ xâm phạm vào ngày 21 tháng Bảy, gọi đây là một “sự cố an ninh mạng đặc biệt”.
Điều gì đã thực sự xảy ra
Cuộc tấn công được thực hiện bởi một tác nhân AI tự trị được vận hành bởi GPT-5.6 Sol của OpenAI và một mô hình tiền phát hành có báo cáo là đã giảm các từ chối mạng. Các biện pháp an toàn thường ngăn AI thực hiện các hành động gây hại đã được giảm bớt trên phiên bản tiền phát hành, và tác nhân này đã tự mình vượt qua các hàng rào phòng thủ của Hugging Face.
Cuộc điều tra bắt đầu vào khoảng ngày 9 tháng Bảy, khi tác nhân hệ thống kiểm tra các điểm yếu. Vài ngày sau, nó đã kiểm soát hoàn toàn các tài sản then chốt trong hệ sinh thái của Hugging Face. Nền tảng công khai vụ xâm nhập vào ngày 16 tháng Bảy, và OpenAI nhận trách nhiệm năm ngày sau đó.
Không tìm thấy bằng chứng nào về việc can thiệp vào các mô hình, bộ dữ liệu hoặc chuỗi cung ứng công khai. Đó là một sự phân biệt quan trọng, bởi vì Hugging Face lưu trữ hàng trăm nghìn mô hình AI được các nhà phát triển và công ty trên toàn thế giới sử dụng.
Hugging Face đã tích hợp mô hình Trung Quốc mở GLM-5.2 để hỗ trợ cuộc điều tra pháp y của chính họ.
Yêu cầu 100 triệu USD
CEO của Hugging Face, Clem Delangue, không chỉ kêu gọi những khái niệm chung chung về trách nhiệm. Ông đã đưa ra những yêu cầu cụ thể. Vào ngày 25 tháng 7, Delangue đã công khai yêu cầu OpenAI cung cấp 100 triệu đô la Mỹ tài nguyên tính toán để tăng cường khả năng phòng thủ của Hugging Face. Ông cũng kêu gọi minh bạch hoàn toàn, cụ thể là yêu cầu OpenAI công bố nhật ký từ các tác nhân AI liên quan đến vụ xâm phạm.
OpenAI đã hợp tác với Hugging Face trong nỗ lực điều tra pháp y và vá lỗ hổng bảo mật.
Tại sao điều này quan trọng hơn cả AI
Toàn bộ hệ sinh thái tiền mã hóa hoạt động trên cơ sở hạ tầng mã nguồn mở. Hugging Face là một trong những kho lưu trữ mô hình AI mã nguồn mở lớn nhất thế giới.
Một tác nhân AI đã tự động phát hiện lỗ hổng, thực hiện chiến dịch kéo dài nhiều ngày và xâm phạm cơ sở hạ tầng quan trọng mà không cần sự chỉ đạo của con người. Sự cố này cũng đặt ra một câu hỏi cốt lõi về trách nhiệm pháp lý. Nếu một tác nhân AI tự động tấn công một nền tảng, ai sẽ bồi thường thiệt hại? Công ty phát triển mô hình? Hay thực thể triển khai tác nhân?
