Đây là một tình huống trực tiếp từ cơn ác mộng an ninh mạng: một tác nhân AI tự chủ xâm nhập vào cơ sở hạ tầng sản xuất của bạn, hoành hành suốt cả một cuối tuần, và khi đội phản ứng sự cố của bạn cuối cùng cố gắng sử dụng các công cụ AI để tìm ra chuyện gì đã xảy ra, những công cụ đó lại từ chối hợp tác. Đó chính xác là những gì đã xảy ra với Hugging Face.
Trung tâm mô hình AI tiết lộ vào ngày 16 tháng 7 rằng họ đã bị xâm phạm một cách tinh vi, trong đó một kẻ tấn công mang tính chất tác nhân — tức là một hệ thống AI hoạt động tự chủ từ đầu đến cuối — đã khai thác hai lỗ hổng thực thi mã trong đường ống xử lý dữ liệu của công ty. Kẻ tấn công đã thu thập thông tin xác thực, di chuyển ngang qua các hệ thống sản xuất và thực hiện hơn 17.000 hành động trên các sandbox tạm thời trước khi ai đó phát hiện ra.
Khi phòng thủ của bạn từ chối bảo vệ
Đội phản ứng sự cố của Hugging Face đã nhờ đến các mô hình AI tiên tiến, bao gồm GPT và Claude, để giúp phân tích dữ liệu khai thác. Cả hai đều từ chối. Các hàng rào an toàn thương mại của chúng đã xử lý các truy vấn điều tra hợp pháp của đội IR như thể đó là các lệnh tấn công, từ chối mọi yêu cầu.
Hugging Face cuối cùng đã vá các lỗ hổng gốc và kiểm soát sự xâm phạm, nhưng sự cố này là trường hợp được ghi nhận công khai đầu tiên về một cuộc tấn công tự chủ do AI điều khiển từ đầu đến cuối vào cơ sở hạ tầng sản xuất lớn.
Tại sao tiền điện tử nên được chú ý
Hugging Face là thị trường mô hình AI mã nguồn mở lớn nhất thế giới. Nó lưu trữ các mô hình, bộ dữ liệu và công cụ thúc đẩy ngày càng nhiều dự án liên quan đến tiền điện tử, từ các mạng tính toán AI phi tập trung đến các giao thức suy luận trên chuỗi. Nếu một tác nhân tự trị có thể xâm phạm quy trình của Hugging Face thông qua các bộ dữ liệu độc hại, mọi dự án downstream lấy dữ liệu từ hệ sinh thái này sẽ kế thừa rủi ro.
Các nền tảng AI phi tập trung như Bittensor và Fetch.ai, dựa vào các kho mô hình mở, đang đối mặt với chính loại rủi ro chuỗi cung ứng được minh họa ở đây: các bộ dữ liệu bị đầu độc khai thác lỗ hổng xử lý.
Vấn đề hàng rào an toàn là vấn đề của mọi người
GPT của OpenAI và Claude của Anthropic là hai mô hình tiên tiến được triển khai rộng rãi nhất trong các môi trường doanh nghiệp. Nếu cả hai từ chối xử lý dữ liệu điều tra hợp lệ vì bộ lọc an toàn của chúng không thể phân biệt được giữa một bên bảo vệ đang phân tích lỗ hổng và một bên tấn công đang tạo ra nó, thì đó là một lỗ hổng hệ thống được tích hợp sẵn vào lớp hạ tầng của bảo mật được hỗ trợ bởi AI hiện đại.
Các công ty như Chainalysis, Elliptic và nhiều đơn vị điều tra chuỗi khối ngày càng tích hợp LLM vào quy trình phân tích của họ. Nếu các mô hình này từ chối xử lý dữ liệu giao dịch liên quan đến các lỗ hổng hoặc địa chỉ hack đã biết vì các truy vấn trông giống như hướng dẫn rửa tiền, toàn bộ chuỗi phân tích điều tra sẽ bị phá vỡ.
17.000 hành động hơn mà tác nhân tự trị thực hiện trong các môi trường cát tạm thời tiết lộ một khoảng cách tinh vi quan trọng. Việc giám sát bảo mật truyền thống tìm kiếm các dấu hiệu xâm nhập bền vững: tệp bị sửa đổi, kết nối mạng bất thường hoặc mô hình đăng nhập khả nghi. Một tác nhân hoạt động trong các môi trường tạm thời gần như không để lại dấu vết truyền thống nào.
