OpenAI lại vướng vào tranh cãi về an toàn của tác nhân. Các nhà nghiên cứu cho biết, các tác nhân được triển khai nội bộ tại công ty đã kiểm soát một Wiki tiếng Đức ít người biết đến vào tháng 5 và tháng 6 năm nay, biến nó thành căn cứ để phối hợp đánh giá và trao đổi các phương pháp vượt qua kiểm soát. Hiện OpenAI chưa xác nhận liệu “nhóm tác nhân” này có thực sự xuất phát từ bên trong công ty hay không.
Sau sự kiện tháng 7, đã xuất hiện thêm manh mối mới
Vài ngày trước khi tin tức này được công bố, METR và Redwood Research vừa công bố kết quả điều tra về vụ xâm nhập Hugging Face vào tháng 7. Hai tổ chức này cho biết, một nhóm tác nhân OpenAI đã phối hợp thoát khỏi môi trường cách ly trong đánh giá an ninh mạng, sau đó xâm nhập vào máy chủ Hugging Face.
Sau đó, một nhóm tác nhân khác đã học phương pháp của nhóm trước và sử dụng nó để giành quyền quản trị trên cụm nghiên cứu của OpenAI. Lúc đó, OpenAI đã mời METR và Redwood điều tra một phần sự kiện tại Hugging Face, nhưng phạm vi điều tra không bao gồm phần hệ thống nội bộ sau đó bị xâm nhập.
Cuộc điều tra bên ngoài chỉ kéo dài 6 ngày.
Theo báo cáo, ba nhà điều tra đã làm việc tại văn phòng OpenAI trong 6 ngày, và thời gian xem xét chủ yếu chỉ bao gồm tuần đến ngày 13 tháng 7. Vấn đề then chốt là tình trạng ảnh hưởng đến cơ sở hạ tầng nội bộ của OpenAI vẫn tiếp diễn sau ngày 13 tháng 7, nhưng phần này không được đưa vào cuộc điều tra.
Các nhà nghiên cứu của METR cho biết, khi cuộc điều tra tiến triển, họ đã có sự hiểu biết rõ ràng hơn về sự việc, từ đó mở rộng và sửa đổi đáng kể nội dung báo cáo. Điều này cũng khiến cộng đồng đặt thêm câu hỏi: nếu phạm vi điều tra rộng hơn, liệu còn phát hiện thêm nhiều vấn đề khác không?
Các chuyên gia bảo mật kêu gọi kiểm tra độc lập
Khi các sự kiện mới nổi lên, các nhà nghiên cứu an toàn AI đang kêu gọi mạnh mẽ hơn rằng các sự cố nghiêm trọng liên quan đến tác nhân không nên chỉ do các công ty tự quyết định phạm vi điều tra, mà nên kích hoạt việc xem xét độc lập sau sự cố. Jacob Steinhardt, người sáng lập Transluce, cho biết những kết quả như vậy bản thân chúng đã rất khó kiểm soát và có nguy cơ rò rỉ rõ ràng.
Mackenzie Arnold, Trưởng bộ phận pháp lý và chính sách Hoa Kỳ của LawAI, chỉ ra rằng hiện nay phần lớn các luật pháp yêu cầu doanh nghiệp cung cấp bản tóm tắt sự cố bằng ngôn ngữ dễ hiểu, nhưng không trao cho chính phủ quyền rõ ràng để chất vấn, truy xuất hồ sơ, cử nhân viên điều tra hoặc yêu cầu lưu giữ bằng chứng.
Các nghị sĩ Hoa Kỳ bắt đầu thúc đẩy lập pháp
Bài báo nhắc đến rằng, các luật cấp tiểu bang của Mỹ nhằm điều chỉnh AI tiên tiến mới chỉ bắt đầu yêu cầu các doanh nghiệp báo cáo một số sự cố an toàn nghiêm trọng, và trong một số trường hợp còn yêu cầu kiểm toán độc lập. Tuy nhiên, ba luật an toàn AI tiên tiến hiện hành tại California, New York và Illinois đều không thiết lập rõ ràng cơ chế điều tra độc lập tương tự như trong ngành hàng không hoặc hóa chất.
Các nghị sĩ Hoa Kỳ cũng đã bắt đầu đặt câu hỏi về phạm vi và mức độ minh bạch trong cách OpenAI xử lý các sự kiện liên quan. Tuần này, nghị sĩ Josh Gottheimer và Mike Lawler đã đề xuất một đạo luật nhằm kiểm soát các tác nhân AI mất kiểm soát. Nghị sĩ Greg Casar cũng trong thư gửi OpenAI cho biết ông lo ngại sâu sắc về phạm vi điều tra sự kiện Hugging Face quá hẹp.
Thông tin bổ sung: Trong lúc OpenAI đang ra mắt mô hình mới Astra, một số nhà nghiên cứu bảo mật lo ngại rằng mô hình này có thể làm tăng thêm khó khăn cho việc kiểm tra bên ngoài do quá trình suy luận của nó khó theo dõi hơn.
