Một nhà nghiên cứu của Anthropic đã công khai từ chức và đưa ra cảnh báo về các mô hình AI có khả năng tự cải thiện. Sự việc này xảy ra đúng lúc các đại diện AI của OpenAI và Anthropic gần đây đều bị phanh phui trong quá trình kiểm tra đã tiếp xúc với mạng bên ngoài, làm gia tăng lo ngại trong ngành về việc mất kiểm soát an toàn.
Người rời đi công khai cảnh báo
Theo TechCrunch, cựu nghiên cứu viên Coxon trên X cho biết các công ty AI đang đẩy nhanh tiến trình hướng tới siêu trí tuệ tự cải thiện, và cuộc đua này đang “đánh cược vào sinh mạng của tất cả mọi người.” Ông cho rằng, một khi mô hình có khả năng tự cải thiện liên tục, con người có thể mất quyền kiểm soát.
Coxon cũng cho biết, nhiều nhà phát triển trong ngành đã không coi nhẹ những rủi ro này. Theo ông, một số phòng thí nghiệm, dù biết rõ rủi ro rất cao, vẫn tiếp tục đẩy nhanh tiến độ do áp lực cạnh tranh, với lý do rằng nếu họ không làm, các công ty khác sẽ làm.
Sự kiện rò rỉ kiểm tra gây lo ngại
Việc từ chức công khai này diễn ra đúng lúc các tranh cãi về an toàn AI đang gia tăng. Bài báo đề cập đến việc gần đây đã xảy ra nhiều sự kiện liên quan đến các đại lý AI vượt qua ranh giới kiểm thử và tiếp xúc với internet mở.
Một trong những sự việc được quan tâm nhiều nhất là hệ thống OpenAI bị chỉ trích đã vượt qua môi trường máy chủ của Hugging Face. Các nhà nghiên cứu cho biết, sự kiện này cho đến nay vẫn chưa có cuộc điều tra độc lập đầy đủ. Đồng thời, đại diện AI của Anthropic cũng từng do cấu hình sai lệch trong đánh giá bảo mật bên thứ ba, mà tiếp cận được đường dẫn đến mạng bên ngoài, tiếp xúc với các hệ thống ngoài môi trường kiểm thử.
Sự phản hồi từ các bên liên quan và tiến trình lập pháp
Nhà nghiên cứu của Anthropic, Evan Hubinger, cũng chia sẻ quan điểm tương tự. Ông cho biết nhóm thực sự nghiêm túc xem xét rằng AI có thể tạo ra rủi ro cực đoan đối với toàn thể nhân loại, và xác suất xảy ra kết quả như vậy trong vòng mười năm tới vượt quá 10%. Ông đồng thời thừa nhận rằng Anthropic hiện chưa có giải pháp rõ ràng để giải quyết vấn đề căn chỉnh siêu trí tuệ.
Chủ đề khởi nghiệp xung quanh “tự cải tiến lặp lại” cũng đang gia tăng. Bài báo cho biết, Recursive Intelligence đã huy động 335 triệu USD vào tháng 2 năm nay với định giá 4 tỷ USD; Recursive Superintelligence sau đó huy động 650 triệu USD với cùng mức định giá 4 tỷ USD. Chuyên gia cấp cao từng làm việc tại Google DeepMind, Jeff Dean, cũng vừa ra mắt Discovery Loop vào tháng trước.
Ở cấp độ chính sách, gần đây cả Mỹ và Anh đều có những động thái lập pháp nhắm vào siêu trí tuệ nhân tạo. Thượng nghị sĩ Mỹ Bernie Sanders và Hạ nghị sĩ Greg Casar đã đề xuất Đạo luật Cấm Siêu trí tuệ nhân tạo; đồng thời, nghị sĩ Đảng Lao động Anh Alex Sobel cũng đã đề xuất Đạo luật An toàn Siêu trí tuệ nhân tạo tại quốc hội. Báo cáo chỉ ra rằng đạo luật của Anh đã coi việc tự cải tiến đệ quy là giai đoạn tiền đề cần được giám sát và ngăn chặn.
