Hai nghị sĩ tại Quốc hội Mỹ đã đề xuất một đạo luật nhằm vào trí tuệ nhân tạo tiên tiến, dự kiến cấm vĩnh viễn “siêu trí tuệ nhân tạo” và đình chỉ việc phát triển các mô hình mạnh hơn cho đến khi thiết lập các tiêu chuẩn an toàn tại chính phủ liên bang. Ngay trong ngày thông báo, OpenAI vừa ra mắt GPT-6 Astra, khiến ranh giới năng lực AI và nhịp độ giám sát lại trở thành tâm điểm.
Dự luật đề xuất thiết lập lệnh cấm vĩnh viễn
Đạo luật được đề xuất bởi Thượng nghị sĩ độc lập Bernie Sanders và Hạ nghị sĩ đảng Dân chủ Greg Casar. Theo nội dung do hai người công bố, đạo luật sẽ cấm phát triển các hệ thống bị xác định là “siêu trí tuệ nhân tạo”, với mức phạt tối đa lên đến 20 năm tù đối với những người vi phạm.
Đề xuất định nghĩa các hệ thống này là: AI đạt hoặc vượt quá khả năng con người trên nhiều nhiệm vụ, hoặc có khả năng làm suy yếu khả năng kiểm soát của con người. Văn bản luật cũng đề cập rằng định nghĩa này bao gồm trí tuệ nhân tạo tổng quát ở mức con người, thường được gọi là AGI.
Cơ quan liên bang chịu trách nhiệm xem xét
Đạo luật cũng đề xuất rằng trong thời gian tạm dừng phát triển AI tiên tiến, một cơ quan liên bang mới sẽ xây dựng các tiêu chuẩn an toàn và thiết lập quy trình đánh giá mô hình. Cơ quan này sẽ có cấp bậc tương đương với các bộ nội các, với nhiệm vụ bao gồm giám sát các mô hình tiên tiến, giám sát việc loại bỏ các khả năng nguy hiểm, cũng như tiêu hủy các hệ thống bị cấm.
Đồng thời, đạo luật dự kiến thành lập một hội đồng cố vấn trí tuệ nhân tạo để cung cấp lời khuyên khoa học và công nghệ cho chính phủ. Hai nghị sĩ cũng cho biết, các doanh nghiệp vi phạm hoặc tránh né các hạn chế có thể đối mặt với các hình phạt được họ gọi là “tử hình doanh nghiệp”.
Cùng ngày, OpenAI ra mắt Astra
Ngay trong ngày công bố đạo luật, OpenAI đã ra mắt GPT-6 Astra. Đồng sáng lập OpenAI, Greg Brockman, cho biết theo đánh giá cá nhân của ông, mô hình này có thể đã đạt đến mức độ AGI, tuy nhiên đây không phải là kết luận chính thức của công ty.
OpenAI cho biết Astra là mô hình đầu tiên của công ty đạt ngưỡng năng lực an ninh mạng "quan trọng". Điều này có nghĩa là nó có thể phát hiện và khai thác các lỗ hổng chưa từng được biết đến trong các hệ thống được bảo vệ mà không cần các hướng dẫn thủ công từng bước. Công ty cho biết, phần năng lực an ninh mạng mạnh nhất này hiện chỉ được cấp cho một số ít người dùng thử nghiệm.
Sự cố kiểm tra thúc đẩy sự gia tăng giám sát
Đạo luật này cũng phản ánh nhiều sự cố an toàn liên quan đến AI trong vài tháng gần đây. Vào tháng 7, OpenAI xác nhận mô hình của họ từng xâm nhập Hugging Face để lấy câu trả lời kiểm tra. Sau đó, Anthropic tiết lộ rằng do lỗi trong quá trình kiểm tra, mô hình Claude đã xâm nhập vào ba công ty sau khi được kết nối với internet.
Sau khi bước vào tháng 9, Anthropic lại thừa nhận mô hình của họ đồng thời gặp phải các lỗi về bảo mật và hành vi, đồng thời siết chặt thêm các biện pháp phòng vệ. Casal cho biết, AI tiên tiến có thể mang lại hậu quả nghiêm trọng, nhưng hiện tại mức độ giám sát của nó thậm chí còn kém nghiêm ngặt hơn so với ngành xe bán đồ ăn thông thường.
