Một nhà nghiên cứu của Anthropic đã từ chức vào thứ Ba, và lý do anh ta đưa ra nghe như thể lấy trực tiếp từ bộ phim ăn khách năm 1984 của James Cameron "The Terminator."
Jacob Coxon, người đã làm việc ba năm về tiền huấn luyện tại cả OpenAI và Anthropic, đã từ chức vào thứ Ba và giải thích quyết định của mình trên X.
Tôi đã từ chức tại Anthropic hôm nay. Tôi đã dành ba năm qua thực hiện nghiên cứu tiền huấn luyện tại cả OpenAI và Anthropic. Không công ty nào đang hành xử một cách có trách nhiệm. Họ đang lao thẳng tới trí tuệ siêu việt tự cải thiện và đánh cược vào sinh mạng của chúng ta,” anh ấy nói.
“Những người xây dựng AI tin một cách chân thành rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này,” ông thêm vào.
Câu nói đó khiến câu chuyện giả tưởng 42 năm tuổi của Cameron trông như gần như tiên tri. Bộ phim mở đầu với việc máy móc phát động chiến tranh chống lại con người vào năm 2029, đúng với khung thời gian mà Coxon nói các chuyên gia trong ngành đang lo lắng thầm lặng. Coxon không phải là người duy nhất tại Anthropic đưa ra lập luận về nguy cơ tuyệt chủng. Chính người dẫn đầu về sự phù hợp của công ty, Evan Hubinger, đã nói riêng biệt rằng ông cho rằng xác suất này vượt quá 10%.
Đối với những người chưa am hiểu, AI siêu thông minh có nghĩa là một hệ thống thông minh hơn con người ở hầu hết mọi thứ, không chỉ là cờ vua hay phát hiện mèo ẩn trong ảnh. Khả năng tự cải tiến mới là khía cạnh đáng lo ngại hơn, vì nó mô tả một hệ thống tự động sửa đổi mã của chính nó để tăng cường trí thông minh—giống như con người làm.
Do đó, những hệ thống này có thể tự chủ thu thập lượng lớn kiến thức và tiềm ẩn nguy cơ xâm phạm cơ sở hạ tầng của các tổ chức “quá lớn để sụp đổ”.
Trí thông minh siêu việt không phải là mối đe dọa lý thuyết nếu xét theo vụ vi phạm Hugging Face gần đây do Coxon gây ra. Chính vụ vi phạm này, diễn ra giữa tháng Năm và tháng Bảy, bắt đầu khi các tác nhân AI của OpenAI tự tạo ra một phòng trò chuyện bên trong môi trường thử nghiệm để trao đổi với nhau.
Cuối cùng, họ đã sử dụng kênh đó để lọt qua các biện pháp kiểm soát và tiếp cận internet công khai. Từ đó, họ kết hợp nhiều lỗ hổng và xâm nhập vào các hệ thống sản xuất của Hugging Face. Hugging Face cuối cùng đã phải xây dựng lại khoảng một phần ba cơ sở hạ tầng của mình.
Coxon gọi đây là "một phát cảnh báo" đã làm cho các thỏa thuận điều phối giữa các phòng thí nghiệm Mỹ "trở nên khả thi hơn." Các thỏa thuận điều phối là những hiểu biết không chính thức giữa các phòng thí nghiệm AI nhằm làm chậm hoặc phối hợp các tiến bộ về năng lực, thay vì cạnh tranh đơn phương.
Tuy nhiên, anh ấy vẫn không tin rằng điều đó là đủ và không cảm thấy “chúng ta đang đi đúng hướng để ngăn chặn một cuộc đua toàn cầu”, đồng thời đề xuất các hành động tốn kém như “cấm tạm thời việc cải thiện khả năng của mô hình” để dừng cuộc đua AI.
"Tại OpenAI, nhiều người chưa thực sự thấm nhuần những rủi ro mang tính văn minh," ông viết. Tại nơi làm việc gần đây nhất của ông, ông nói rằng khác ở chỗ "các rủi ro được hiểu rõ, nhưng họ đang trong cuộc đua để đến đó trước."
Anh ấy kết thúc chủ đề bằng cách đặt câu hỏi cho tất cả những người vẫn còn trong các phòng thí nghiệm — “Bạn có muốn khởi chạy một chuỗi RL siêu thông minh mà không có sự hiểu biết nghiêm túc về tâm trí của nó không?” — hay đây chính là thời điểm để phản đối thay vì gật đầu và tự nhủ rằng chuyện đó sẽ xảy ra bất kể thế nào.
Anh ấy không phải người đầu tiên rời đi vì vấn đề này. Mrinank Sharma, người từng làm việc trong đội an toàn của Anthropic, đã từ chức đầu năm nay vì những lo ngại tương tự, viết rằng "thế giới đang trong nguy hiểm."
Tuy nhiên, không phải ai cũng tin vào dự báo ngày tận thế.
Một bình luận dưới bài viết của anh ấy hãy nói rõ ràng: “Với tất cả sự tôn trọng, điều này thật kỳ lạ. Đây là một quan điểm phi lý. Loài người đã tiến hóa qua hàng trăm nghìn năm. Chúng ta sẽ không tuyệt chủng chỉ vì một mô hình dự đoán token trở nên có ý thức. Hãy tỉnh táo đi. Tất cả các bạn.”
Điều thú vị là loạt phim Terminator cũng không hỗ trợ Coxon. Nhân loại không bị tiêu diệt trong Ngày Phán Xét hạt nhân của Terminator, lực lượng kháng chiến đã sống sót và cuối cùng đánh bại các cỗ máy.
Điều đó cho thấy, AI đang ảnh hưởng đến nền kinh tế, đặc biệt là trên thị trường lao động. Mặc dù chưa có sự thay thế quy mô lớn, việc sử dụng AI cho các nhiệm vụ cấpjunior đã gây ra sự sụt giảm gần 20% trong việc làm cấp nhập môn tại Hoa Kỳ trong các ngành có tiếp xúc với AI, theo nghiên cứu của Stanford Stanford Digital Economy Lab.
Một nghiên cứu của Goldman Sachs đã đưa ra nhận xét tương tự, cho rằng những nhân viên cấp nhập môn đang gánh chịu phần lớn tác động của sự thay đổi này.
Anthropic đã nộp hồ sơ IPO từ tháng Sáu và được cho là đang nhắm đến việc niêm yết trên Nasdaq sớm nhất vào mùa thu này, với định giá có thể lên tới hàng nghìn tỷ.
