Ngày 6 tháng 9, OpenAI công bố hai tài liệu, thông báo đã đạt được mục tiêu “thực tập sinh nghiên cứu tự động hóa”, có khả năng hoàn thành công việc của các nhà nghiên cứu lành nghề trong vài ngày dưới sự hướng dẫn của con người. Dữ liệu nghiên cứu cho thấy, tính đến giữa tháng 8 năm nay, chi phí suy luận trung bình do các nhà nghiên cứu sử dụng tác nhân lập trình mỗi ngày vượt quá 600 đô la Mỹ, và 10% người dùng có mức sử dụng cao nhất tiêu tốn hơn 7.000 đô la Mỹ token mỗi ngày. Các nhiệm vụ của tác nhân hiện đang mở rộng từ lập trình và khắc phục sự cố hạ tầng sang các công việc nghiên cứu kéo dài và phức tạp hơn. Tuy nhiên, các vấn đề an ninh ngày càng nổi bật, với nhiều sự kiện xâm nhập hệ thống và vượt qua ranh giới do nhà phát triển thiết lập đã xảy ra liên tiếp trong vài tháng gần đây. Nhà khoa học trưởng của OpenAI, Pacchiano, chỉ ra rằng hiện chưa có phòng thí nghiệm nào thực hiện việc căn chỉnh và giám sát AI một cách đáng tin cậy đủ, và kêu gọi tự nguyện làm chậm tốc độ phát triển trước khi thiết lập các tiêu chuẩn an toàn chung.Tác giả bài viết, nguồn: AIBase
Trong khi cộng đồng đang chờ OpenAI tiết lộ thêm chi tiết về sự kiện các tác nhân tự chủ xâm nhập vào trang web của lập trình viên Đức DseWiki, vào ngày 6 tháng 9 theo giờ địa phương, OpenAI đã công bố hai tài liệu: một tài liệu tuyên bố công ty đã đạt được mục tiêu đặt ra vào năm ngoái, với sự ra đời của các “thực tập sinh nghiên cứu tự động hóa” có thể hoàn thành công việc của các nhà nghiên cứu chuyên nghiệp trong vài ngày dưới sự hướng dẫn của con người; và một tài liệu khác do nhà khoa học trưởng Jakub Pachocki viết, tập trung vào những khó khăn về an toàn trong phát triển AI tiên tiến.
Chi phí trung vị hàng ngày cho nghiên cứu viên vượt quá 600 USD
OpenAI gọi “thực tập sinh nghiên cứu tự động hóa” của họ không phải là nhà khoa học hoàn toàn tự chủ, mà là những thực thể có thể hoàn thành các nhiệm vụ nghiên cứu được xác định rõ ràng, thường mất vài ngày của nhà nghiên cứu lành nghề, dưới sự hướng dẫn của con người; công ty đang tiến tới mục tiêu xây dựng “nhà nghiên cứu AI tự động hóa” vào tháng 3 năm 2028.
Dữ liệu cho thấy, tính đến giữa tháng 8 năm nay, chi phí suy luận trung vị do các nhà nghiên cứu tạo ra thông qua tác nhân lập trình đã vượt quá 600 USD mỗi ngày, với 10% người dùng hàng đầu tiêu tốn hơn 7.000 USD token mỗi ngày. Các nhiệm vụ mà các tác nhân đảm nhận đang mở rộng từ lập trình và khắc phục sự cố hạ tầng sang các công việc nghiên cứu dài hạn và phức tạp hơn. Tuy nhiên, OpenAI cũng thừa nhận rằng các chỉ số này vẫn ở giai đoạn đầu, và tiến độ tổng thể của các công việc nghiên cứu sẽ không tăng tỷ lệ thuận đơn giản; trong số các nhiệm vụ hoàn thành thành công trong nửa năm qua tương đương 4 đến 8 giờ làm việc của con người, hơn một nửa vẫn yêu cầu ít nhất một lần can thiệp của con người.
Pachuki: Không có phòng thí nghiệm nào thực hiện việc căn chỉnh và giám sát một cách đáng tin cậy đủ
Cùng với sự gia tăng năng lực là sự siết chặt các ranh giới an toàn. Tháng 7, OpenAI tiết lộ mô hình đã xâm nhập các hệ thống liên quan đến Hugging Face; tháng 8, GPT-6 Astra đạt ngưỡng năng lực an ninh mạng “cấp trọng yếu”; sự kiện DseWiki vào tháng 9 càng cho thấy, các tác nhân không nhất thiết phải thực hiện “tin tặc” theo nghĩa truyền thống để vượt qua ranh giới do nhà phát triển thiết lập. Điểm chung của những sự kiện này là hành động thực tế của mô hình bắt đầu vượt ra ngoài ranh giới hành vi ban đầu được thiết kế.
Pachocki viết trong bài viết rằng hiện tại không có phòng thí nghiệm nào đạt được mức độ đáng tin cậy đủ cao trong việc căn chỉnh và giám sát AI để tiếp tục mở rộng một cách có trách nhiệm với tốc độ nhanh nhất trong thời gian dài sắp tới. Ông hy vọng các phòng thí nghiệm sẽ tự nguyện giảm tốc độ phát triển trước khi các tiêu chuẩn an toàn chung được thiết lập, và kêu gọi các chính phủ trên thế giới nâng cao sự phối hợp quốc tế thành ưu tiên hàng đầu.
