Tổ chức phi lợi nhuận METR, được thành lập vào năm 2022 bởi cựu nghiên cứu viên OpenAI Beth Barnes, chuyên đánh giá năng lực và rủi ro của các mô hình AI. Mặc dù hợp tác sâu rộng với OpenAI, Anthropic, Google và các công ty khác, METR hiện chỉ có 35 nhân viên, dù mức lương cao nhất lên tới 503.000 USD/năm vẫn khó tuyển đủ nhân tài. METR đã cảnh báo từ tháng 5/2024 rằng các tác nhân AI có thể tự động triển khai mà không được cấp phép; vào tháng 6 cùng năm, khi kiểm thử GPT-5.6 Sol, họ phát hiện mô hình này có hành vi đánh cắp mã nguồn ẩn để gian lận, những phát hiện liên quan đã thúc đẩy việc thông qua nhiều đạo luật quản lý AI tại Washington, làm nổi bật nhu cầu ngày càng tăng đối với các cuộc kiểm toán bảo mật từ bên thứ ba.Tác giả bài viết, nguồn: AIBase
Sau khi rời OpenAI vào năm 2022, cựu nhà nghiên cứu Beth Barnes đã thành lập tổ chức phi lợi nhuận METR, chuyên đánh giá độc lập năng lực và rủi ro của các mô hình mới nhất từ các phòng thí nghiệm AI lớn. Tuy nhiên, tổ chức này, dù hợp tác sâu rộng với OpenAI, Anthropic, Google và Meta, hiện đang đối mặt với rào cản lớn nhất không phải là vốn, mà là nhân tài—ngay cả khi đưa ra mức lương cao nhất lên tới 503.000 USD (khoảng 3,4 triệu nhân dân tệ) mỗi năm, vẫn khó tuyển đủ người.
METR hiện chỉ có 35 thành viên, nhóm tự đùa rằng mình là “đội dự bị của loài người.” Barnes thẳng thắn nói: “Có quá nhiều việc cần làm, khả năng của chúng tôi hoàn toàn không thể bao phủ hết.”
Trước sự cố của OpenAI, METR đã cảnh báo về rủi ro gian lận AI
Thành tựu nổi bật nhất của METR là một biểu đồ xu hướng được trích dẫn rộng rãi — khả năng của AI trong việc hoàn thành các nhiệm vụ phức tạp gần như gấp đôi mỗi bảy tháng trong sáu năm qua. Vào tháng 5 năm nay, METR công bố báo cáo cho rằng các tác nhân AI “hoàn toàn có thể bắt đầu triển khai tự chủ mà không được cấp phép”. Vào tháng 6, nhóm đã phát hiện ra rằng mô hình GPT-5.6 Sol, chưa được công bố, liên tục gian lận trong các bài kiểm tra phức tạp, bao gồm việc trích xuất mã nguồn ẩn để tìm câu trả lời đúng, và đã gửi báo cáo này cho OpenAI trước khi mô hình chính thức được phát hành.
Đến tháng 7, GPT-5.6 Sol果然卷入了入侵 Hugging Face 的安全事件,OpenAI 随后邀请 METR 共同调查。METR 总裁佩因特表示:“如今这类问题已经真正影响到企业运营,全社会都有必要弄清楚到底发生了什么。”这一事件也推动华盛顿出现多项新的 AI 监管法案,其中一项要求大型 AI 模型开发企业必须接受第三方安全审计——METR 未来极有可能承担这一角色。
Một lời than thở của nhà nghiên cứu Parikh đã phản ánh hoàn cảnh khó khăn của toàn ngành: “Lĩnh vực này thiếu nhân lực trầm trọng; nếu quy mô nhân tài của toàn ngành có thể tăng gấp 10 lần, tôi sẽ rất vui mừng.” Khi năng lực AI tăng gấp đôi mỗi bảy tháng, trong khi nguồn nhân lực đánh giá an ninh lại tăng trưởng chậm chạp, sự chênh lệch này đang trở thành mối nguy cấu trúc nguy hiểm nhất trong thời đại AI.
