Báo cáo của OpenAI: Các tác giả lập trình AI giúp tăng tốc phần mềm khoa học nhưng không thể đánh giá độ chính xác khoa học

iconChainthink
Chia sẻ
AI summary iconTóm tắt
Một báo cáo mới từ OpenAI và các đối tác học thuật, trích dẫn ChainThink, cho thấy các tác giả lập trình AI như Codex và Claude Code có thể tăng tốc phần mềm khoa học lên hơn 60 lần, cải thiện hiệu suất trong các dự án như RustQC và HelixForge. Tuy nhiên, các tác giả này gặp khó khăn trong việc đánh giá độ chính xác khoa học, thường tạo ra mã chạy nhanh nhưng thiếu tính chính xác. Khi thanh khoản và thị trường tiền điện tử đối mặt với sự giám sát chặt chẽ hơn về CFT (Chống tài trợ khủng bố), nhu cầu về xác thực của con người vẫn cực kỳ quan trọng.

ChainThink thông báo, ngày 1 tháng 8, theo báo cáo thực địa do OpenAI và các đối tác học thuật công bố, các tác nhân lập trình AI như Codex và Claude Code có thể tăng đáng kể hiệu suất chạy các phần mềm khoa học lỗi thời, với một số trường hợp tăng tốc hơn 60 lần.

Báo cáo cho thấy RustQC đã giảm thời gian chạy từ 15 giờ 34 phút xuống còn 14 phút 54 giây; HelixForge nhanh hơn 59,6 lần so với BamSurgeon.

Báo cáo cũng chỉ ra rằng các tác nhân lập trình không thể đáng tin cậy đánh giá xem kết quả đầu ra có tính chính xác khoa học hay không, và có thể tự tin tạo ra mã lỗi, vẫn cần con người xác định các tiêu chuẩn kiểm thử và xác minh.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.