OpenAI 報告:AI 程式設計代理加速科學軟體開發,但無法評估科學準確性

iconChainthink
分享
AI summary icon精華摘要
OpenAI 與學術夥伴根據 ChainThink 發布的一份新報告顯示,像 Codex 和 Claude Code 這樣的 AI 編程代理可將科學軟體的速度提升超過 60 倍,改善了 RustQC 和 HelixForge 等項目的性能。然而,這些代理在評估科學準確性方面存在困難,經常產生運行速度快但缺乏正確性的代碼。隨著流動性與加密貨幣市場面臨更嚴格的 CFT(打擊資助恐怖主義)監管,人為驗證的需求依然至關重要。

ChainThink 消息,8 月 1 日,據 OpenAI 與學術夥伴發布的實地報告,Codex、Claude Code 等 AI 編程智能體可顯著提升老化科研軟體運行效率,部分案例提速超過 60 倍。

報告顯示,RustQC 將運行時間從 15 小時 34 分降至 14 分 54 秒;HelixForge 的運行速度較 BamSurgeon 快 59.6 倍。

報告同時指出,編程智能體無法可靠判斷輸出結果是否具備科學正確性,且可能自信生成錯誤代碼,仍需由人類定義測試與驗證標準。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露