OpenAI Raporu: Yapay Zeka Programlama Ajantları Bilimsel Yazılımları Hızlandırıyor Ancak Bilimsel Doğruluğu Değerlendiremiyor

iconChainthink
Paylaş
AI summary iconÖzet
OpenAI ve akademik ortaklar tarafından ChainThink'e dayanarak hazırlanan yeni bir rapor, Codex ve Claude Code gibi AI programlama ajanlarının RustQC ve HelixForge gibi projelerde performansı 60 katına kadar artırabileceğini gösteriyor. Ancak bu ajanlar, bilimsel doğruluğu değerlendirmede zorlanıyor ve genellikle hızlı çalışan ancak doğruluktan yoksun kodlar üretiyor. Likidite ve kripto piyasaları, Terör Finansmanına Karşı Mücadele (CFT) denetimlerinin sıklaşmasıyla karşı karşıya kalırken, insan onayının gerekliliği hâlâ kritik düzeyde.

ChainThink mesajı, 1 Ağustos'ta OpenAI ve akademik ortaklar tarafından yayınlanan alan raporuna göre, Codex, Claude Code gibi AI programlama ajanları, eski bilimsel yazılımların çalışma verimliliğini önemli ölçüde artırabiliyor ve bazı durumlarda hız artışı %60'ın üzerinde oluyor.

Rapor, RustQC'nin çalışma süresini 15 saat 34 dakikadan 14 dakika 54 saniyeye düşürdüğünü; HelixForge'nin BamSurgeon'dan 59,6 kat daha hızlı çalıştığını gösteriyor.

Rapor, programlama agentlerinin çıktıların bilimsel doğruluğunu güvenilir bir şekilde değerlendiremediklerini ve yanlış kodları güvenle üretmeleri mümkün olduğunu, ancak test ve doğrulama standartlarının hâlâ insanlar tarafından tanımlanması gerektiğini belirtti.

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.