تقرير OpenAI: تسرّع وكلاء برمجة الذكاء الاصطناعي تطوير البرمجيات العلمية لكن لا يمكنها تقييم الدقة العلمية

iconChainthink
مشاركة
AI summary iconملخص
تُظهر تقرير جديد من OpenAI وشركاء أكاديميين، مستشهدين بـ ChainThink، أن وكلاء البرمجة بالذكاء الاصطناعي مثل Codex وClaude Code يمكنهم تسريع البرمجيات العلمية بأكثر من 60 مرة، مما يحسن الأداء في مشاريع مثل RustQC وHelixForge. ومع ذلك، فإن هذه الوكلاء تواجه صعوبات في تقييم الدقة العلمية، وغالبًا ما تنتج أكوادًا تعمل بسرعة ولكنها تفتقر إلى الدقة. مع تزايد الرقابة المشددة على السيولة وأسواق التشفير من قبل CFT (مكافحة تمويل الإرهاب)، يظل التحقق البشري ضروريًا بشكل حاسم.

رسالة ChainThink، 1 أغسطس، وفقًا للتقرير الميداني الذي نشرته OpenAI وشركاؤها الأكاديميون، يمكن لوكيلات البرمجة بالذكاء الاصطناعي مثل Codex وClaude Code تحسين كفاءة تشغيل برامج البحث القديمة بشكل ملحوظ، مع تسريع بعض الحالات بأكثر من 60 مرة.

أظهر التقرير أن RustQC خفّض وقت التشغيل من 15 ساعة و34 دقيقة إلى 14 دقيقة و54 ثانية؛ بينما تعمل HelixForge أسرع بـ59.6 مرة مقارنة بـ BamSurgeon.

كما أشار التقرير إلى أن الوكلاء البرمجيين لا يستطيعون تحديد موثوقية الصواب العلمي للنتائج، وقد يُنتجون بثقة أكوادًا خاطئة، ولا يزال يتعين على البشر تحديد معايير الاختبار والتحقق.

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.