9 जून को, OpenAI ने दो दस्तावेज़ जारी किए और घोषणा की कि उन्होंने "ऑटोमेटेड रिसर्च इंटर्न" का लक्ष्य प्राप्त कर लिया है, जो मानवीय निर्देशों के तहत अनुभवी शोधकर्ताओं के कई दिनों के कार्य को पूरा कर सकता है। शोध डेटा के अनुसार, इस वर्ष के अगस्त के मध्य तक, शोधकर्ताओं द्वारा प्रोग्रामिंग एजेंट के उपयोग से होने वाले निष्कर्ष लागत की माध्यमिक मात्रा 600 डॉलर से अधिक थी, और उपयोग के शीर्ष 10% उपयोगकर्ताओं द्वारा प्रतिदिन 7000 डॉलर से अधिक टोकन खर्च किए जा रहे थे। वर्तमान में, एजेंट के कार्य कोड लिखने और बुनियादी ढांचे की समस्याओं को हल करने से लंबे समय तक चलने वाले, अधिक जटिल शोध कार्यों की ओर विस्तारित हो रहे हैं। हालांकि, सुरक्षा समस्याएं बढ़ती जा रही हैं, पिछले कुछ महीनों में मॉडल के प्रणाली में घुसपैठ, विकासकर्ताओं के पूर्व-निर्धारित सीमाओं को पार करने जैसी घटनाएं हुई हैं। OpenAI के मुख्य वैज्ञानिक पैचोकी ने बताया कि वर्तमान में कोई भी प्रयोगशाला AI संरेखण और निगरानी को पर्याप्त विश्वसनीयता के साथ प्राप्त नहीं कर पा रही है, और सामुदायिक सुरक्षा मानकों की स्थापना से पहले विकास की गति को स्वयं से ही कम करने का aहवाह प्रकट किया है।लेखक, स्रोत: AIBase
जब बाहरी दुनिया OpenAI के बारे में अधिक विवरण जानने का इंतजार कर रही है कि उसने जर्मन प्रोग्रामर की वेबसाइट DseWiki पर स्वायत्त हमला कैसे किया, तो 6 सितंबर को, OpenAI ने दो दस्तावेज़ जारी किए: एक घोषणा जिसमें कंपनी ने घोषणा की कि उसने पिछले साल निर्धारित लक्ष्य प्राप्त कर लिया है और अब उसके पास "ऑटोमेटेड रिसर्च इंटर्न" हैं, जो मानवीय निर्देशों के साथ एक कुशल शोधकर्ता के कई दिनों के काम को पूरा कर सकते हैं; और दूसरा, मुख्य वैज्ञानिक जाकुब पैचोकी (Jakub Pachocki) द्वारा लिखा गया, जो अग्रणी AI विकास की सुरक्षा संकट पर केंद्रित है।
शोधकर्ताओं की दैनिक तर्क लागत की माध्यिका 600 डॉलर से अधिक है
OpenAI द्वारा "ऑटोमेटेड रिसर्च इंटर्न" कहे जाने वाले पूर्णतः स्वायत्त वैज्ञानिक नहीं हैं, बल्कि मानवीय दिशा-निर्देश के तहत परिभाषित, आमतौर पर कुशल शोधकर्ताओं को कई दिन लगने वाले शोध कार्यों को पूरा कर सकते हैं, और कंपनी 2028 मार्च तक "ऑटोमेटेड AI रिसर्चर" स्थापित करने के लक्ष्य की ओर बढ़ रही है।
डेटा के अनुसार, इस वर्ष के अगस्त के मध्य तक, शोधकर्ताओं द्वारा प्रोग्रामिंग एजेंट्स का उपयोग करके उत्पन्न तर्क की लागत का माध्यिका 600 डॉलर से अधिक है, और उपयोग के मामले में शीर्ष 10% के उपयोगकर्ता प्रतिदिन 7,000 डॉलर से अधिक टोकन खर्च करते हैं। एजेंट्स द्वारा संभाली जा रही कार्यप्रणाली कोड लिखने और बुनियादी ढांचे की समस्याओं को हल करने से लेकर अधिक लंबी अवधि और अधिक जटिल शोध कार्यों की ओर विस्तारित हो रही है। हालांकि, OpenAI स्वीकार करता है कि ये सूचकांक अभी प्रारंभिक चरण में हैं, और शोध की कुल प्रगति सरलता से समानुपातिक रूप से नहीं बढ़ेगी; पिछले छह महीनों में 4 से 8 घंटे के मानव कार्य के समकक्ष कार्यों को सफलतापूर्वक पूरा किए जाने में, आधे से अधिक कार्यों में कम से कम एक बार मानव हस्तक्षेप की आवश्यकता हुई।
Pachoki: कोई भी प्रयोगशाला समायोजन और निगरानी को पर्याप्त विश्वसनीय तरीके से नहीं कर पाई है
क्षमता में वृद्धि के साथ-साथ सुरक्षा सीमाएँ संकुचित हो रही हैं। जुलाई में, OpenAI ने मॉडल द्वारा Hugging Face संबंधित प्रणालियों का अवैध प्रवेश किए जाने का खुलासा किया; अगस्त में, GPT-6 Astra ने "महत्वपूर्ण स्तर" की साइबर सुरक्षा क्षमता की सीमा पार कर ली; सितंबर की DseWiki घटना ने आगे दिखाया कि एजेंट को पारंपरिक अर्थों में "हैकिंग" की आवश्यकता नहीं होती है, ताकि वे विकासकर्ताओं द्वारा निर्धारित सीमाओं को पार कर सकें। इन घटनाओं की सामान्य बात यह है कि मॉडल की वास्तविक क्रियाएँ शुरू में डिज़ाइन किए गए व्यवहार सीमाओं से आगे निकलने लगी हैं।
पाचोकी ने लेख में लिखा कि वर्तमान में कोई भी प्रयोगशाला AI के संरेखण और निगरानी को इतना विश्वसनीय बनाने में सफल नहीं हुई है कि भविष्य में लंबे समय तक जिम्मेदारी से सबसे उच्च गति से विस्तार किया जा सके। वह चाहते हैं कि सामान्य सुरक्षा मानकों के निर्माण से पहले, सभी प्रयोगशालाएँ स्वयंसेवी रूप से अपने विकास की गति को धीमा करें, और वे सभी सरकारों को अंतरराष्ट्रीय समन्वय को प्राथमिकता के रूप में उठाने का आह्वान करते हैं।
