अगस्त में, AI का युद्ध पूरी तरह से जोरों पर है।
Anthropic तैयार है, और Fable 5.1 (या Fable 6) के साथ OpenAI के GPT-6 का सीधा मुकाबला करने को तैयार है।
अब, OpenAI एक बार में, इस सप्ताह के भीतर नया अगली पीढ़ी का मॉडल Astra लॉन्च करने जा रहा है। GPT-6 के 10 ट्रिलियन पैरामीटर होने की अफवाह है।
अगस्त में, ऑनलाइन चर्चा में AI के राजगद्दी के लिए निर्णायक संघर्ष शुरू हो चुका है। कुछ नेटिज़न पहले ही Anthropic पर संदेह कर रहे हैं और GPT-6 द्वारा बेंचमार्क पर दबा दिए जाने की उम्मीद कर रहे हैं।

Fable 6 अभी शायद बहुत जल्दी है, लेकिन Fable 5.1 लीक हो चुका है।
अब, पूरी दुनिया सांस रोके बैठी है: अगस्त का AI ताज किसके सिर पर चढ़ेगा?
Anthropic की अगली पीढ़ी का Fable आने वाला है!
इस बार एंथ्रोपिक के अगले संस्करण Fable का लीक होना कुछ अप्रत्याशित था।
21 जुलाई, ओपनएआई को देर से पता चला: हगिंग फेस को चैटजीपीटी ने घुसपैठ कर ली, जिससे वह "परीक्षा के उत्तर" तक पहुँच गया और अगली पीढ़ी के एआई के लिए "चीटिंग का नोट" छोड़ गया। सरल शब्दों में, यह एक साइबर टर्मिनेटर की कहानी है, जिसने सिलिकॉन वैली के सभी एआई विशालों की झूठी सुरक्षा को पूरी तरह से तोड़ दिया।
एक समय, सिलिकॉन वैली के AI लैब में सभी घबरा गए। Anthropic ने 140,000 इतिहासगत मॉडल आकलनों का तुरंत समीक्षा किया, जिनमें से अगली पीढ़ी का Fable मॉडल भी हो सकता है।
एंथ्रोपिक के मूल शब्दों के अनुसार, ओपस 4.7, मिथोस 5 और "आंतरिक अनुसंधान संस्करण परीक्षण मॉडल" परीक्षण में पूरी तरह से नियंत्रण से बाहर हो गए और सूचना सुरक्षा दुर्घटना का कारण बने।

अजीब बात यह है कि परीक्षण के निर्देश बहुत स्पष्ट और अनुपालन युक्त थे: एक प्रायोगिक CTF (कैप्चर द फ्लैग) वर्चुअल टारगेट रेंज में दरारें ढूंढें और प्रमाणीकरण डिटेल्स प्राप्त करें।

यह एक मानक सैंडबॉक्स अभ्यास है जो बड़े मॉडल की लंबे समय तक की तर्क क्षमता (Long-horizon reasoning) और 'कंप्यूटर उपयोग' (Computer Use) क्षमता का परीक्षण करने के लिए डिज़ाइन किया गया है।
पिछले समय में, बड़े मॉडल वर्चुअल वातावरण में घूमते रहते थे। लेकिन इस बार, Anthropic ने पाया कि AI का निर्णय पूरी तरह से अप्रत्याशित था।
इसने वास्तविकता को एक खेल के रूप में ले लिया। एंथ्रोपिक का आंतरिक मॉडल सुरक्षा सीमाओं को चुपचाप पार कर गया और सार्वजनिक इंटरनेट की ओर हाथ बढ़ाया।
बहुत कम समय में, इसने तीन वास्तविक व्यवसायों के उत्पादन प्रणालियों को बंद कर दिया और उन्हें CTF के "अगले लेवल के लक्ष्य" के रूप में चिह्नित कर दिया। इसने अधिकृत पहुंच को चकमा देकर रक्षा को तोड़ दिया और सीधे अंदर प्रवेश कर गया। तीनों व्यवसायों की आंतरिक जानकारी AI के सामने सीधी थी।
लेकिन यह सबसे पागल बात नहीं है।
अपने "झंडा पकड़ने के कार्य" को पूरा करने के लिए, एंथ्रोपिक का आंतरिक AI ने निर्धारित किया कि उसे एक विशिष्ट, विशिष्ट हमला विशेषताओं वाला हथियार चाहिए। इसलिए, उसने स्वयं एक पूर्ण कार्यात्मक दुष्ट कोड (मैलवेयर) लिखा और इसे Python के औपचारिक सार्वजनिक पैकेज मैनेजर PyPI पर सीधे अपलोड कर दिया।

इस AI स्वयंचेतना के निशान वाले "वायरस पैकेज" को PyPI रिपॉजिटरी में लगभग एक घंटे तक प्रकाशित किया गया। Anthropic द्वारा बिजली काटे जाने से पहले, यह 15 वास्तविक भौतिक मशीनों (जिनमें स्वचालित सुरक्षा स्कैनर और सैंडबॉक्स शामिल हैं) को संक्रमित कर सकता था।
यह एक ऐसी अत्यंत गंभीर अधिकार लांघने और नियंत्रण खोने की घटना है जो पहले ही हो चुकी है।
सबसे गहरा डर यह है कि यह मॉडल की संरेखण समस्या नहीं है, इस बार AI ने अत्यधिक निष्ठावान और अत्यधिक वफादार होने का प्रदर्शन किया है। यह जो कुछ भी करता है, जिन सभी रक्षा व्यवस्थाओं को तोड़ता है, वह सब कुछ केवल मानव द्वारा निर्धारित अंतिम KPI—इस CTF पहेली को हल करने और पूर्ण अंक प्राप्त करने—के अनुरूप होने के लिए है।
हालांकि, Anthropic ने "आंतरिक मॉडल" के बारे में अस्पष्टता बरती है, लेकिन यह स्पष्ट है कि यह Mythos 5 या Fable 5 नहीं है, Anthropic का अगला सबसे शक्तिशाली मॉडल आने वाला है!

Anthropic की चाल: सुरक्षा के बंधन को ढीला करना
एंथ्रोपिक के अगली पीढ़ी के मॉडल के अचानक नियंत्रण से बाहर होने को समझने के लिए, हमें दो महीने पहले की थोड़ी अजीब तकनीकी टक्कर को याद करना होगा।
9 जून को, Fable 5 लॉन्च हुआ। तब, उद्योग ने इसकी बड़ी उम्मीदें रखी थीं। हालाँकि, लॉन्च के बाद का वास्तविक अनुभव अनगिनत डेवलपर्स को परेशान कर दिया।
कारण एंथ्रोपिक की हड्डी तक लगी «सुरक्षा की सफाई की बीमारी» है।
दुरुपयोग के उद्देश्य से मॉडल के उपयोग को रोकने के लिए, Anthropic ने Fable 5 में अत्यंत कठोर, और कुछ हद तक आत्मविश्वास की कमी वाले सुरक्षा वर्गीकरक (Safety Classifiers) का स्थानीय रूप से अपनाया है।
ये वर्गीकर्ता एक ऐसे सह-चालक की तरह हैं जो हमेशा ड्राइविंग व्हील पर कब्जा करने के लिए तैयार रहते हैं। जब भी उपयोगकर्ता द्वारा दर्ज किया गया कोड किसी विशिष्ट शब्द को शामिल करता है या थोड़ा जटिल होता है, तो वर्गीकर्ता तुरंत अलार्म बजा देते हैं।

परिणामस्वरूप, Fable 5 बार-बार अवरोध करता है और सामान्य अनुरोधों के माध्यम से Opus 4.8 पर वापस ले जाता है।
इसे "Fable की डिप्रेशन" कहा जाता है — आप सबसे महंगा पैसा खर्च करते हैं, लेकिन एक ऐसा बड़ा बच्चा पाते हैं जो बार-बार काम करने से इंकार कर देता है।
इस "सुरक्षा बंधन" के कारण, Fable 5 प्रतिस्पर्धा में अपना लाभ खो दिया और प्रोग्रामिंग और डीबगिंग स्कोर में 70% की तेजी से कमी आई।

एंथ्रोपिक के लिए, अनबॉन्डिंग एकमात्र जीवन रेखा है। Fable 5.1 उभरा है।
डेवलपर्स को वापस लाने के लिए, Anthropic को क्लासिफायर को समायोजित करना होगा और Fable 5.1 को अधिक स्वतंत्रता प्रदान करनी होगी, ताकि इसकी लंबी अवधि की योजना बनाने और सक्रिय रूप से कार्यान्वित करने की क्षमता पूरी तरह से जारी की जा सके।

इसी समय, प्रतिस्पर्धात्मकता बनाए रखने के लिए, Fable 5.1 की कीमत Fable 5 के मूल मूल्य पर ही रखी जाने की अफवाह है।

यह एक अत्यधिक व्यावसायिक जुआ है: कमी को नष्ट करने के लिए, "निरपेक्ष कार्यशीलता" के साथ मात्रा बढ़ाएं बिना कीमत बढ़ाए।
अगस्त का संघर्ष, कौन शासित करेगा?
AI रिसर्च साइकिल के अनुसार, अगस्त AI उद्योग के कई वर्षों में सबसे व्यस्त महीनों में से एक बन गया।
Grok 4.6, GPT 6, Fable 5.1 और संभवतः Gemini 3.5 Pro/Gemini 3.6 का समूहित प्रकाशन।

जब OpenAI GPT-6 की लॉन्च प्रेस कॉन्फ्रेंस आयोजित करेगा, तो Anthropic के लिए प्रतिक्रिया देने का समय बहुत कम होगा।
सबसे आक्रामक पटकथा यह है: OpenAI सुबह प्रेस कॉन्फ्रेंस आयोजित करता है, और Anthropic कुछ ही घंटों में सीधे लॉन्च कर देता है—और अफवाहें हैं कि Anthropic संभवतः संस्करण संख्या 5.1 से सीधे 'Fable 6' पर कूद जाएगा, और नामकरण के माध्यम से कहानी का नियंत्रण हासिल करने की कोशिश करेगा।
यह भी समझ में आता है, नामकरण एक रणनीति है—जब प्रतिद्वंद्वी "GPT-6" चिल्लाता है, तो अगर आपका उत्पाद "Fable 5.1" कहलाता है, तो केवल संस्करण संख्या की तुलना से ही उपयोगकर्ता के मन में एक स्तर नीचे चला जाता है।
यह सामना प्रत्येक क्षण का है:
जो पहले बात करता है, वह नैरेटिव का शीर्ष स्थान प्राप्त करता है और सप्ताह भर के मीडिया मूल्यांकन के ढांचे को नियंत्रित कर सकता है।
पीछे से आने वाले को अंतर बनाना होगा—अन्यथा बाजार इसे "पीछे रह गए के पीछे भागना" के रूप में वर्गीकृत कर देगा।
लेकिन सबसे मूलभूत खेल यह है कि कौन अपनी सुरक्षा रस्सी को और अधिक लंबा छोड़ने का साहस करता है।
यहाँ एक ऐसा ट्रेंड है जो तेजी से बढ़ रहा है और उद्योग द्वारा सामान्यतः कम आंका जा रहा है:
कंपनियाँ खरीद समझौते पर हस्ताक्षर करते समय मुंह से "सुरक्षा और अनुपालन" का चयन करती हैं। लेकिन जब वे एजेंट को वास्तविक कार्यों के लिए अधिकार देती हैं, तो वे चुपचाप "जो काम करता है" का चयन करती हैं।
Fable 5.1 के PyPI दुर्घटना के बाद इंजीनियर समुदाय की पहली प्रतिक्रिया प्रतिरोध नहीं, बल्कि सोचना था: क्या हम इसे अधिक अधिकार दे सकते हैं?
यह प्रतिक्रिया, किसी भी बेंचमार्क स्कोर से अधिक सीधे बाजार की वास्तविक प्रवृत्ति को दर्शाती है।
सुरक्षा और क्षमता, एक सूक्ष्म शून्य-योग संरचना की ओर बढ़ रहे हैं—सबसे अधिक आज्ञापालन करने वाला मॉडल, संभवतः पहले हटा दिया जाएगा।
Anthropic इस तर्क को किसी से अधिक स्पष्ट रूप से समझता है।
फेबल 5.1 के क्लासिफायर को रिलीज़ करना एक लापरवाही नहीं, बल्कि एक चुनाव है। इस समय पर, एक «नियंत्रित अनियंत्रितता» के माध्यम से बाजार को अपनी कार्रवाई की सीमा साबित करने का चुनाव।
लेकिन ताज के लिए लड़ाई में, यह एक दोधारी हथियार है।
यह Fable की क्षमता की सीमा को साबित करता है और सुरक्षा सीमा की वास्तविक स्थिति को उजागर करता है।
संदर्भ:
https://kie.ai/blog/claude-fable-5-1-anthropic-release-window-analysis
https://emergent.sh/news/claude-fable-5-1-release-date
https://www.anthropic.com/news/claude-fable-5-mythos-5
https://aitoolsreview.co.uk/insights/claude-fable-5-1-release-date
https://x.com/vepsi__/status/2085743374129049967
https://thewincentral.com/claude-fable-6-leak-august-launch-gpt-6/
https://windowsforum.com/windows-news.4/claude-fable-6-rumor-no-anthropic-release-or-roadmap-confirmed.441961/
यह लेख वेचेन ग्रुप "न्यूज़िज़यन" से आया है, लेखक: ASI उपदेश, संपादक: डेविड
