GPT-6, जिसमें 10 ट्रिलियन पैरामीटर हैं, इस महीने जारी किए जाने वाले हैं!
बिल्कुल अभी, X पर एक बड़ी खबर आई है।
AI इन्साइडर क्रिसGPT ने खुलासा किया कि सरकारी जांच के दबाव के बावजूद, GPT-6 (Astra) का जुलाई में लॉन्च होगा।

GPT-6, जो कल OpenAI द्वारा तत्काल प्रकाशन से रोका गया मॉडल Astra है।
9 महीने पहले, OpenAI ने बल लगाया और कंप्यूटिंग संसाधनों को पुनर्वितरित किया। जब उन्हें एंथ्रोपिक को प्री-ट्रेनिंग में आगे होने का एहसास हुआ, तो OpenAI घबरा गया!

अनुमानित रूप से GPT-4 के पैरामीटर लगभग 1.8 ट्रिलियन हैं। यदि Astra के पैरामीटर वास्तव में 10 ट्रिलियन हैं, तो यह GPT-4 से पांच गुना से अधिक है।
किसी भी तरह, OpenAI ने प्री-ट्रेनिंग पर अभूतपूर्व पैमाने पर निवेश किया है।
धीरे करें, अभी और बड़े खिलाड़ी आ रहे हैं।
क्रिसजीपीटी द्वारा दूसरा उजागर किया गया, वर्ष के अंत का 'एपिक बीस्ट' जिसका कोडनाम डग है।
यह केवल OpenAI द्वारा अब तक का सबसे बड़ा प्री-ट्रेन्ड मॉडल नहीं है, बल्कि इसे ऐसा भी कहा जाता है कि यह Fable को एक प्रारंभिक उत्पाद जैसा लगने देता है।
और यह GPT-6 नहीं है।
लेकिन इस मॉडल को पहले प्री-ट्रेन किया जाना चाहिए, फिर बड़ी मात्रा में साइबर सुरक्षा परीक्षण किए जाने चाहिए, इसलिए यह नवंबर से पहले जारी हो सकता है।


दिलचस्प बात यह है कि हाल ही में, OpenAI के अध्यक्ष ग्रेग ने एक X पोस्ट को रीट्वीट किया—
GPT-4, जिसका प्रशिक्षण चार साल पहले, 8 अगस्त को पूरा हुआ था।

उद्योग में अनुमान है कि GPT-4 के पैरामीटर 1.8 ट्रिलियन थे, चार साल बाद, GPT-6 के पैरामीटर अचानक दस ट्रिलियन तक पहुंच गए, जिससे संख्यात्मक रूप से एक भयानक कूद हुई!
अनुमान लगाया जा सकता है कि GPT-6 अअनुमानित तर्कसंगतता और सामान्यीकरण क्षमता को प्रकट करेगा।
वर्ष के अंत का अंतिम विशालकाय Doug:
Fable 5 को "प्राचीन मानव" के रूप में वर्णित करें
Doug नाम का उल्लेख केवल ChrisGPT द्वारा ही नहीं, बल्कि पहले ही प्रसिद्ध संस्था SemiAnalysis द्वारा भी किया गया था।
लीक की गई जानकारी के अनुसार, डॉग का हैशरेट बेस अत्यंत शानदार है।
एडवांस्ड इनफॉर्मेशन विज़र्ड पंकज कुमार ने बताया कि डग ने शायद नाइविडिया के अभी तक पूरी तरह से लॉन्च नहीं हुए अगली पीढ़ी के वेरा रुबिन चिप का उपयोग किया है!

समग्र रूप से, OpenAI एक बड़ी चाल खेल रहा है।
अगस्त में, पहले 10 ट्रिलियन GPT-6 के साथ धमाका करें, उपयोगकर्ताओं को आकर्षित करें; साल के अंत तक, डग को जारी करें, और अब अपने आप को नंबर वन पर स्थापित करें।

Boris के साथ लड़ रहा Tibo भी आश्चर्यजनक बात का अनुमान लगा रहा है
अगस्त, ASI का निर्णायक संघर्ष
और 2026 के जुलाई में, कई स्रोतों ने दावा किया कि OpenAI का आगामी अगली पीढ़ी का मॉडल एक नया प्री-ट्रेनिंग बेस (पिछले लगभग 4T टोकन के 'Spud' से आगे) का उपयोग करेगा, जिसका आकार लगभग 10T होगा और संदर्भ 1.5M टोकन तक पहुँच सकता है, जो Anthropic के Mythos/Fable के साथ प्रतिस्पर्धा करेगा।
अब स्थिति स्पष्ट है: सुरक्षा निलंबन के कारण एस्ट्रा का लॉन्च समय टाल दिया गया है, लेकिन एंथ्रोपिक प्रतीक्षा नहीं करने जा रहा है।
Anthropic 8 में Fable 5.1 लॉन्च करने की तैयारी कर रहा है, जिसकी कीमत Fable 5 के बराबर होगी और यह सीधे Astra का प्रतिस्पर्धी होगा।

एंथ्रोपिक संभवतः "तियान जी का घोड़े का दौड़" रणनीति अपना रहा है: ओपस 5 को जानबूझकर शक्ति बचाकर जारी किया गया है, ताकि फेबल 5.1 को एक छिपी हुई सेना के रूप में इस्तेमाल किया जा सके, और GPT-6 के आने के साथ ही तुरंत उसका सामना किया जा सके।
कौन बड़े मॉडल का राजा बनेगा? यह सवाल अगस्त में अभूतपूर्व रूप से तीव्र हो गया।
"प्री-ट्रेनिंग वॉल" को तोड़ें: OpenAI की जबरदस्त वापसी
डॉग क्यों इतना महत्वपूर्ण है?
क्योंकि यह पूरे उद्योग के सामने एक ऐसा सच रखता है जिसे कोई स्वीकार नहीं करना चाहता: 2024 में मई में GPT-4o के लॉन्च के बाद से, OpenAI ने अगली पीढ़ी के अग्रणी मॉडल की पूर्ण स्केल प्री-ट्रेनिंग पूरी नहीं की है।
o1, o3, GPT-5 से GPT-5.5 तक, सभी GPT-4o के आधार पर पोस्ट-ट्रेनिंग, रिइनफोर्समेंट लर्निंग और इन्फरेंस कॉम्प्यूटिंग कर रहे हैं। GPT का "इंजन" दो साल से बदला नहीं गया है।
भारी प्री-ट्रेनिंग बॉटलनेक के कारण, ओरियन जैसे प्रोजेक्ट्स को अपेक्षित प्रदर्शन के कारण डाउनग्रेड कर दिया गया है।
लेकिन! OpenAI ने कभी प्री-ट्रेनिंग को अपनी केंद्रीय रेखा के रूप में छोड़ा नहीं है।
पिछले साल के अंत में जारी किए गए Gemini 3 ने ऑटमैन को "इंजन" बदलने का निर्णय लेने के लिए पूरी तरह से प्रेरित कर दिया।
इसके तुरंत बाद, गार्लिक कोडनेम वाला एक नया प्री-ट्रेन्ड मॉडल सामने आया। जिसके अनुसार, मुख्य शोध अधिकारी मार्क चेन ने टीम को बताया कि कंपनी ने प्री-ट्रेनिंग में महत्वपूर्ण समस्याओं को हल कर लिया है।
लेकिन गार्लिक एक प्रमाणीकरण प्रयोग की तरह है, जबकि डग ही बड़े पैमाने पर विस्तारित वास्तविक उत्पाद है।
उन्होंने संभवतः प्रदर्शन अवक्षय की सीमा को दूर कर दिया और लाखों GPU के क्लस्टर की स्थिरता को सुनिश्चित किया, जिससे Doug का जन्म हुआ।
लंबे समय से, SemiAnalysis ने जोर देकर कहा है: स्केलिंग नियम अभी भी प्रासंगिक हैं।
o1 सीरीज प्रमाण: मॉडल "इन्फरेंस टाइम" पर निरंतर स्केलिंग कर सकता है।
और वापस आए डॉग ने घोषणा की: बेसिक 'प्री-ट्रेनिंग' आयाम पर, जब तक कैलकुलेशन पावर और डेटा के साथ चला जाए, स्केलिंग लॉज अभी भी चमत्कार पैदा कर सकते हैं!
तीन बड़ों में से केवल दो बचे हैं
अब, तीनों में से केवल दो बचे हैं।
5 अगस्त को, गूगल के AI के नक्शे का एक कोना ढह गया।
27 वर्षों तक मुख्य वैज्ञानिक के रूप में काम करने वाले जेफ डीन ने तीन मुख्य शोधकर्ताओं के साथ कार्यालय छोड़कर उद्यम शुरू किया। उसी दिन, नोबेल पुरस्कार विजेता हसबिस ने DeepMind के CEO पद से इस्तीफा दे दिया और अध्यक्ष के पद पर चले गए। Alphabet का शेयर उसी दिन 4% से अधिक गिर गया।
DeepMind, अब एक अग्रणी प्रयोगशाला नहीं है। Transformer का आविष्कार करने वाली जगह, अपने प्रतिद्वंद्वियों को शीर्ष शोधकर्ता प्रदान कर रही है।
हाल ही में, सिलिकॉन वैली में ASI के 'तीन बड़े' थे, अब सिर्फ OpenAI और Anthropic बचे हैं।
अब, Anthropic के पास Fable 5 है। OpenAI के पास लगातार अपडेट हो रहे 5.5, 5.6, और आगामी 6 हैं।
अब, OpenAI के पास दो कार्ड हैं: अगस्त का Astra और वर्ष के अंत का Doug।
पिछले दो वर्षों में, OpenAI ने साबित किया है कि पुराने इंजन से अभी भी कई अतिरिक्त घोड़े की शक्ति निकाली जा सकती है। जब इंजन का अपग्रेड होगा, तो इस पूरी सिस्टम, जिसे पहले से ही अधिकतम सीमा तक ट्यून किया गया है, कितनी तेजी से गाड़ी को आगे धकेल पाएगी?
इस उत्तर को वर्ष के अंत में डग जाहिर करेंगे।
संदर्भ:
https://x.com/ChrisGPT/status/2086220662264250764
https://newsletter.semianalysis.com/p/gemini-is-cooked-but-gcp-is-cooking
यह लेख वेचेन ग्रुप "न्यूज़िज़ियुएन" से है, लेखक: ASI अपोकैलिप्स, संपादक: एनियस सोलोमन
