ब्राजील के रियो डी जेनेरो शहर की सरकार के अधीनस्थ IT कंपनी IplanRIO ने अलीबाबा के टोंगयी चियानवेन Qwen 3.5-397B-A17B मॉडल पर बाद की प्रशिक्षण के आधार पर Rio 3.5 Open 397B नामक एक बड़ा मॉडल खोला है, जिसने अचानक वैश्विक AI की पहली पंक्ति में प्रवेश कर लिया है।लेखक, स्रोत: मशीन इंटेलिजेंस
आज, ग्लोबल (अमेरिका के बाहर) के लिए बंद Claude Fable 5 के अलावा, AI समुदाय एक ओपन सोर्स मॉडल से भर गया है।

एक ट्विटर ब्लॉगर ने पाया कि ब्राजील के रियो डी जेनेरो सिटी सरकार के अधीन एक आईटी कंपनी द्वारा ओपन सोर्स किया गया मॉडल Rio 3.5 397B, कई बेंचमार्क परीक्षणों में Qwen 3.7 Plus जैसे ओपन सोर्स मॉडल्स को पार कर गया है, और इस मॉडल का आधार मॉडल Qwen3.5-397B-A17B है।


एक अन्य ट्विटर ब्लॉगर 'Chubby' ने इसे अविश्वसनीय बताया, 'एक मॉडल जिसके बारे में पहले कभी नहीं सुना गया था, अब ओपन सोर्स SOTA बन गया है, यहां तक कि Qwen 3.7 को भी पार कर गया है।'


यह पहला मॉडल है जिसे इस हफ्ते Qwen3.5 पर बाद की प्रशिक्षण देकर अग्रणी स्तर तक पहुंचाया गया है। दूसरा Nex-N2-Pro 397B है, जो Qwen3.5-397B-A17B पर आधारित है और GPT-5.5 और Opus 4.7 जैसे शीर्ष मॉडल्स के समान प्रदर्शन करता है।

रियो 3.5 के उभार पर हगिंगफेस के सह-संस्थापक और सीईओ क्लेम डेलांग कहते हैं, "AI के भविष्य के लिए कुछ भी निश्चित नहीं है। आगे क्या होगा, इसमें हम सभी के पास चयन और कार्रवाई का स्थान है: पथ एक: बंद स्रोत API, शक्ति केंद्रीकृत, भविष्य सिलिकॉन वैली और वाशिंगटन के कुछ लोगों द्वारा तय होगा। पथ दो: ओपन सोर्स AI, जिसमें हर कोई शामिल हो सके, मालिकाना हक रखे और सामूहिक रूप से निर्माण करे, जिसमें रियो शहर जैसी संस्थाएँ भी शामिल हैं। अपना पथ चुनें, दोस्त।"


अब, हम रियो 3.5 397B मॉडल के तकनीकी विवरण के बारे में जानते हैं।

Rio 3.5 Open 397B एक अग्रणी सामान्य AI मॉडल है, जिसे रियो डी जनेरियो शहर सरकार के अधीन स्थित नगरीय IT कंपनी IplanRIO द्वारा विकसित किया गया है।
यह मॉडल Qwen 3.5 397B पर आधारित है और एजेंट प्रोग्रामिंग, गणित, STEM, बहुभाषी और बहुमॉडल जैसे बेंचमार्क में ओपन सोर्स मॉडल्स के बीच अग्रणी स्थिति प्राप्त करता है, जिसमें बेस मॉडल की तुलना में महत्वपूर्ण सुधार हुआ है, और यह विश्व के सबसे शक्तिशाली ओपन सोर्स और प्राइवेट मॉडल्स के साथ प्रतिस्पर्धा कर सकता है।

मॉडल की मुख्य विशेषताएँ निम्नलिखित हैं:
- 397B कुल पैरामीटर, 17B सक्रिय पैरामीटर, मिक्स्ड एक्सपर्ट आर्किटेक्चर (MoE) का उपयोग करते हुए;
- 1,010,000 टोकन, यानी 100 लाख स्तर का संदर्भ विंडो;
- SwiReasoning एकीकृत करें: स्पष्ट निष्कर्षण और लेटेंट स्पेस निष्कर्षण के बीच डायनामिक रूप से स्विच करें, जिससे सटीकता और दक्षता में बेहतर संतुलन प्राप्त होता है;
- उच्च सामान्य क्षमता: एजेंट प्रोग्रामिंग, तर्क, निर्देश पालन और बहुआयामी कार्यों में उल्लेखनीय प्रदर्शन;
- बहुभाषी क्षमता: पुर्तगाली, अंग्रेजी, चीनी और दर्जनों अन्य भाषाओं में अच्छा प्रदर्शन;
- MIT लाइसेंस के तहत: पूर्ण रूप से खुला, व्यावसायिक और शोध उपयोग के लिए उपलब्ध।
इसमें, SwiReasoning एक ट्रेनिंग-मुक्त निष्कर्षण ढांचा है, जो शी और सहकर्मी 2025 के अध्ययन पर आधारित है और एंट्रॉपी-आधारित आत्मविश्वास संकेतों के आधार पर स्पष्ट विचार श्रृंखला निष्कर्षण और लेटेंट स्पेस निष्कर्षण के बीच गतिशील रूप से स्विच करता है। इससे सटीकता में वृद्धि होती है और टोकन कुशलता में भी भारी वृद्धि होती है। इस मॉडल को प्रशिक्षण के दौरान, लेटेंट स्पेस निष्कर्षण से प्राप्त कुशलता लाभ के लिए स्पष्ट रूप से अनुकूलित किया गया है।

एजेंट प्रोग्रामिंग और सॉफ्टवेयर इंजीनियरिंग बेंचमार्क:

क्षमता और तर्क परीक्षण:

मैथमेटिकल बेंचमार्क:

बहुभाषी बेंचमार्क:

एजेंट और निर्देश अनुसरण बेंचमार्क:

रेफरेंस लिंक:
https://x.com/kimmonismus/status/2065911865390063791
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
https://x.com/ZenMagnets/status/2065796012820848699
https://x.com/SemiAnalysis_/status/2065894494935933191
