OpenBMB का MiniCPM5-2B कम 4B पैरामीटर वाले खुले मॉडल्स में Artificial Analysis Index v4.2 पर शीर्ष स्थान पर है

iconCryptoBriefing
साझा करें
AI summary iconसारांश
OpenBMB का MiniCPM5-2B आर्टिफिशियल एनालिसिस इंटेलिजेंस सूचकांक v4.2 पर 15 अंक प्राप्त करता है और 4B पैरामीटर से कम ओपन मॉडल्स में पहले स्थान पर है। इस मॉडल का विकास Tsinghua विश्वविद्यालय के NLP लैब और ModelBest के साथ किया गया है, जो 512K टोकन कंटेक्स्ट विंडोज को सपोर्ट करता है और एज डिवाइसेस के लिए अनुकूलित है। ऑन-चेन विश्लेषण से पता चलता है कि हल्के AI समाधानों में रुचि बढ़ रही है। AI मॉडल अपनाने के लिए फियर एंड ग्रीड सूचकांक ऊपर की ओर बढ़ रहा है।

केवल 2 बिलियन पैरामीटर वाले मॉडल ने Artificial Analysis Intelligence Index v4.2 पर 4 बिलियन पैरामीटर से कम ओपन मॉडल्स के बीच शीर्ष स्थान हासिल किया है, जिसमें इसने 15 अंक प्राप्त किए हैं। OpenBMB का MiniCPM5-2B, जिसका निर्माण Tsinghua University के NLP लैब और ModelBest के सहयोग से किया गया है, फोन, लैपटॉप और अन्य ऐसे उपकरणों पर चलाने के लिए डिज़ाइन किया गया है, जहाँ परिगणन संसाधन एक विशेषता हैं, न कि एक दी गई बात।

बेंचमार्क वास्तव में क्या मापता है

Artificial Analysis ने 4 सितंबर, 2026 को अपना Intelligence Index संस्करण 4.2 जारी किया, जो MiniCPM5-2B के लॉन्च से तीन दिन पहले था। अपडेटेड सूचकांक में AI मॉडल्स के मूल्यांकन के तरीके में महत्वपूर्ण बदलाव किए गए।

निजी परीक्षण अब कुल वजन का 40% बन गए हैं, जो पिछले संस्करणों की तुलना में बढ़ गया है। इसका महत्व इसलिए है क्योंकि निजी परीक्षणों को धोखे से पार करना कठिन होता है। जब मॉडल विकासकर्ता परीक्षा के प्रश्नों को पहले से नहीं देख सकते, तो स्कोर सच्ची क्षमता के अधिक विश्वसनीय संकेत बन जाते हैं।

v4.2 अपडेट ने दो नए मूल्यांकन घटक भी जोड़े: AA-Briefcase एजेंटिक मूल्यांकन और Surge का GDP.pdf लंबे संदर्भ परीक्षण। ये जोड़े उद्योग के उस बढ़ते रुचि को दर्शाते हैं जो मॉडल्स पर है जो स्वतंत्र रूप से कार्य कर सकें और बहुत लंबे दस्तावेज़ों को प्रोसेस कर सकें, केवल ट्रिविया प्रश्नों का अच्छे से उत्तर देने तक सीमित न हों।

समग्र लीडरबोर्ड के शीर्ष पर, स्वामित्व वाले मॉडल अभी भी शीर्ष पर हैं। Anthropic का Claude Fable 5.1 शीर्ष पर है। लेकिन 4B पैरामीटर से कम श्रेणी में, जहाँ कच्ची शक्ति के बजाय कुशलता और पहुँच महत्वपूर्ण है, MiniCPM5-2B ओपन-वेट रैंकिंग में शीर्ष पर है।

विज्ञापन

छोटा मॉडल, व्यापक लक्ष्य

MiniCPM5-2B एक घना ट्रांसफॉर्मर है, जिसका अर्थ है कि निष्पादन के दौरान प्रत्येक पैरामीटर सक्रिय होता है, एक मिक्सचर-ऑफ-एक्सपर्ट्स आर्किटेक्चर के माध्यम से रूटिंग नहीं होता। घने मॉडल अपने संसाधन उपभोग में अधिक भरोसेमंद होते हैं, जो ठीक वही है जो आपको एआई को एज डिवाइस पर डिप्लॉय करते समय चाहिए।

मॉडल 131K से 512K टोकन तक के कॉन्टेक्स्ट विंडोज़ को समर्थन करता है, जो कॉन्फ़िगरेशन पर निर्भर करता है। संदर्भ के लिए, 512K टोकन लगभग एकल पास में 1,000-पृष्ठ की पुस्तक को प्रोसेस करने के बराबर है।

OpenBMB ने MiniCPM5-2B को AMD, Intel, MediaTek और Qualcomm के चिप्स के लिए अनुकूलित किया है।

क्षमता के मामले में, टीम अपने पैरामीटर रेंज के भीतर कोडिंग, गणित, लंबे संदर्भ की समझ, टूल उपयोग और एजेंटिक वर्कफ्लो में सर्वश्रेष्ठ प्रदर्शन का दावा करती है।

मॉडल के प्रशिक्षण में प्रबलन अधिगम संरेखण और ओपनबीएमबी द्वारा उच्च गुणवत्ता वाली ट्रैजेक्टरीज के रूप में वर्णित तकनीकों को शामिल किया गया था, जो जटिल, क्रमिक निर्णय लेने के तरीके को सुधारने के लिए डिज़ाइन की गई थीं।

मिनीसीपीएम वंशज

MiniCPM5-2B एक अच्छे रिकॉर्ड पर आधारित है। इसका पूर्ववर्ती, MiniCPM5-1B, पहले संस्करण के कृत्रिम विश्लेषण सूचकांक पर 17.9 अंक प्राप्त किए थे, जिससे 2 बिलियन पैरामीटर से कम मॉडल्स में शीर्ष पोज़ीशन हासिल की थी।

दो मॉडल्स के बीच स्कोरिंग अंतर, 1B संस्करण के लिए 17.9 और 2B संस्करण के लिए 15, सूचकांक विधि में बदलाव को दर्शाता है, एक पीछे की ओर की ओर नहीं। संस्करण 4.2 का निजी परीक्षण सेट्स और नए मूल्यांकन श्रेणियों पर अधिक निर्भरता होने के कारण, संस्करणों के स्कोर सीधे तुलनीय नहीं हैं।

इसका डिवाइस पर AI के लिए क्या अर्थ है

छोटे मॉडल्स के लिए प्रतिस्पर्धी दृश्य भीड़ भरता जा रहा है। मेटा की लामा श्रृंखला, माइक्रोसॉफ्ट के फाई मॉडल और गूगल के गेमा वेरिएंट्स सभी समान पैरामीटर रेंज में प्रतिस्पर्धा करते हैं। सब-4B श्रेणी में MiniCPM5-2B का बेंचमार्क नेतृत्व ध्यान देने योग्य है, लेकिन बेंचमार्क प्रभुत्व और वास्तविक दुनिया की उपयोगिता हमेशा एक साथ नहीं चलते।

मॉडल के दावा किए गए प्रदर्शन की स्वतंत्र पुष्टि अभी तक सार्वजनिक रूप से दस्तावेज़ित नहीं की गई है। AI बेंचमार्किंग में, परिणामों की तीसरे पक्ष द्वारा पुनर्उत्पादन ही प्रेस रिलीज और साबित क्षमता के बीच का अंतर है।

डिस्क्लेमर: इस पेज पर दी गई जानकारी थर्ड पार्टीज़ से प्राप्त की गई हो सकती है और यह जरूरी नहीं कि KuCoin के विचारों या राय को दर्शाती हो। यह सामग्री केवल सामान्य सूचनात्मक उद्देश्यों के लिए प्रदान की गई है, किसी भी प्रकार के प्रस्तुतीकरण या वारंटी के बिना, न ही इसे वित्तीय या निवेश सलाह के रूप में माना जाएगा। KuCoin किसी भी त्रुटि या चूक के लिए या इस जानकारी के इस्तेमाल से होने वाले किसी भी नतीजे के लिए उत्तरदायी नहीं होगा। डिजिटल संपत्तियों में निवेश जोखिम भरा हो सकता है। कृपया अपनी वित्तीय परिस्थितियों के आधार पर किसी प्रोडक्ट के जोखिमों और अपनी जोखिम सहनशीलता का सावधानीपूर्वक मूल्यांकन करें। अधिक जानकारी के लिए, कृपया हमारे उपयोग के नियम और जोखिम प्रकटीकरण देखें।