मार्क जकरबर्ग ने बुधवार को मेटा का पहला कृत्रिम बुद्धिमत्ता (AI) कोडिंग एजेंट, म्यूज़ कोड को बीटा संस्करण में लॉन्च किया। एंथ्रोपिक का क्लॉड ओपस 5 मेटा द्वारा लॉन्च पर प्रकाशित सभी चार तुलनाओं में इसे पीछे छोड़ देता है।
मेटा ने उन चार्ट्स को फिर भी जारी कर दिया। कंपनी एक बेहतर उपकरण के बजाय एक सस्ता उपकरण बेच रही है। स्वतंत्र परीक्षण डेटा सुझाता है कि अंतर मेटा द्वारा दिखाए गए से अधिक है।
X पर हमें फॉलो करें ताकि नवीनतम समाचार तुरंत प्राप्त कर सकें
मेटा के अपने चार्ट्स हर राउंड में एंथ्रोपिक को हाथ देते हैं
Muse Spark 1.2, Muse Code के अंदर का मॉडल है। इसने Terminal-Bench 2.1 पर 82.9% का स्कोर प्राप्त किया।
Claude Opus 5 ने इसी परीक्षा में 86.7% अंक प्राप्त किए। Terminal-Bench Laude संस्थान और स्टैनफोर्ड शोधकर्ताओं से आया है। यह सिस्टम मरम्मत, डेटा कार्य और सुरक्षा में 89 वास्तविक नौकरियों को सेट करता है।
दूसरा स्थान सम्मानजनक है। म्यूज कोड ने OpenAI के Codex को 81.8% और Grok Build को 81.6% पर हराया।

अगला चार्ट अधिक कठोर था। DeepSWE 1.1 ने ग्रेडिंग के दौरान इंटरनेट एक्सेस बंद करके 113 कोडिंग कार्य सेट किए। Muse Spark 1.2 घटकर 59.3% पर तीसरे स्थान पर पहुंच गया।
मेटा ने फिर अपने इंजीनियर्स द्वारा बनाए गए 440 वास्तविक पुल रिक्वेस्ट्स से एक परीक्षण प्रकाशित किया। म्यूज स्पार्क 1.2 ने वहां 70.6% स्कोर किया, जो ऑपस 5 से लगभग नौ अंक पीछे था।

वह स्कोर केवल 2.3 अंक ऊपर है Muse Spark 1.1, मॉडल जिसे मेटा ने जुलाई में लॉन्च किया था।
मॉडल मेटा ने अपने कोडिंग चार्ट्स छोड़ दिए
मेटा ने खुद को GPT-5.6 Terra के साथ तुलना की। ओपनएआई एक मजबूत मॉडल सोल बेचता है, और मेटा ने इसे सभी तीन कोडिंग चार्ट्स से बाहर रख दिया।
Sol ने स्वतंत्र Terminal-Bench 2.1 लीडरबोर्ड पर 89.5% के साथ शीर्ष स्थान प्राप्त किया। इसके बाद Opus 5 89.1% के साथ आया।
दोनों आंकड़े Meta द्वारा Opus 5 के लिए रिपोर्ट किए गए 86.7% को पार कर गए। Meta ने अपने सबसे मजबूत प्रतिद्वंद्वी का कमजोर सेटिंग चुना और फिर भी इसके पीछे रह गया।
सॉल के खिलाफ, सच्चे नेता, म्यूज स्पार्क 1.2, 3.8 के बजाय 6.6 अंक पीछे है।
मेटा ने एक जगह पर सोल को शामिल किया था। 1,000 से अधिक टूल कॉल्स चल रहे एक जीपीयू कर्नेल कार्य पर, सोल ने बेसलाइन पर 71.2% का सुधार किया। म्यूज स्पार्क 1.2 ने 68.7% किया और छह में से चौथा स्थान प्राप्त किया।
एक सावधानी दूसरी ओर काटती है। म्यूज स्पार्क 1.2 अभी तक उस सार्वजनिक लीडरबोर्ड पर नहीं दिखाई देता है, जहाँ 183 ट्रैक किए गए मॉडल्स में से केवल 26 का परीक्षण किया गया है। इसका 82.9% अभी भी मेटा का आंकड़ा है।
“Muse Spark 1.2 हमारा अगला कदम है, जब हम सीमा की ओर बढ़ रहे हैं, और आगे बड़े, अधिक क्षम स्वरूप आ रहे हैं,” जुकरबर्ग ने एक पोस्ट में कहा।
ज़ुकरबर्ग शीघ्र ही अपने खिलाफ मॉडल की मेजबानी कर सकते हैं
रिपोर्ट्स के अनुसार, मेटा एंथ्रोपिक को कंप्यूट किराए पर देने की बातचीत में है। यह समझौता दो वर्षों में $10 बिलियन तक पहुँच सकता है। मेटा डेटा सेंटर तब क्लॉड मॉडल्स को चलाने में मदद करेंगे, जिन्हें म्यूज़ कोड ने हराने के लिए बनाया गया था।
म्यूज कोड के पीछे की नेतृत्व टीम महंगी थी। जुकरबर्ग ने जून 2025 में स्केल एआई और उसके संस्थापक अलेक्सांड्र वांग के लिए 14.3 अरब डॉलर भुगतान किया, जो अब मेटा सुपरइंटेलिजेंस लैब्स की अगुवाई करते हैं।
कीमत वह एकमात्र लीवर है जो वांग के पास बचा है। दरें मेटा के पहले भुगतान वाले API की जुलाई लॉन्च के साथ मेल खाती हैं, जो प्रति मिलियन इनपुट टोकन 1.25 डॉलर और प्रति मिलियन आउटपुट टोकन 4.25 डॉलर हैं।
एक योगदानकर्ता स्तर की लागत 10 गुना कम होती है। विकासक अपने कार्य पर मेटा को प्रशिक्षित करने से योग्य होते हैं। वांग ने म्यूज स्पार्क लाइन के लिए अपनाये जाने के आंकड़े देने से इंकार कर दिया।
मेटा के खाते छूट की व्याख्या करते हैं। पिछले चौथाई में राजस्व 28% बढ़कर 60.8 अरब डॉलर हो गया, लेकिन संचालन लाभ घटकर 18.8 अरब डॉलर हो गया।
ऑपरेटिंग मार्जिन घटकर 31% हो गया, जो पिछले वर्ष के इसी समय की तुलना में 43% था। मेटा ने केवल इस क्वार्टर में $31.08 बिलियन कैपिटल प्रोजेक्ट्स पर खर्च किया, और वर्ष के लिए $145 बिलियन तक का अनुमान रखा है।
Muse Code, जिसकी इंजीनियरिंग Claude Code में नहीं है। पृष्ठभूमि एजेंट एक सत्र के दौरान संदर्भ रखते हैं। सब-एजेंट एक रिपॉजिटरी की अलग-अलग प्रतियों में काम करते हैं।
मेटा ने एक मजबूत दूसरा सर्वश्रेष्ठ कोडर बनाया है और इसे एक बजट विकल्प की तरह कीमत दी है। बीटा दिखाएगा कि डेवलपर्स क्या सटीकता के कुछ अंकों को लगभग दसवें हिस्से के बिल के लिए बदलते हैं।
