أطلق مارك زوكربيرغ Muse Code في النسخة التجريبية يوم الأربعاء، وهو أول عامل برمجي بالذكاء الاصطناعي (AI) من Meta. وتفوق Claude Opus 5 من Anthropic عليه في جميع المقارنات الأربع التي نشرتها Meta عند الإطلاق.
أصدرت ميتا تلك المخططات على أي حال. الشركة تبيع أداة أرخص بدلاً من أداة أفضل. تشير بيانات الاختبار المستقلة إلى أن الفجوة أوسع مما أظهرته ميتا.
تابعنا على X للحصول على أحدث الأخبار فور صدورها
مخططات ميتا تُمنح أنثروبيك الجولة كلها
Muse Spark 1.2 هي النموذج داخل Muse Code. حصل على 82.9% في Terminal-Bench 2.1.
حقق Claude Opus 5 درجة 86.7% في نفس الاختبار. يأتي Terminal-Bench من معهد Laude وباحثين من ستانفورد. وهو يحدد 89 وظيفة حقيقية تغطي إصلاح الأنظمة، وعمل البيانات، والأمان.
المركز الثاني مُحترم. تفوق Muse Code على Codex التابع لـ OpenAI بنسبة 81.8% وعلى Grok Build بنسبة 81.6%.

كان الرسم البياني التالي أكثر قسوة. يحدد DeepSWE 1.1 113 مهمة برمجية مع إيقاف الوصول إلى الإنترنت أثناء التصحيح. وهبط Muse Spark 1.2 إلى المركز الثالث بنسبة 59.3%.
ثم نشرت ميتا اختبارًا بنته بنفسها، مستخلصًا من 440 طلب سحب حقيقي من مهندسيها. حصل Muse Spark 1.2 على 70.6% هناك، بفارق حوالي تسع نقاط خلف Opus 5.

هذا التقييم يقع فقط على بعد 2.3 نقطة فوق Muse Spark 1.1، النموذج الذي أصدرته ميتا في يوليو.
النموذج ميتا أوقف رسوماته البرمجية
قاسَت ميتا نفسها مقابل GPT-5.6 Terra. تبيع OpenAI نموذجًا أقوى يُدعى Sol، وحذفت ميتا النموذج من جميع مخططات البرمجة الثلاثة.
يتصدر سول قائمة Terminal-Bench 2.1 المستقلة القائمة الرائدة بنسبة 89.5%. يليه Opus 5 بنسبة 89.1%.
كلا الرقمين تجاوزا النسبة 86.7% التي أبلغ عنها ميتا لـ Opus 5. اختار ميتا إعدادًا أضعف لمنافسه الأقوى، لكنه لا يزال خلفه.
ضد سول، القائد الحقيقي، يتراجع Muse Spark 1.2 بـ 6.6 نقطة بدلاً من 3.8.
شاملة ميتا Sol في مكان واحد. على مهمة نواة وحدة معالجة الرسومات (GPU) تعمل عبر أكثر من 1,000 استدعاء أداة، تحسّن Sol على الأساس بنسبة 71.2%. وحققت Muse Spark 1.2 نسبة 68.7% واحتلت المركز الرابع من أصل ستة.
تحذير واحد يعكس الاتجاه الآخر. لا يظهر Muse Spark 1.2 بعد على قائمة الصدارة العامة، حيث تم اختبار 26 نموذجًا فقط من أصل 183 نموذجًا متعقبًا. نسبة 82.9% لا تزال رقمًا تابعًا لـ Meta.
"ميوس سبارك 1.2 هي خطوتنا التالية في طريقنا نحو الحدود، مع وجود نماذج أكبر وأكثر قدرة قادمة،" كما قال زوكربيرغ said في منشور.
قد يُنظم زوكربيرغ قريبًا النموذج الذي يتفوق على نفسه
يُقال إن ميتا تجري محادثات لـ تأجير حوسبة لشركة Anthropic. يمكن أن يصل الاتفاق إلى 10 مليارات دولار على مدار عامين. ستُساعد مراكز بيانات ميتا بعد ذلك في تشغيل نماذج Claude التي تم بناء Muse Code لتحديها.
القيادة وراء Muse Code كانت مكلفة. دفع زوكربيرغ 14.3 مليار دولار في يونيو 2025 مقابل Scale AI ومؤسسها ألكسندر وانغ، الذي يرأس الآن مختبرات ميتا للذكاء الاصطناعي الفائق.
السعر هو الرافعة التي تبقى لدى وانغ. تتطابق الأسعار مع إطلاق أول واجهة برمجة تطبيقات مدفوعة من ميتا في يوليو بسعر 1.25 دولار لكل مليون رمز إدخال و4.25 دولار لكل مليون رمز إخراج.
تكلفة مستوى المساهم تقل بأكثر من 10 مرات. يتأهل المطورون من خلال السماح لـ Meta بتدريب نماذجها على أعمالهم. ورفض وانغ تقديم أرقام التبني لخط Muse Spark.
حسابات ميتا تشرح الخصم. ارتفع الإيراد بنسبة 28% إلى 60.8 مليار دولار في الربع الماضي، لكن الربح التشغيلي انخفض بنسبة 8% إلى 18.8 مليار دولار.
انخفض هامش التشغيل إلى 31% من 43% قبل عام. أنفقت ميتا 31.08 مليار دولار على مشاريع رأس المال في الربع وحده، وتتوقع إنفاق ما يصل إلى 145 مليار دولار للسنة.
تقدم Muse Code ميزات هندسية لا يوفرها Claude Code. تحتفظ الوكلاء الخلفيون بالسياق عبر الجلسة. تعمل الوكلاء الفرعية في نسخ معزولة من المستودع.
لقد بنت ميتا مبرمجًا ثانيًا ممتازًا وحددت سعره كخيار اقتصادي. ستُظهر النسخة التجريبية ما إذا كان المطورون يتنازلون عن بضع نقاط من الدقة مقابل فاتورة بحجم يقارب العُشر.
