لقد كان لذراعات الروبوتات تاريخ موثق من كونها سيئة بشكل مُحبِط في رفع الأشياء. وقد أحدثت Claude Fable 5.1 من Anthropic، الصادرة في 1 سبتمبر 2026، فرقًا كبيرًا في هذه المشكلة.
يحقق النموذج معدل نجاح قدره 40% في مهام الروبوتات للرفع والوضع، بزيادة من 5% لسابقه كلاود فايب 5.
ما الذي تغيّر تحت الغطاء
تم تصميم Fable 5.1 لأعمال الوكلاء على المدى الطويل، وهي فئة المهام التي يحتاج فيها النموذج إلى التخطيط والتنفيذ والتعافي عبر العديد من الخطوات دون مساعدة بشرية. أنابيب البرمجة وسير عمل البحث العلمي وأتمتة الأعمال المعقدة هي المجال المستهدف.
تعكس الأرقام المرجعية هذا التركيز. على Terminal-Bench-Science، يحقق Fable 5.1 نسبة 52.6٪، مقارنة بـ 24.7٪ لـ Fable 5. وترتفع إكمالات OSWorld 2.0 الصارمة من 36.1٪ إلى 41.7٪. ويرتفع AutomationBench، الذي يختبر أتمتة البرمجيات متعددة الخطوات، من 17.1٪ إلى 31.4٪.
تكرر تعليقات العملاء بعد الإطلاق القصة المرجعية. وأشار مستخدمو المؤسسات بشكل خاص إلى تحسن الموثوقية في المشاريع التي تستغرق ساعات، وليس دقائق، حيث أكمل النموذج تلك المهام باستخدام عدد أقل من الرموز مقارنة بالإصدارات السابقة.
الحسابات السعرية أكثر إثارة مما تبدو
يظل التسعير الأساسي لـ Fable 5.1 ثابتًا عند 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج، نفس سعر النموذج السابق.
انخفضت تكلفة قراءة الذاكرة المؤقتة بنسبة 75% إلى 0.25 دولار لكل مليون رمز. تقدّر Anthropic أن تقليل الذاكرة المؤقتة يترجم إلى توفير تقريبي بنسبة 25% على أحمال العمل النموذجية. ويمكن أن يصل التوفير في خطوط أنابيب الوكلاء الأكثر تعقيدًا إلى 45%.
النموذج متاح للمستخدمين من فئات Pro و Max و Team و Enterprise، ويمكن الوصول إليه عبر واجهة برمجة التطبيقات وسوق السحابة الرئيسية.
لماذا تستحق رقم الروبوتات محادثة خاصة بها
تحسين عملية التقاط والوضع هو الرقم الرئيسي، لكنه يستحق التوقف عند سبب أهمية هذا المعيار المحدد. إن عملية التقاط والوضع هي مؤشر على التأصيل في العالم المادي: هل يمكن لنموذج الذكاء الاصطناعي تحويل التفكير المجرد إلى أوامر حركية دقيقة وواقعية؟ تتضمن المهمة التعرف على الأجسام، والتفكير المكاني، وتخطيط الإمساك، واستعادة الأخطاء عندما تحدث مشكلات.
معدل نجاح 5% هو في جوهره ضجيج. أما معدل 40% فليس كافيًا بعد للاستخدام الصناعي غير الخاضع للإشراف، لكنه يتجاوز الحد الذي تصبح فيه التقنية مفيدة كطبقة مساعدة بشرية بدلاً من كونها مجرد فضول.
السياق التنافسي
صنّف المقيمون المستقلون Claude Fable 5.1 في مستوى مساوٍ أو أعلى من القادة السابقين على مؤشرات الذكاء بعد إطلاقه مباشرة. إن نمط التحسينات عبر Terminal-Bench-Science وOSWorld 2.0 وAutomationBench يشير إلى أن Anthropic تستهدف عملاء المؤسسات الذين ينفذون سير عمل معقدة ومتعددة الخطوات وتمتد لساعات، بدلاً من المستهلكين الذين يطرحون أسئلة سريعة.
