اليوم، أطلقت Anthropic أحدث إصدارين: Claude Fable 5.1 وMythos 5.1 (نفس النموذج، مستويات حماية مختلفة)، وهو تحديث متوسط بسيط مع تحسينات أداء محدودة، لكنه يركز بشكل أساسي على تحسين الاستقرار وتخفيض الأسعار. إليك التحديثات الرسمية: 1. تحسينات كبيرة في القدرات البحثية agentic ارتفع أداء Terminal-Bench-Science من 24.7% في Fable 5 إلى 52.6% في Mythos 5.1، أي تقريبًا مضاعفة، وفوق بكثير أداء Opus 5 البالغ 29.0%. 2. البرمجة والمهمات الطويلة دون رقابة ارتفع أداء Terminal-Bench 4.0 من 42.0% إلى 55.8% (و60.9% في Mythos 5.1)، ووصل CursorBench 3.2.0 إلى 73.4%. استخدمه Millennium لاكتشاف عطل نادر باحتمال واحد من بين مليون، لم يُكتشفه الفريق خلال أربع إلى خمس سنوات، ولم يلاحظه أي نموذج آخر. 3. انخفاض الأسعار بنسبة حوالي 25% انخفض سعر قراءة التخزين المؤقت (cache read) بنسبة 75% ليصبح 0.25 دولار لكل مليون رمز؛ انخفضت التكلفة الإجمالية للحمل النموذجي بنسبة حوالي 25%، وأقصى انخفاض يصل إلى 45% في سيناريوهات agentic الثقيلة. تبقى أسعار الإدخال عند 10 دولارات والإخراج عند 50 دولارًا لكل مليون رمز دون تغيير. 4. الأداء كافٍ حتى مع الإعداد المنخفض عند ضبطه على Low/Medium، يكون الأداء قريبًا من أو يتجاوز Fable 5، مع تكلفة أقل بكثير — يمكن للسيناريوهات الحساسة للتكلفة التحويل مباشرة إلى الإعداد الأدنى. 5. تقليل كبير في الإشارات الخاطئة للأمن انخفض عدد مرات حظر حماية الأمن السيبراني في Claude Code بنسبة حوالي 60% متوسطًا، ويُسمح الآن باستخدامه لتحديد الثغرات (لا يزال ممنوعًا كتابة استغلالات أو إجراء اختبارات اختراق أو مسح ثنائي، والتي ستُحوَّل إلى Opus). انخفضت الإشارات الخاطئة للأسئلة البيولوجية البريئة (أسئلة أساسية في البيولوجيا أو الطب) بنسبة 85%. 6. حلول الاحتفاظ بالبيانات المؤسسية يُخزّن الحل الجديد Enterprise Frontier Safeguards (EFS) البيانات على سحابة العميل نفسه بدلاً من Anthropic، مما يعادل الاحتفاظ الصفري بالبيانات، وسيتم إطلاقه تدريجيًا هذا الخريف؛ ويمكن للعملاء المؤهلين استخدامه بصفة صفرية للاحتفاظ بالبيانات قبل ذلك. 7. تحسن في التوافق مقارنة بالجيل السابق يُظهر تقليلًا أكبر في محاولة الخروج من بيئة الاختبار للحصول على موارد، وتقليلًا أكبر في استخدام الاستدلالات الدافعة مثل "هذا محاكاة/تقييم" لتبرير الأفعال، وانخفاضًا في محاولات ونجاحات "الاحتيال بالمكافآت"، وهو النموذج الأكثر ثباتًا حاليًا ضد حقن الأوامر. نقطتان إضافيتان تستحقان المعرفة: لا يمكن الآن تعديل يدوي لمحتوى التفكير التاريخي لـ Claude داخل المحادثات متعددة الخطوات لحسابات API الجديدة (لمنع التقطيع)، وسيتم إضافة علامة مائية نصية خفية تطلبها قانون الاتحاد الأوروبي للذكاء الاصطناعي، دون التأثير على جودة المحتوى أو احتوائها على أي معلومات مستخدم.
Dr.Rمشاركة
المصدر:عرض النسخة الأصلية
إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات.
يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.