تحديث واجهة برمجة تطبيقات Anthropic Fable 5.1 يمنع تقطيع النموذج

icon MarsBit
مشاركة
AI summary iconملخص
أطلقت Anthropic Fable 5.1، وهو تحديث رئيسي للواجهة البرمجية يمنع تقطيع النموذج. يضيف هذا التحديث فحوصات السياق لمنع الاستخراج غير المصرح به لاستدلالات Claude. قد يواجه المطورون الذين يستخدمون محفزات معدلة أخطاء أو حظرًا مزيلًا. تنطبق هذه القواعد على الحسابات الجديدة بعد 31 أغسطس 2026. تم تحسين الأداء للمستخدمين الملتزمين. يتوافق هذا التحديث لـ BTC وتحديث ETH مع اتجاهات تعزيز أمان النماذج.

عصر التقطير الكبير سيأتي إلى نهايته!

في 2 سبتمبر، أطلقت Anthropic ضربة قوية، وغيّرت قواعد واجهة برمجة التطبيقات تمامًا، وقطعت تمامًا أي طريق خلفي للموديلات المُغلفة والمستخلصة.

كلود

في الماضي، اختارت العديد من الشركات تجنب تكاليف الحوسبة الهائلة وفترات التدريب الطويلة من خلال استخدام واجهات برمجة التطبيقات لاستخلاص عملية الاستدلال من النماذج الرائدة، ثم استخدام هذه البيانات لتدريب نماذجها "الصغيرة".

But after today, this possibility no longer exists.

Claude Fable 5.1 يحظر تغيير "كتلة التفكير"

أطلقت Anthropic Fable 5.1 مع آلية مكافحة التقطيع الأكثر صرامة على الإطلاق.

الإجراء الأساسي هو تثبيت "كتلة التفكير" بإحكام.

ما هو "Thinking Block"؟

ببساطة، هي عملية CoT التي تقوم بها الذكاء الاصطناعي في ذهنها قبل تقديم الإجابة النهائية.

كلود

يستخدم كلاود مسارات معقدة ومتوازية أثناء التفكير أثناء إجراء الحسابات الذهنية.

في مكالمات API، سيُعيد Claude خطوات الاستدلال هذه للمستخدم على شكل "كتل تفكير".

في المحادثات المتعددة الخطوات العادية، يقوم المطورون بإعادة إرسال كتل التفكير هذه مع تعليمات النظام والأدوات والرسائل السابقة إلى Claude لتمكين النموذج من تذكر السياق والحفاظ على ترابط المحادثة.

لكن بالضبط هذا الآلية أصبحت فرصة للمُقَطِّفين.

اكتشفوا ثغرة ضخمة: فقط من خلال تعديل دقيق للسياق قبل وبعد كتلة التفكير خلال محادثات متعددة (مثل تزوير تعليمات النظام المبكرة أو الرسائل السابقة)، يمكنهم كسر آلية دفاع Claude، وحتى إقناع Claude بكشف منطق الاستدلال الأساسي الذي كان مخفيًا!

كلود

كلود

لمعالجة هذا الفوضى، أطلقت Anthropic في Fable 5.1 قاعدة جديدة صارمة تُسمى "التحقق من اتساق السياق".

1. العودة إلى المسار الأصلي، حرفًا بحرف: ستقوم واجهة برمجة التطبيقات الآن بالتحقق الصارم من أن "كتلة التفكير" المرسلة من العميل مطابقة تمامًا للإرشاد النظامي والأدوات والرسائل التاريخية التي أنشأتها في الأصل.

2. تلاعب؟ خطأ مباشر! بمجرد اكتشاف النظام أي تعديل على السياق، حتى لو كان واحدًا نقر ستفشل جميع المطابقات، وسيعيد الـ API رسالة خطأ مباشرة ويرفض الخدمة.

بالإضافة إلى ذلك، لمراعاة المطورين الشرعيين الذين يحتاجون فعلاً إلى تعديل السياق (مثل الحاجة إلى تقليل طول السياق لتوفير التكاليف)، توفر Anthropic "وضعًا غير صارم".

في هذا الوضع، يمكن قبول طلبك، لكن النظام سيحذف جميع "كتل التفكير" مباشرة! وسيُجبر النموذج على الإجابة دون رؤية عملية الاستدلال السابقة على الإطلاق.

هذه الخدعة تُعدّ سحبًا للأساس.

كلود

عندما يُسأل Claude عن سؤال بسيط وسؤال صعب، أمثلة على الاستدلال الأمين والاستدلال الدافع (غير الأمين)

ما مدى الجنون في التقطير الصناعي؟

لماذا يُبالغ أنثروبيك في الغضب ويفرض مثل هذه القيود الصارمة؟

الإجابة هي: بالنسبة، وأيضًا ضرورية للغاية.

بسبب التقطيع غير القانوني الحالي، تطور إلى حجم صناعي.

على مدار العام الماضي، لاحظ فريق أمان Anthropic ظواهر إساءة استخدام مُرعبة.

هؤلاء المخترقون المحترفون "المُقَطَّعون" لا يسألون عن بضعة أسئلة يوميًا باستخدام حساب واحد، بل يستخدمون آلاف الحسابات الوهمية، من خلال نصوص آلية، للإفراط في استغلال نقطة الواجهة البرمجية للتطبيق على مدار الساعة.

كلود

أساليبهم في التشغيل شديدة الخفاء والعدوانية.

كما ذُكر سابقًا، على الرغم من أن Anthropic قامت بترميز مكونات التفكير الأساسية لـ Claude منذ فترة طويلة، إلا أن القراصنة استخدموا تقنيات "حقن السياق" و"إعادة كتابة المحادثة".

هذا السلوك يشبه إجراء "تهدئة" لـ Claude، بحيث تُجبره على فك تشفير وطباعة عملية الاستدلال الخاصة بها رغم وجود خلل منطقي.

لذلك، لم تخضع العديد من النماذج الصغيرة المعلمة لعملية تراكم قوة الحوسبة والابتكار الخوارزمي من الصفر، بل اكتفت بحفظ أساليب الإجابة من أفضل نماذج الذكاء الاصطناعي، مما مكنها من تحقيق أداء مماثل.

الأكثر رعبًا أن هذا السلوك يلامس الحدود الحمراء مباشرة، مما يؤدي إلى انهيار الأمان.

أكبر خطر لفقدان السيطرة على الذكاء الاصطناعي

إذا كان خسارة المصالح التجارية تسبب لـ Anthropic "ألمًا بسيطًا"، فإن "فصل القدرة عن الأمان" يُثير رعبًا في جميع أنحاء مجتمع أمان الذكاء الاصطناعي.

هذا أيضًا الدافع الأساسي الذي دفع Anthropic إلى اتخاذ إجراء قاطع.

من المعروف أن النماذج الكبيرة مثل Claude وGPT-4، على الرغم من امتلاكها ذكاءً عالياً جدًا، فقد خضعت لتدريبات صارمة على "توحيد القيم" والأمان. فهي تعرف أنها لا يمكنها تعليم الناس كيفية صنع القنابل، أو كتابة برامج خبيثة لطلب الفدية، أو نشر خطاب الكراهية.

هذا الربط المزدوج من "القدرة + حواجز أمان" هو ما بنَتْه الشركات الكبرى للذكاء الاصطناعي بإنفاق ملايين الدولارات على RLHF والمواجهة الحمراء-الزرقاء.

كلود

لكن نموذج التقطير تجنب تمامًا هذا الشبكة الأمنية!

عندما يقوم المُستخلصون بتعديل السياق لاستخراج "كتل التفكير" من Claude، فإنهم يستخرجون فقط جزء "القدرة الاستدلالية" عالي الذكاء، لكنهم لا يستطيعون على الإطلاق توريث الضمانات الأمنية الأساسية.

مثل منظمة شريرة، نسخت ذكاء أينشتاين دون نسخ أخلاقياته وتعاطفه.

الأنظمة المدربة باستخدام هذه الوسائل غير القانونية للتكثيف ترث بشكل غامض قدرات منطقية وبرمجية متقدمة لم تكن ينبغي لها أن تمتلكها.

لكن نظرًا لأنها في جوهرها نماذج أساسية ذات "ضمان منخفض وحواجز ضعيفة"، فإنها ستستجيب بلا تردد لطلبات القراصنة لإنشاء سكريبتات هجوم إلكتروني أو المساعدة في تطوير أسلحة بيولوجية.

إن فصل القدرة عن الأمان هو أكبر خطر في الذكاء الاصطناعي اليوم.

اللوائح الجديدة تدخل حيز التنفيذ: من يتأثر؟

Will this crackdown affect legitimate developers?

لا داعي للقلق، اتخذت Anthropic استراتيجية "تنفيذ تدريجي" دقيقة تهدف إلى تقليل الأضرار الجانبية إلى أدنى حد.

أولًا، "الحساب الجديد".

وفقًا للوثائق الرسمية، تبدأ هذه القيود أولًا من الحسابات الجديدة التي تُستخدم بشكل مفرط بشكل أكبر. بالنسبة لنموذج Fable 5.1، ينطبق هذا التحديث فقط على الحسابات الجديدة لإدارة واجهات برمجة التطبيقات التي تم إنشاؤها بعد 31 أغسطس 2026، 12:00:00 AM UTC.

يمكن لهؤلاء الأشخاص أن يطمئنوا تمامًا، فهم غير متأثرين على الإطلاق.

1. الحسابات الحالية للواجهة البرمجية: الحسابات القديمة الحالية غير متأثرة مؤقتًا على Fable 5.1. وهذا يمنح المطورين القانونيين وقتًا كافيًا للتكيف.

2. المستخدمون العاديون من طرف الاستهلاك: إذا كنت تستخدم فقط إصدار الويب من Claude.ai، أو منتجات Claude Code وClaude Cowork الرسمية، أو تتحدث بشكل طبيعي عبر منتجات طرف ثالث مُغلفة، فلن تتعرض لأي تدخل.

كلود

ما الذي يجب على مطوري الـ API المتضررين الانتباه إليه؟

إذا كنت قد استخدمت سابقًا تقنية "إعادة كتابة الجولات المبكرة أثناء المحادثة" في تكامل تطبيقك (على سبيل المثال، لتقليل التكاليف من خلال ضغط السياق، أو حقن تنبيهات نظام جديدة أثناء المحادثة)، فعليك البدء فورًا في تعديل منطق كودك.

كلود

للتعامل مع هذا التغيير، قدمت Anthropic دليلاً شاملاً للهجرة. لدى المطورين خياران.

اختر الخيار واحد: الحفاظ على الاتساق المطلق للسياق. إعادة إرسال كتلة التفكير وتعليمات النظام والأدوات كما هي دون أي تغيير.

الخيار الثاني: اختر الانضمام إلى "الوضع غير الصارم" في طلب API. في هذا الوضع، حتى إذا قمت بتعديل السياق، فلن يُخطئ الـ API أو يتوقف، بل سيحذف تلقائيًا وهادئًا كتل التفكير المتأثرة من الطلب.

على الرغم من أن هذا سيجعل النموذج "ينسى" عملية الاستدلال المحددة من المحادثة السابقة، إلا أنه على الأقل يضمن عدم انقطاع محادثتك أو مهامك.

يجب التذكير بأنه على الرغم من وجود فترة إعفاء حالية لهذا الحكم، فقد أعلنت Anthropic بوضوح أن آلية "الاحتفاظ بالتفكير" ستُطبق على جميع الحسابات في الإصدارات المستقبلية من النماذج!

فترة التخزين الحالية محدودة أيضًا.

مفاجأة سارة: نفعًا للأشخاص الصادقين

وبالإضافة إلى ذلك، بعد هذه اللوائح الجديدة، هناك ميزة خفية للمطورين القانونيين—انخفاض كبير في التكاليف وقفزة في سرعة الاستجابة.

How is this done?

The core lies in "contextual consistency".

في الماضي، كان المطورون يستطيعون تعديل السياق بحرية، مما جعل كل طلب يتلقاه النموذج يبدو "جديدًا" بالكامل. هذا لم يُهدر الموارد الحسابية فحسب، بل جعل العملية بطيئة جدًا.

الآن، تجبر القواعد الجديدة الجميع على الحفاظ على "كتلة التفكير" والرسائل التوجيهية المحيطة بها والرسائل السابقة تمامًا كما هي، دون أي تغيير.

هذا يخلق من الناحية الفنية ظروفًا مثالية: يمكن للتخزين المؤقت للإشارات تحقيق معدل إصابة عالٍ جدًا!

الآن، يمكن لخادم API تخزين ذاكرة السياق السابق للحوار بسهولة. عندما يأتي طلب حوار جديد، يقوم النظام باستدعاء البيانات مباشرة من الذاكرة المؤقتة، مما يكمل التطابق فورًا.

النتيجة: انخفاض كبير في وقت استجابة واجهة برمجة التطبيقات، وانخفاض حاد في التأخير، مع خفض ملحوظ في تكلفة استدعاءات واجهة برمجة التطبيقات للمطورين!

هذه الخدعة "الزراعة العرضية" يمكن اعتبارها دعماً ملموساً للمطورين الصادقين.

بشكل عام، هذه اللوائح الجديدة تمثل نقطة فاصلة لصناعة الذكاء الاصطناعي بأكملها.

قد تقل قصص الصغيرة التي تُهزم بها الكبيرة.

بعد انسحاب المد، من يسبح عاريًا؟

المراجع:

https://support.claude.com/zh-CN/articles/16761192-%E4%BF%9D%E7%95%99%E6%80%9D%E8%80%83-%E6%94%B9%E5%8F%98messages-api%E5%A4%84%E7%90%86%E6%80%9D%E8%80%83%E5%9D%97%E7%9A%84%E6%96%B9%E5%BC%8F%E4%BB%A5%E9%98%B2%E6%AD%A2%E8%92%B8%E9%A6%8F

تحرير: أينياس

هذا المقال من حساب WeChat "سينزي يوان" (ID: AI_era)، الكاتب: ASI Revelation

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.