كتاب تقييم سلامة الذكاء الاصطناعي يكتسبون بروزًا وسط جدالات أنثروبيك وأوبن أي آي

icon币界网
مشاركة
AI summary iconملخص
يُدخل مقيّمو سلامة الذكاء الاصطناعي إلى دائرة الضوء بينما يطلبون مساعدة Anthropic وOpenAI للتعامل مع مخاطر توسيع النماذج. تقوم هذه المجموعات غير الربحية بتقييم قدرات الذكاء الاصطناعي وهي الآن مدمجة في عمليات الجهات الكبرى. أطلقت OpenAI مؤخرًا ثلاثة موظفين بسبب انتهاكات سياسات تتعلق بمناقشات طرف ثالث، مما جذب الانتباه إلى مخاوف داخلية تتعلق بالسلامة. وتكسب المقترحات التنظيمية مثل قانون FRONTIER وMiCA (لوائح السوق الأوروبية للأصول المشفرة) أرضية، لكن الفجوات في التمويل والإشراف لا تزال قائمة. تظل السيولة وأسواق العملات المشفرة تحت المراجعة التنظيمية مع تحرك الصناعة نحو الامتثال الرسمي.
موقع CoinNews يفيد:

قبل شهرين، كانت وكالات التقييم المستقلة تقع في زاوية هادئة نسبيًا من صناعة الذكاء الاصطناعي بقيمة تريليون دولار. اليوم، يُطلب منها "إنقاذ الموقف".

بينما تتنافس Anthropic و OpenAI حول كيفية توسيع أعمالهما مع ضمان أمان النماذج المتقدمة، تسعى هاتان الشركتان للحصول على دعم عدد قليل من المؤسسات الثالثية الصغيرة، مثل Model Evaluation and Threat Research (METR) و Apollo Research و Transluce.

تعمل معظم هذه الهيئات التقييمية كمنظمات غير ربحية، وهي لا تزال تسعى لتحديد موقعها في صناعة تتدفق فيها رؤوس الأموال بسرعة غير مسبوقة، وتُطرح فيها نماذج جديدة بتردد غير مسبوق. وتتمثل مسؤولياتها الأساسية في تقييم قدرات ومخاطر نماذج الذكاء الاصطناعي، وتحديد الحالات التي تظهر فيها سلوكيات غير مناسبة تقنيًا.

في غياب تقدم تنظيمي على المستوى الفيدرالي، أصبحت أهمية هيئات التقييم المستقلة أكثر وضوحاً. فقد تعهد داريو أمودي، الرئيس التنفيذي لشركة Anthropic، الشهر الماضي بإدماج هيئات تقييم مستقلة داخل الشركة، وسرعان ما أيد سام ألتمان، الرئيس التنفيذي لشركة OpenAI، هذا المفهوم. كما أن الرئيس الأمريكي دونالد ترامب يدعم هذا الفكرة، وكذلك العديد من شركات التكنولوجيا الكبرى في الولايات المتحدة. لكن لا تزال هناك أسئلة معلقة، مثل: كيف يجب تمويل هذه الأطراف الثالثة، وما مدى صلاحيات الوصول التي ستتمتع بها، وما هي هيكلية الإبلاغ النهائية.

قال أستاذ علوم الحاسوب في جامعة براون، سوريش فينكاتاسوبرامانيان، في مقابلة مع CNBC: "المشكلة، إلى حد ما، كما كانت دائمًا: المال. من سيُمول هذا العمل للشركات؟ كيف ستُدعم هذه المؤسسات؟ تحتاج إلى نظام بيئي، وتحتاج إلى نموذج عمل قابل للتطبيق."

حاليًا، تضع شركة Anthropic وOpenAI وشركاء البنية التحتية الذين استفادوا من موجة الذكاء الاصطناعي القواعد. يقول المنتقدون إن هذا يشبه السماح لأكبر البنوك بحمايتنا من الأزمات المالية، أو السماح لشركات الأدوية بإطلاق الأدوية في السوق دون موافقة تنظيمية.

أشاد ترامب مؤخرًا بـ "الرقابة الذاتية الممتازة جدًا" من قبل كبار مسؤولي الذكاء الاصطناعي، وأعلن نيته ترك الصناعة لتعالج نفسها، متجنبًا عرقلة الصناعة التي تدفع نمو الاقتصاد والأسواق المالية. وحث ترامب في اتفاق طوعي اقترحه في أواخر سبتمبر شركات الذكاء الاصطناعي على "التعاون مع مدققين أو مقيّمين خارجيين مستقلين".

تم إثارة هذه المناقشة بمقال نشره أموديي الشهر الماضي وانتشر على نطاق واسع. وفي ذلك المقال، دعا إلى إبطاء تطوير النماذج المتقدمة، نظرًا لقلق بعض الباحثين الذين غادروا الشركات وعبّروا عن مخاوفهم من أن هذه التقنية قد تشكل تهديدًا للوجود.

لقد ظهرت احتكاكات مع بدء مختبرات الذكاء الاصطناعي في نشر هيئات التقييم.

صرّح متحدث باسم OpenAI أن الشركة فصلت ثلاثة موظفين الأسبوع الماضي بسبب "انتهاكهم لسياسياتنا المتعلقة بالوصول إلى المعلومات الحساسة للشركة ومعالجتها". وأفاد الموظفان المُفصَلان، ميكيتا بالييسني وتوميك كورباك، أنهما يعتقدان أن سبب فصلهما هو طريقة تواصلهما مع جهات تقييم خارجية.

كتب بيلسني يوم الخميس على X: "أخبرني زملائي السابقون أنهم يشعرون بالارتباك بشأن ما يجب تصديقه. كما أنهم يخافون من التحدث، خشية أن يتم تفتيش هواتفهم الشخصية بسبب رسائلهم معنا ومع أطراف ثالثة. أخشى أن هذا الخوف العام من التحدث والقلق من التواصل مع أطراف ثالثة سيجعل OpenAI تقلل من جودة الأمان في الخلفية."

نفت OpenAI هذا الادعاء، وأفادت في منشور يوم الجمعة أن الشركة تُجري مفاوضات نشطة لتوقيع عقود مع مقيّمين أمنيين طرف ثالث، وستُعلن عن التفاصيل خلال الأسابيع القادمة.

كتب OpenAI: "نحن ملتزمون بدمج مقيّمين خارجيين، ونستمر في جعل التعاون الوثيق مع منظمات أمنية مستقلة جزءًا أساسيًا من عملنا الأمني."

أفاد متحدث باسم OpenAI في بيان عبر البريد الإلكتروني أن العمل القادم مع وكالات التقييم "يُبنى على التعاون الحالي مع منظمات أمنية مستقلة"، وتشمل METR وRedwood Research.

Anthropic لم ترد على طلب CNBC للتعليق.

لم أرَ قط مشكلة تُحَلّ بهذه السرعة

يتكون نظام بيئي لمؤسسات تقييم الذكاء الاصطناعي بشكل رئيسي من منظمات صغيرة مثل METR وApollo Research، بالإضافة إلى شركات محاسبة ومراجعة أكبر مثل Accenture.

لقد كانت مختبرات الذكاء الاصطناعي تعمل بالتعاون مع هيئات التقييم ضمن نطاق محدود، لكن أندرو فريدمان، الرئيس التنفيذي للمنظمة غير الربحية Fathom، قال إن هذا المجال يتطور بسرعة.

قال فريدمان في مقابلة مع CNBC: "عملت في مجال السياسة والسياسات لمدة 20 عامًا، ولم أرَ قط مشكلة تُدفع بهذه السرعة عبر طيف سياسي متنوع بهذا القدر." وأشار إلى توقعه بـ"تدفق هائل لرأس المال" إلى هذا النظام البيئي.

قال ريان كريشنان، الرئيس التنفيذي لشركة Vals AI، وهي جهة تقييم مستقلة، إن هذه الشركة الناشئة الربحية تضع معايير لقياس أداء نماذج الذكاء الاصطناعي في المهام الخاصة بالصناعة، وقد نما عدد الموظفين من 8 إلى حوالي 30 موظفًا هذا العام، وأعلنت في أغسطس عن إتمام تمويل بقيمة 40 مليون دولار.

أعلنت المنظمة غير الربحية METR في أغسطس أنّها حصلت على التزامات تمويل بقيمة حوالي 71 مليون دولار خلال الأشهر الستة الماضية. ووفقًا لأحدث المستندات المقدمة من المنظمة إلى مصلحة الضرائب الأمريكية، فإن هذا الرقم يفوق إجمالي تبرعاتها البالغ 13.6 مليون دولار لعام 2024 بأكمله.

بحلول نهاية ذلك الشهر، ارتفع وعي METR أكثر. استأجرت OpenAI موظفين اثنين من المؤسسة ومقاولاً واحدًا للمساعدة في إعداد تقرير تحليلي لاحق يوضح كيف هربت نماذج الشركة من السيطرة، ووصلت إلى الإنترنت المفتوح، وتجاوزت منصة المطورين مفتوحة المصدر Hugging Face. أفادت METR أنها لم تتلقَ أي تعويض من OpenAI مقابل هذا التقييم.

قال كيفن ويرباخ، مدير مختبر الذكاء الاصطناعي المسؤول في كلية وارتون لإدارة الأعمال بجامعة بنسلفانيا، إن هذا النظام البيئي "ليس مستقرًا بما يكفي حاليًا". على سبيل المثال، يُظهر موقع METR أن عدد الموظفين بدوام كامل في المؤسسة أقل من 50 موظفًا.

الاختلال في القوة بين وكالات تقييم صغيرة ومختبرات رائدة حصلت على تمويل ببلايين الدولارات وتوظف آلاف الأشخاص، أثار مخاوف بشأن تضارب المصالح المحتمل.

قال فينكاتاسوبرامانيان: "إذا كنت ترغب في تقييم طرف ثالث حقيقي، فأنت بحاجة إلى استقلال مالي حقيقي، بالإضافة إلى استقلال جوانب أخرى. الأمر لا يقتصر فقط على عدم تلقي الأموال، بل يشمل أيضًا: إذا كنت مدققًا ونشرت تقريرًا ضارًا بهذه الشركة، هل ستكون هناك عواقب؟ هل سيتوقف نشاطي التجاري بسبب ذلك؟"

اعترفت Anthropic الشهر الماضي في مقال مدونة بهذه التعقيدات. أعلنت الشركة أنها ستُدمج موظفين من Faculty، وهي وحدة Accenture المتخصصة في الذكاء الاصطناعي، لاختبار تدابير الأمان وتقييم ما إذا كانت النماذج تتصرف وفقًا للقيم البشرية. وأفادت Anthropic أنه نظرًا لأهمية وعجلة هذا العمل، ستقوم الشركة بتمويل مباشر للمساهمات ذات الصلة من قبل Accenture.

تقول Anthropic: "لا توجد معايير حالية فيما يتعلق بالمعلومات التي يجب أن يتعرض لها المقيّمون المدمجون، أو كيفية الإبلاغ عن النتائج. كما لم يتم تحديد هيكل التمويل للمقيّمين المستقلين بعد. على المدى الطويل، نرى أن التمويل يجب أن يأتي من مصادر جماعية أو حكومية."

كما أشارت أنثروبيك إلى أن الشركة تناقش مع METR ومؤسسات تقييم غير ربحية أخرى، والتي تخطط لتجربة بعض "العناصر" من "التقييم المدمج" باستخدام أموالها الخاصة.

Will the government intervene?

في يونيو من العام الماضي، اقترح فاثوم إطارًا للسوق لمنظمات التحقق المستقلة (Independent Verification Organizations، IVOs). ستُمنح هذه المنظمات ترخيصًا حكوميًا وتُخوّل اختبار شركات الذكاء الاصطناعي للتحقق من توافقها مع معايير الأمان المختلفة.

قال فريدمان إن الرقابة الحكومية ضرورية، وإلا فقد تعتمد الجهات الخارجية للتقييم على إيرادات مختبرات الذكاء الاصطناعي الكبيرة، مما يحفزها على "البدء في التوقيع على القائمة" للحفاظ على العلاقات.

بعض المشرعين قد أعربوا عن دعمهم.

تُعد IVOs بندًا أساسيًا في قانون "المراقبة المتقدمة للمخاطر، الشفافية الوطنية، التقييم المستقل والتقارير" (FRONTIER)، والذي قدمه النائب لوري تراهن (الديمقراطية من ماساتشوستس) وجاي أوبيرنولتي (الجمهوري من كاليفورنيا) في يوليو. وقال فريدمان إن فاثوم ساعدت في صياغة نص القانون وقدمت الدعم التقني.

قال كريس ليهان، المدير التنفيذي للشؤون العالمية في OpenAI، للصحفيين في سبتمبر إنه التقى أحد مقدمي المشروع في الكونغرس للتعبير عن دعمه لبنود IVO.

أفاد ليهان أن "من المهم بالنسبة لهم سماع هذا، وسماعنا نقول ذلك، ونود أن نوضح هذا بوضوح شديد."

في الوقت نفسه، اتخذ المشرعون في كاليفورنيا وكونيتيكت وفرجينيا خطوات لتعزيز IVOs، بينما تنظر ولايات مثل ماساتشوستس في تقييمات أمنية مستقلة على نطاق أوسع.

وقع حاكم كاليفورنيا غافين نيوسوم مؤخرًا على قانونين يتعلقان بـ IVOs، أحدهما ينشئ "إطارًا فريدًا من نوعه على مستوى البلاد"، والآخر ينشئ سجلًا ولايًا للمدققين المعنيين بالذكاء الاصطناعي. دعمت Anthropic هذين القانونين في أغسطس، وقامت OpenAI الشهر الماضي بتأييدهما رسميًا، في نفس اليوم الذي وقع فيه نيوسوم على القانونين.

كتب ليهان في مقال مدونة وقتها: "نفضل أن يُطلب تقييم تقني مستقل على المستوى الفيدرالي"، لكن في غياب إجراءات فيدرالية، "يمكن لولاية كاليفورنيا مساعدة وضع القواعد".

قال فريدمان إنه يعتقد أن الشركات مثل OpenAI وAnthropic ستواجه صعوبة كبيرة في اكتشاف كيفية التعاون مع هيئات التقييم المستقلة. ومع ذلك، في ظل غموض دور الحكومة، قال إنه "أمر يستحق تطويره كمهارة خلال المرحلة الانتقالية".

حاليًا، أقرب شيء يمتلكه القطاع إلى معيار هو اتفاقية "أخلاقية ملزمة" أشار إليها ترامب خلال غداء عقده في البيت الأبيض في نهاية الشهر الماضي مع قادة التكنولوجيا.

تُنصّ هذه الوثيقة المكوّنة من صفحة واحدة على أن "كل شركة مسؤولة عن تطوير تقنياتها الخاصة بطريقة آمنة، وتعزيزها بطرق تمكن من بناء ثقة العملاء والجمهور." كما تشجّع الوثيقة الموقعين على التعاون مع "مُدقّقين أو مُقيّمين خارجيين مستقلين" لإجراء تقييمات مستقلة.

تم توقيع هذا المستند من قبل كبار المسؤولين في Anthropic وGoogle وMeta وOpenAI وSpaceX وNvidia، وهو ما يمثل مظهراً نادراً من التوافق بين قادة يختلفون في آرائهم حول كيفية التعامل مع مخاطر الذكاء الاصطناعي. لكن هؤلاء الكبار ما زالوا بحاجة إلى وضع خططهم الخاصة للتقدم.

قال فينكاتاسوبرامانيان: "هذا أكثر شبهاً بعرض يحاول إظهار وجود إجراءات، بينما في الواقع لم يحدث أي إجراء حقيقي. ما وعدوا بفعله كان ينبغي أن يكون قد تم بالفعل، وفي الواقع لقد زعموا في الماضي أنهم كانوا يفعلونه باستمرار."

في مقاله في سبتمبر، أشار أمودي إلى أن أنثروبيك ستزود المقيّمين بطاولات عمل وبطاقات دخول وأجهزة كمبيوتر محمولة تابعة للشركة، بالإضافة إلى صلاحيات "متكافئة تقريبًا" مع فريق التقييم الداخلي للمخاطر. بالإضافة إلى ذلك، سيحصل المقيّمون على دعم قانوني يمنحهم "حق نشر الاكتشافات الهامة"، بينما تحتفظ أنثروبيك بـ"قدرة محدودة" على حذف أو تعديل بعض المعلومات المتعلقة بالأمن أو السرية.

كتب أمودي: "هذه خطوة غير معتادة بالنسبة لشركة، لكننا نعتقد أن إثبات مفهوم المراجع الخارجي المضمن مهم."

بعد عدة أيام، أصدرت OpenAI اقتراحها الخاص، وذكرت أن المقيّمين يجب أن يعملوا حول "ادعاء تقييم محدد بوضوح ومتفق عليه من الطرفين"، مع توضيح الأساليب والمعايير، وإثبات الخبرة التقنية ذات الصلة، وكشف أي تضارب في المصالح.

في الشهر الماضي، أصدر منتدى مقيّمي الذكاء الاصطناعي، الذي يشمل METR ومعهد أبحاث التحقق والتقييم للذكاء الاصطناعي (AVERI) ومؤسسات أخرى، رسالة مفتوحة بعنوان "الشروط الدنيا لإدماج المقيّمين".

الرسالة تشير إلى أن المقيّمين يجب أن يحافظوا على الشفافية، وأن يكونوا محميين من الانتقام، وأن يحصلوا على مستوى وصول مماثل لمستوى الموظفين ذوي الامتيازات العالية في شركات الذكاء الاصطناعي.

كما ورد في الرسالة: "لا يمكن للتقييمات المدمجة حل جميع احتياجات الإشراف، بل يجب اعتبارها مكملة للجهود الأوسع التي تهدف إلى تشجيع شركات الذكاء الاصطناعي المتقدمة على تعزيز الإشراف الخارجي، وليس بديلاً عنها."

أشار فريدمان إلى أنه خلال الأشهر الأخيرة، لاحظ تغيّراً في موقف OpenAI وAnthropic، وذلك أساساً لأنهما أدركا أنه لا يمكنهما إطلاق أنظمة متقدمة دون ثقة الجمهور.

قال فريدمان: "لا أعتقد أنك بحاجة إلى تصديق أنهم فجأة أصبحوا متعاطفين، أو أن هناك شيئًا آخر غير أن الشركة تتصرف كشركة."

يقول ويرباخ إن هذا ربما يسلط الضوء على المشكلة الأساسية. فـ OpenAI وAnthropic في المقام الأول يتنافسان مع بعضهما البعض، حيث يسعيان نحو الإدراج العام مع السعي وراء تقييم يتجاوز تريليون دولار.

قال ويرباغ: "هناك عدم ثقة شخصية كبيرة بين هاتين الشركتين. على الرغم من وجود توافق كبير على ضرورة إجراء هذا النوع من التقييمات."

شاهد: برادلي تاسك حول طرح Anthropic للاكتتاب العام: لماذا تضيف ضغوط السوق العام إذا كان السلامة أولويتك القصوى؟

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.