جوجل تطلق ثلاثة نماذج جديدة من جيميني لتحسين كفاءة وسرعة وكلاء الذكاء الاصطناعي

iconTechFlow
مشاركة
AI summary iconملخص
أطلقت جوجل ثلاثة نماذج جديدة من جيميني—3.6 Flash و3.5 Flash-Lite و3.5 Flash Cyber—لتعزيز أداء وكلاء الذكاء الاصطناعي. يقلل نموذج 3.6 Flash استخدام الرموز بنسبة 17% ويعزز مهام البرمجة والمعرفة. يصل نموذج 3.5 Flash-Lite إلى 350 رمزًا في الثانية، وهو الأسرع في سلسلته. يركز نموذج 3.5 Flash Cyber على تحديد وحل قضايا الأمن السيبراني في الكود. تتماشى هذه التحديثات مع أخبار الذكاء الاصطناعي + التشفير وقد تؤثر على قوائم الرموز الجديدة في هذا المجال.

المؤلف: Google DeepMind

مُترجم: Deep潮 TechFlow

مقدمة من Shenchao: تركز النماذج الثلاثة التي أطلقتها Google على معالجة التحديات الحقيقية في تجسيد الوكلاء الذكاء الاصطناعي — التكلفة والسرعة. يوفر نموذج 3.6 Flash تقليلًا بنسبة 17% في عدد الرموز مقارنة بالجيل السابق، مع سعر أقل وجودة أفضل؛ ويصل نموذج 3.5 Flash-Lite إلى سرعة 350 رمزًا/ثانية، وهو أسرع نموذج في سلسلة 3.5 حاليًا؛ بينما يستهدف نموذج Flash Cyber المتخصص سوقًا ضروريًا لتصحيح الثغرات الأمنية في الكود. إنها ليست مسابقة أداء، بل خطوة لتمهيد الطريق للنشر الواسع للوكلاء الذكاء الاصطناعي.

أطلقت Google DeepMind اليوم ثلاثة نماذج جديدة من Gemini: 3.6 Flash و3.5 Flash-Lite و3.5 Flash Cyber. تم تصميم هذه النماذج خصيصًا للكفاءة والتأخير والموثوقية المطلوبة لبناء وكلاء الذكاء الاصطناعي على نطاق واسع.

Gemini 3.6 Flash: أكثر كفاءة وأفضل جودة

تم تحسين 3.6 Flash بناءً على ملاحظات المطورين حول 3.5 Flash. فهو لا يُحسّن فقط في مجالات البرمجة والعمل المعرفي، بل يُحسّن أيضًا كفاءة الرموز بشكل ملحوظ. وفقًا لمؤشر التحليل الاصطناعي، يقلل 3.6 Flash من استهلاك رموز الإخراج بنسبة 17% مقارنة بـ 3.5 Flash. وفي بعض اختبارات الأداء مثل DeepSWE الخاص بـ Datacurve، تصل هذه النسبة إلى 65%. كما يتطلب عددًا أقل من خطوات الاستدلال ودعوات الأدوات لإكمال سير العمل متعددة الخطوات.

يأتي هذا التحسن في الكفاءة مع أسعار أقل. بسعر 1.5 دولار لكل مليون رمز إدخال و7.5 دولار لكل مليون رمز إخراج، خفّض 3.6 Flash التكلفة الإجمالية لكل مهمة عامل، مما يجعل بناء وتشغيل العاملين أكثر اقتصادية.

حتى مع كونه أكثر كفاءة، فإن 3.6 Flash يتفوق في الأداء على 3.5 Flash في جميع حالات الاستخدام:

تم تحسين تحرير الكود ليكون أكثر دقة، مع تقليل التعديلات والدورات التنفيذية غير الضرورية، حيث بلغ الأداء 49% على DeepSWE (مقارنة بـ 37% لـ 3.5 Flash)، وارتفع بشكل ملحوظ إلى 63.9% على معيار أبحاث التعلم الآلي MLE Bench (مقارنة بـ 49.7% لـ 3.5 Flash)

تم تحسين القدرة على تشغيل الكمبيوتر، وحصل OSWorld-Verified على درجة 83.0% (3.5 Flash بدرجة 78.4%). الآن، يتم توفير تشغيل الكمبيوتر عبر Gemini API وGemini Enterprise كأداة عميل مدمجة.

أداء أفضل في المهام المعرفية، مثل درجة معيار GDPval-AA v2 البالغة 1421 (بينما بلغت 3.5 Flash 1349). وجد عملاء مثل Hebbia و Harvey أنه متميز بشكل خاص في مهام متعددة الوسائط مثل تحليل المستندات، والرسوم البيانية وتحليل البيانات، وصياغة التقارير.

ملاحظات العملاء: 3.6 Flash يمثل تقدمًا من حيث التكلفة وجودة الأداء، ويوزن كفاءة الرموز والدقة والسرعة في سير العمل المعقدة والمهمات القائمة على المعرفة.

تصميم الأمان

يُزود 3.6 Flash بإجراءات حماية أمنية متقدمة محسّنة تغطي مجالات الكيميائية والبيولوجية والإشعاعية والنووية (CBRN) واستخدامات الهجمات السيبرانية. تزيد هذه التدابير من مقاومة النموذج لهجمات التجاوز، وفي الوقت نفسه، تم تدريب النموذج على تقليل رفض الاستخدامات المفيدة قدر الإمكان.

Gemini 3.5 Flash-Lite: مصمم لتوسيع نطاق عمليات الوكلاء

3.5 Flash-Lite مصمم لمهام منخفضة التأخير وسيناريوهات تطوير تتطلب عرض نطاق عالٍ، مثل بحث الوكلاء ومعالجة المستندات.

3.5 Flash-Lite هو أسرع نموذج في سلسلة 3.5. وفقًا لقياسات Artificial Analysis، يصل سرعته إلى 350 رمز إخراج في الثانية. يتم تسعيره بـ 0.3 دولار لكل مليون رمز إدخال و2.5 دولار لكل مليون رمز إخراج، مع جودة متفوقة بكثير على 3.1 Flash-Lite، مما يوفر قيمة ممتازة للمطورين والعملاء الذين ينفذون مهام إنتاجية بحجم عالٍ.

يدعم 3.5 Flash-Lite التوسع الفعال لنظام الوكلاء. يتفوق هذا النموذج بشكل ملحوظ على 3.1 Flash-Lite على جميع مستويات التفكير. يمكن للمطورين تكوين النموذج وفقًا لعبء العمل: استخدام مستويات تفكير منخفضة وصغيرة للمهام الكبيرة، مع إعطاء الأولوية للتنفيذ منخفض التأخير ومنخفض التكلفة؛ أو تمكين مستويات تفكير أعلى للتعامل مع عبء عمل الوكلاء الفرعيين متعدد الخطوات. سيدعم هذا النموذج الآن عمليات الكمبيوتر كأداة مدمجة، ويدعم بشكل موثوق مهام الوكلاء عبر الواجهات.

لقد شهد تحسينًا ملحوظًا في الترميز ومهام الوكلاء، مثل درجة Terminal-Bench 2.1 البالغة 54% (مقارنة بـ 31% لـ 3.1 Flash-Lite)، وسياقات طويلة مثل GDM-MRCR v2 بدرجة 72.2% (مقارنة بـ 60.1% لـ 3.1 Flash-Lite)، وتنفيذ المهام الفعلية مثل GDPval-AA v2 بدرجة 1140 (مقارنة بـ 642 لـ 3.1 Flash-Lite).

في الواقع، تفوق 3.5 Flash-Lite على 3 Flash في العديد من تقييمات الوكلاء والبرمجة، بما في ذلك SWE-Bench Pro (54.2% مقابل 49.6%) وOSWorld-Verified (74.0% مقابل 65.1%)، ليصبح الخيار الأسرع والأقوى لعبء عمل 2.5 و3 Flash.

أكد العملاء المبكرون على المزيج الفريد للسرعة والذكاء وكفاءة التكلفة لـ 3.5 Flash-Lite في توسيع سير عمل العوامل ومهمات معالجة البيانات.

Gemini 3.5 Flash Cyber في CodeMender: اكتشاف وإصلاح الثغرات بكفاءة

تتفوق نماذج الذكاء الاصطناعي في اكتشاف الثغرات الأمنية على سرعة تصحيحها من قبل الأنظمة الحالية. يتطلب التصدي لهذا التهديد المتزايد أسلوبًا فعالًا وقويًا لأمان البرمجيات.

إن أداء وفعالية Flash يجعلانه الأساس المثالي للكشف الواسع النطاق والتحقق من مشكلات أمان الكود وإصلاحها. تم بناء Gemini 3.5 Flash Cyber على أساس 3.5 Flash، وتم ضبطه خصيصًا لاكتشاف وإصلاح ثغرات الأمن السيبراني، مع سعر أقل لكل رمز مقارنة بالنماذج الكبيرة.

في CodeMender، تعمل عدة وكلاء سيبرانيين من نوع 3.5 Flash معًا لإنشاء تقرير موحد، وتحقيق مستوى تنافسي رائد على معيار CyberGym الشهير.

نظرًا لطبيعة هذه التقنية الثنائية الاستخدام، اتخذنا نهجًا حذرًا في النشر. سيتم تقديم النموذج قريبًا من خلال CodeMender كمشروع تجريبي بوصول محدود للحكومات والشركاء الموثوقين. وسيمكن هذا الدفاعيين على الخطوط الأمامية من اكتشاف وإصلاح الثغرات الحرجة قبل استغلالها، مع تقليل مخاطر الاستخدام الواسع النطاق.

ابدأ الآن

3.6 Flash و 3.5 Flash-Lite متاحان اعتبارًا من اليوم:

يمكن للمطورين استخدامه عبر Gemini API في Google AI Studio وAndroid Studio. كما يمكن استخدام 3.6 Flash أيضًا في Google Antigravity

يمكن استخدام 3.6 Flash في منصة Gemini Enterprise Agent. كما يمكن استخدام 3.6 Flash أيضًا في تطبيق Gemini Enterprise.

متاح للجميع عبر تطبيق Gemini. كما يتم إطلاق 3.5 Flash-Lite حاليًا على Google Search.

مرحبًا بتعليقاتكم لتحسين نماذج Gemini المستقبلية، ونحن نتطلع إلى إصدار 3.5 Pro قريبًا.

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.