أطلقت Google ثلاثة نماذج جديدة من Gemini تهدف إلى جعل وكلاء الذكاء الاصطناعي أسرع وأرخص وأكثر كفاءة مع تصاعد المنافسة في مجالات البرمجة وأتمتة المؤسسات والأمن السيبراني.
يضم التشكيلة Gemini 3.6 Flash وGemini 3.5 Flash Lite وGemini 3.5 Flash Cyber. كما أكدت Google أن Gemini 3.5 Pro قيد الاختبار مع الشركاء، وقد بدأ أطول عملية تدريب مسبق على الإطلاق لـ Gemini 4.
يُعد Gemini 3.6 Flash النموذج الرئيسي في الإصدار، ويوفر أداءً أقوى في البرمجة وعمل المعرفة والأداء متعدد الوسائط مع استهلاك أقل للرموز مقارنة بـ Gemini 3.5 Flash.
وفقًا لجوجل، يستخدم النموذج 17% أقل من رموز الإخراج على مؤشر التحليل الاصطناعي. وقالت الشركة إن تقليل الرموز وصل إلى ما يصل إلى 65% في بعض اختبارات DeepSWE، كما أن النموذج يتطلب خطوات استدلال وأدوات أقل لإكمال سير العمل متعددة الخطوات.
تكلفة Gemini 3.6 Flash هي 1.50 دولار لكل مليون رمز إدخال و7.50 دولار لكل مليون رمز إخراج، مما يوفر للمطورين سعرًا أقل لكل مهمة وكيلية مقارنةً بسلفها.
حقق النموذج درجة 49% على DeepSWE، مقارنة بـ 37% لـ Gemini 3.5 Flash، مما يعكس دقة أعلى وتغييرات أقل غير ضرورية في الكود. وزادت درجة النموذج على MLE Bench إلى 63.9% من 49.7%.
كما تحسّن استخدام الحاسوب، حيث حصل Gemini 3.6 Flash على 83% في OSWorld Verified، مقارنة بـ 78.4% للنموذج السابق. يُتاح استخدام الحاسوب كأداة مدمجة من جانب العميل عبر Gemini API وGemini Enterprise.
قالت جوجل إن النموذج مناسب بشكل خاص لسير العمل الوكيلية، ومهمات البرمجة، والعمليات المؤسسية الطويلة الأمد. وهو يدعم النصوص والصور والصوت والفيديو، مع نافذة سياق تصل إلى مليون رمز.
يستهدف Flash Lite أحمال العمل الكبيرة للذكاء الاصطناعي
تم تصميم Gemini 3.5 Flash Lite للتطبيقات التي تكون فيها السرعة والقدرة على المعالجة والتكلفة أكثر أهمية من استخدام نموذج أكبر.
يُنتج النموذج حوالي 350 رمز إخراج في الثانية، وفقًا لـ Artificial Analysis، مما يجعله أسرع نموذج في سلسلة Gemini 3.5.
يُسعر بـ 0.30 دولار لكل مليون رمز إدخال و2.50 دولار لكل مليون رمز إخراج. تقوم جوجل بوضعه لمعالجة الأحمال عالية الحجم مثل البحث الوكيلي، ومعالجة المستندات، واستخراج البيانات، والترجمة والتلخيص.
يمكن للمطورين ضبط مستوى تفكير النموذج حسب المهمة. تُعطي الإعدادات الدنيا والمنخفضة أولوية للتنفيذ الأسرع والأقل تكلفة، بينما تدعم الإعدادات الأعلى سير عمل أكثر تعقيدًا للوكلاء الفرعيين.
حقق Gemini 3.5 Flash Lite 54% في Terminal Bench 2.1، مقارنة بـ 31% لـ Gemini 3.1 Flash Lite. كما وصل إلى 72.2% في GDM MRCR v2، بزيادة من 60.1%, و1,140 في GDPval AA v2، مقارنة بـ 642.
قالت جوجل إن Flash Lite تفوقت أيضًا على Gemini 3 Flash الأكبر في عدة معايير برمجة ووكلاء، بما في ذلك SWE Bench Pro وOSWorld Verified.
تحتل جوجل فلاش سايبر ضد ميثوس من أنثروبيك
النموذج الثالث، جيميني 3.5 فلاش سايبر، متخصص في العثور على ثغرات البرمجيات والتحقق منها وإصلاحها.
مبنية على Gemini 3.5 Flash، يعمل النموذج من خلال CodeMender، وكيل أمان الكود التابع لـ Google. يمكن لعدة وكلاء Flash Cyber العمل معًا لتحليل الثغرات وإنتاج تقرير موحد.
قالت جوجل إن النظام حقق أداءً تنافسيًا على CyberGym بينما يعمل بسعر أقل لكل رمز مقارنةً بالنماذج الأكبر في مجال الأمن السيبراني.
تحدد الإصدار Flash Cyber كمنافس أقل تكلفة للنماذج الأمنية المتقدمة مثل Mythos الخاص بـ Anthropic، الذي صُمم لاكتشاف الثغرات والمنطق السيبراني المعقد.
تتخذ جوجل نهجًا محدودًا لنشر النموذج بسبب احتمال سوء الاستخدام السيبراني. سيكون Flash Cyber متاحًا في البداية فقط للحكومات والشركاء الموثوقين من خلال برنامج تجريبي محدود لـ CodeMender.
قالت الشركة إن النشر مصمم لتمكين المدافعين من الوصول إلى أدوات كشف الثغرات ومعالجتها قبل توفر النموذج على نطاق أوسع.
بدء التدريب المسبق لـ Gemini 4
متاحة Gemini 3.6 Flash وGemini 3.5 Flash Lite من خلال Gemini API وGoogle AI Studio وAndroid Studio وGemini Enterprise.
متاح Gemini 3.6 Flash أيضًا من خلال Google Antigravity وتطبيق Gemini، بينما يتم طرح Flash Lite من خلال Google Search.
تظهر الإصدارات بينما تستمر جوجل في اختبار Gemini 3.5 Pro مع الشركاء. لم يتم تحديد تاريخ إصدار عام للنموذج الرئيسي بعد.
كما أكدت جوجل أن تطوير الجيل التالي قيد التقدم، مع بدء الشركة ما وصفته بأطول عملية تدريب مسبق طموحة لها حتى الآن لـ Gemini 4.
