Google lance trois nouveaux modèles Gemini pour améliorer l'efficacité et la vitesse des agents IA

iconTechFlow
Partager
AI summary iconRésumé
Google a lancé trois nouveaux modèles Gemini — 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber — pour améliorer les performances des agents IA. Le modèle 3.6 Flash réduit l'utilisation des jetons de 17 % et améliore les tâches de codage et de connaissance. Le 3.5 Flash-Lite atteint 350 jetons par seconde, soit la vitesse la plus rapide de sa série. Le 3.5 Flash Cyber se concentre sur l'identification et la résolution des problèmes de cybersécurité dans le code. Ces mises à jour s'alignent sur les actualités IA + crypto et pourraient influencer de nouvelles listages de jetons dans ce domaine.

Auteur : Google DeepMind

Traduction : Deep潮 TechFlow

Lecture approfondie de Shenchao : Les trois modèles publiés par Google visent tous à résoudre les défis réels de la commercialisation des agents IA — le coût et la vitesse. Le 3.6 Flash réduit la consommation de tokens de 17 % par rapport à la génération précédente, tout en étant moins cher et de meilleure qualité. Le 3.5 Flash-Lite atteint une vitesse de 350 tokens/seconde, ce qui en fait le modèle le plus rapide de la série 3.5 à ce jour. Quant au modèle dédié à la cybersécurité, Flash Cyber, il cible le marché essentiel de la correction des vulnérabilités de code. Il ne s'agit pas d'un simple concours de performances, mais d'une préparation au déploiement à grande échelle des agents IA.

Google DeepMind lance aujourd'hui trois nouveaux modèles Gemini : 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber. Ces modèles sont conçus pour l'efficacité, la latence et la fiabilité nécessaires à la construction à grande échelle d'agents IA.

Gemini 3.6 Flash : plus efficace, de meilleure qualité

3.6 Flash a été amélioré directement à partir des retours des développeurs sur 3.5 Flash. Il ne fait pas seulement des progrès en matière de codage et de travail intellectuel, mais augmente également considérablement l'efficacité des tokens. Selon l'Artificial Analysis Index, 3.6 Flash réduit la consommation de tokens de sortie de 17 % par rapport à 3.5 Flash. Dans certaines évaluations, comme DeepSWE de Datacurve, cette réduction atteint jusqu'à 65 %. Il nécessite également moins d'étapes d'inférence et d'appels d'outils pour accomplir des flux de travail à plusieurs étapes.

Cette amélioration de l'efficacité s'accompagne également de prix plus bas. À un tarif de 1,5 $ pour un million de tokens d'entrée et 7,5 $ pour un million de tokens de sortie, 3.6 Flash réduit le coût total par tâche d'Agent, rendant la création et l'exécution d'Agents plus économiques.

Même plus efficace, 3.6 Flash offre de meilleures performances que 3.5 Flash dans divers cas d'utilisation :

L'édition de code est plus précise, réduisant les modifications et boucles d'exécution inutiles, atteignant 49 % sur DeepSWE (3.5 Flash : 37 %) et s'améliorant significativement à 63,9 % sur le benchmark de recherche en apprentissage automatique MLE Bench (3.5 Flash : 49,7 %)

Amélioration des compétences en manipulation informatique, score OSWorld-Verified à 83,0 % (3,5 Flash à 78,4 %). La manipulation informatique est désormais disponible via l'API Gemini et Gemini Enterprise en tant qu'outil intégré.

Les travaux intellectuels s'effectuent mieux, comme le montre le score de référence GDPval-AA v2 à 1421 (contre 1349 pour 3.5 Flash). Des clients tels que Hebbia et Harvey ont constaté qu'il excelle particulièrement dans des tâches multimodales telles que l'analyse de documents, les graphiques et l'analyse de données, ainsi que la rédaction de rapports.

Les retours clients indiquent que 3.6 Flash représente une amélioration en termes de coût et de qualité, équilibrant efficacité en tokens, précision et vitesse dans les flux de travail complexes et les tâches axées sur les connaissances.

Conception de sécurité

3.6 Flash est doté de mesures de sécurité avancées renforcées couvrant les domaines chimique, biologique, radiologique, nucléaire (CBRN) et les abus par attaques cybernétiques. Ces protections augmentent considérablement la résistance du modèle aux attaques de jailbreak. En parallèle, le modèle a été formé pour minimiser les refus concernant les utilisations bénéfiques.

Gemini 3.5 Flash-Lite : conçu pour la mise à l'échelle des flux de travail Agent

3.5 Flash-Lite est conçu pour les tâches à faible latence et les scénarios de développement nécessitant un haut débit, tels que la recherche d'agents et le traitement de documents.

3.5 Flash-Lite est le modèle le plus rapide de la série 3.5. Selon les mesures d'Artificial Analysis, il atteint une vitesse de 350 tokens de sortie par seconde. Avec un prix de 0,30 $ pour un million de tokens d'entrée et 2,50 $ pour un million de tokens de sortie, il offre une qualité nettement supérieure à 3.1 Flash-Lite, procurant aux développeurs et clients exécutant des tâches de production à fort débit un excellent rapport qualité-prix.

3.5 Flash-Lite prend en charge une extension efficace du système Agent. À chaque niveau de réflexion, ce modèle surpasse significativement 3.1 Flash-Lite. Les développeurs peuvent configurer le modèle en fonction de la charge de travail : utiliser les niveaux de réflexion les plus bas et minimaux pour les tâches en gros lot, en privilégiant une exécution à faible latence et à faible coût ; ou activer des niveaux de réflexion plus élevés pour gérer des charges de travail Agent à plusieurs étapes. Ce modèle prend désormais en charge en tant qu'outil intégré les opérations sur ordinateur, permettant une prise en charge fiable des tâches Agent à travers les interfaces.

Il présente une amélioration significative en matière de codage et de tâches d'agent, avec un score de 54 % sur Terminal-Bench 2.1 (31 % pour 3.1 Flash-Lite), un score de 72,2 % sur les contextes longs comme GDM-MRCR v2 (60,1 % pour 3.1 Flash-Lite) et un score de 1140 sur des tâches réelles comme GDPval-AA v2 (642 pour 3.1 Flash-Lite).

En réalité, dans de nombreux benchmarks d'agents et de codage, 3.5 Flash-Lite dépasse même 3 Flash, notamment sur SWE-Bench Pro (54,2 % contre 49,6 %) et OSWorld-Verified (74,0 % contre 65,1 %), devenant ainsi une option plus rapide et plus puissante pour les charges de travail de 2.5 et 3 Flash.

Les clients initiaux ont souligné la combinaison unique de vitesse, d'intelligence et d'efficacité coûts de 3.5 Flash-Lite pour étendre les flux de travail des agents et les tâches de traitement des données.

Gemini 3.5 Flash Cyber dans CodeMender : Découverte et correction efficaces des vulnérabilités

Les modèles d'IA découvrent des vulnérabilités de sécurité plus rapidement que les systèmes actuels ne peuvent les corriger. Lutter contre cette menace croissante nécessite une approche de sécurité logicielle à la fois efficace et robuste.

La performance et l'efficacité de Flash en font une base idéale pour la détection, la validation et la correction à grande échelle des problèmes de sécurité du code. Gemini 3.5 Flash Cyber est construit sur la base de 3.5 Flash, fine-tuné spécifiquement pour identifier et corriger les vulnérabilités de cybersécurité, avec un coût par token inférieur à celui des grands modèles.

Dans CodeMender, plusieurs Flash Cyber Agents 3.5 collaborent pour générer un rapport synthétique unique, atteignant un niveau compétitif de pointe sur le benchmark populaire CyberGym.

Étant donné la nature à double usage de cette technologie, nous avons adopté une approche de déploiement prudente. Le modèle sera bientôt proposé en accès restreint via CodeMender dans le cadre d’un projet pilote destiné aux gouvernements et partenaires de confiance. Cela permettra aux défenseurs sur le terrain de détecter et de corriger les vulnérabilités critiques avant qu’elles ne soient exploitées, tout en atténuant les risques d’abus plus larges.

Commencez dès maintenant

3.6 Flash et 3.5 Flash-Lite sont désormais disponibles :

Les développeurs peuvent utiliser l'API Gemini via Google AI Studio et Android Studio. 3.6 Flash est également disponible sur Google Antigravity.

L'entreprise peut être utilisée sur la plateforme Gemini Enterprise Agent. 3.6 Flash est également disponible dans l'application Gemini Enterprise.

Disponible sur l'application Gemini pour tous. 3.5 Flash-Lite est également en cours de déploiement sur Google Search.

Merci de nous faire part de vos retours pour améliorer les futurs modèles Gemini ; nous attendons avec impatience de publier le 3.5 Pro.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.