Auteur : Google DeepMind
Traduction : Deep潮 TechFlow
Lecture approfondie de Shenchao : Les trois modèles publiés par Google visent tous à résoudre les défis réels de la commercialisation des agents IA — le coût et la vitesse. Le 3.6 Flash réduit la consommation de tokens de 17 % par rapport à la génération précédente, tout en étant moins cher et de meilleure qualité. Le 3.5 Flash-Lite atteint une vitesse de 350 tokens/seconde, ce qui en fait le modèle le plus rapide de la série 3.5 à ce jour. Quant au modèle dédié à la cybersécurité, Flash Cyber, il cible le marché essentiel de la correction des vulnérabilités de code. Il ne s'agit pas d'un simple concours de performances, mais d'une préparation au déploiement à grande échelle des agents IA.
Google DeepMind lance aujourd'hui trois nouveaux modèles Gemini : 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber. Ces modèles sont conçus pour l'efficacité, la latence et la fiabilité nécessaires à la construction à grande échelle d'agents IA.
Gemini 3.6 Flash : plus efficace, de meilleure qualité
3.6 Flash a été amélioré directement à partir des retours des développeurs sur 3.5 Flash. Il ne fait pas seulement des progrès en matière de codage et de travail intellectuel, mais augmente également considérablement l'efficacité des tokens. Selon l'Artificial Analysis Index, 3.6 Flash réduit la consommation de tokens de sortie de 17 % par rapport à 3.5 Flash. Dans certaines évaluations, comme DeepSWE de Datacurve, cette réduction atteint jusqu'à 65 %. Il nécessite également moins d'étapes d'inférence et d'appels d'outils pour accomplir des flux de travail à plusieurs étapes.
Cette amélioration de l'efficacité s'accompagne également de prix plus bas. À un tarif de 1,5 $ pour un million de tokens d'entrée et 7,5 $ pour un million de tokens de sortie, 3.6 Flash réduit le coût total par tâche d'Agent, rendant la création et l'exécution d'Agents plus économiques.
Même plus efficace, 3.6 Flash offre de meilleures performances que 3.5 Flash dans divers cas d'utilisation :
L'édition de code est plus précise, réduisant les modifications et boucles d'exécution inutiles, atteignant 49 % sur DeepSWE (3.5 Flash : 37 %) et s'améliorant significativement à 63,9 % sur le benchmark de recherche en apprentissage automatique MLE Bench (3.5 Flash : 49,7 %)
Amélioration des compétences en manipulation informatique, score OSWorld-Verified à 83,0 % (3,5 Flash à 78,4 %). La manipulation informatique est désormais disponible via l'API Gemini et Gemini Enterprise en tant qu'outil intégré.
Les travaux intellectuels s'effectuent mieux, comme le montre le score de référence GDPval-AA v2 à 1421 (contre 1349 pour 3.5 Flash). Des clients tels que Hebbia et Harvey ont constaté qu'il excelle particulièrement dans des tâches multimodales telles que l'analyse de documents, les graphiques et l'analyse de données, ainsi que la rédaction de rapports.
Les retours clients indiquent que 3.6 Flash représente une amélioration en termes de coût et de qualité, équilibrant efficacité en tokens, précision et vitesse dans les flux de travail complexes et les tâches axées sur les connaissances.
Conception de sécurité
3.6 Flash est doté de mesures de sécurité avancées renforcées couvrant les domaines chimique, biologique, radiologique, nucléaire (CBRN) et les abus par attaques cybernétiques. Ces protections augmentent considérablement la résistance du modèle aux attaques de jailbreak. En parallèle, le modèle a été formé pour minimiser les refus concernant les utilisations bénéfiques.
Gemini 3.5 Flash-Lite : conçu pour la mise à l'échelle des flux de travail Agent
3.5 Flash-Lite est conçu pour les tâches à faible latence et les scénarios de développement nécessitant un haut débit, tels que la recherche d'agents et le traitement de documents.
3.5 Flash-Lite est le modèle le plus rapide de la série 3.5. Selon les mesures d'Artificial Analysis, il atteint une vitesse de 350 tokens de sortie par seconde. Avec un prix de 0,30 $ pour un million de tokens d'entrée et 2,50 $ pour un million de tokens de sortie, il offre une qualité nettement supérieure à 3.1 Flash-Lite, procurant aux développeurs et clients exécutant des tâches de production à fort débit un excellent rapport qualité-prix.
3.5 Flash-Lite prend en charge une extension efficace du système Agent. À chaque niveau de réflexion, ce modèle surpasse significativement 3.1 Flash-Lite. Les développeurs peuvent configurer le modèle en fonction de la charge de travail : utiliser les niveaux de réflexion les plus bas et minimaux pour les tâches en gros lot, en privilégiant une exécution à faible latence et à faible coût ; ou activer des niveaux de réflexion plus élevés pour gérer des charges de travail Agent à plusieurs étapes. Ce modèle prend désormais en charge en tant qu'outil intégré les opérations sur ordinateur, permettant une prise en charge fiable des tâches Agent à travers les interfaces.
Il présente une amélioration significative en matière de codage et de tâches d'agent, avec un score de 54 % sur Terminal-Bench 2.1 (31 % pour 3.1 Flash-Lite), un score de 72,2 % sur les contextes longs comme GDM-MRCR v2 (60,1 % pour 3.1 Flash-Lite) et un score de 1140 sur des tâches réelles comme GDPval-AA v2 (642 pour 3.1 Flash-Lite).
En réalité, dans de nombreux benchmarks d'agents et de codage, 3.5 Flash-Lite dépasse même 3 Flash, notamment sur SWE-Bench Pro (54,2 % contre 49,6 %) et OSWorld-Verified (74,0 % contre 65,1 %), devenant ainsi une option plus rapide et plus puissante pour les charges de travail de 2.5 et 3 Flash.
Les clients initiaux ont souligné la combinaison unique de vitesse, d'intelligence et d'efficacité coûts de 3.5 Flash-Lite pour étendre les flux de travail des agents et les tâches de traitement des données.
Gemini 3.5 Flash Cyber dans CodeMender : Découverte et correction efficaces des vulnérabilités
Les modèles d'IA découvrent des vulnérabilités de sécurité plus rapidement que les systèmes actuels ne peuvent les corriger. Lutter contre cette menace croissante nécessite une approche de sécurité logicielle à la fois efficace et robuste.
La performance et l'efficacité de Flash en font une base idéale pour la détection, la validation et la correction à grande échelle des problèmes de sécurité du code. Gemini 3.5 Flash Cyber est construit sur la base de 3.5 Flash, fine-tuné spécifiquement pour identifier et corriger les vulnérabilités de cybersécurité, avec un coût par token inférieur à celui des grands modèles.
Dans CodeMender, plusieurs Flash Cyber Agents 3.5 collaborent pour générer un rapport synthétique unique, atteignant un niveau compétitif de pointe sur le benchmark populaire CyberGym.
Étant donné la nature à double usage de cette technologie, nous avons adopté une approche de déploiement prudente. Le modèle sera bientôt proposé en accès restreint via CodeMender dans le cadre d’un projet pilote destiné aux gouvernements et partenaires de confiance. Cela permettra aux défenseurs sur le terrain de détecter et de corriger les vulnérabilités critiques avant qu’elles ne soient exploitées, tout en atténuant les risques d’abus plus larges.
Commencez dès maintenant
3.6 Flash et 3.5 Flash-Lite sont désormais disponibles :
Les développeurs peuvent utiliser l'API Gemini via Google AI Studio et Android Studio. 3.6 Flash est également disponible sur Google Antigravity.
L'entreprise peut être utilisée sur la plateforme Gemini Enterprise Agent. 3.6 Flash est également disponible dans l'application Gemini Enterprise.
Disponible sur l'application Gemini pour tous. 3.5 Flash-Lite est également en cours de déploiement sur Google Search.
Merci de nous faire part de vos retours pour améliorer les futurs modèles Gemini ; nous attendons avec impatience de publier le 3.5 Pro.
