Google a lancé trois nouveaux modèles Gemini, avec un accent mis sur les coûts d'appel, la vitesse de réponse et les scénarios d'IA agent. Toutefois, le Gemini 3.5 Pro, attendu par le public, n'a pas encore été publié, ce qui retarde le calendrier de production.
3.5 Pro reste en phase de test
Google avait indiqué lors de la conférence I/O 2026 en mai que Gemini 3.5 Pro serait lancé dans un mois. Toutefois, selon des rapports, le modèle n'a pas atteint ses objectifs lors des tests internes, notamment en ce qui concerne les tâches de programmation, où ses performances ont été inférieures aux attentes, ce qui a empêché son lancement à temps.
Bloomberg a précédemment indiqué que Google avait tenté, fin juin, de corriger le problème en mettant à jour les données d'entraînement, mais les résultats n'ont pas été satisfaisants. Google se contente pour l'instant de déclarer que Gemini 3.5 Pro sera publié « dès qu'il sera prêt ».
3.6 Flash réduit les prix et améliore l'efficacité
La version principale de cette publication est Gemini 3.6 Flash, toujours positionnée comme un modèle léger pour les agents IA et les scénarios à forte fréquence d'appel. Par rapport à Gemini 3.5 Flash, ce modèle réduit la consommation de tokens de sortie d'environ 17 %, et le prix de sortie passe de 9 $ à 7,5 $ par million de tokens.
Les tests de référence publics montrent que Gemini 3.6 Flash présente une amélioration significative par rapport à la génération précédente sur plusieurs tâches, notamment en ingénierie logicielle, en ingénierie d'apprentissage automatique et en opérations informatiques. Le score DeepSWE v1.1 est passé de 37 % à 49 %, MLE-Bench de 49,7 % à 63,9 %, et OSWorld-Verified atteint 83,0 %.
Cependant, dans certaines évaluations de programmation et de travail intellectuel, les modèles similaires d'OpenAI et d'Anthropic restent en avance. Le rapport mentionne également que Gemini 3.6 Flash présente encore des erreurs de format et des résultats non directement utilisables lors de tests de programmation simples.
Flash-Lite et Cyber sont conçus pour des scénarios différents
Gemini 3.5 Flash-Lite met l'accent sur un haut débit et des coûts réduits, ce qui le rend idéal pour le traitement de documents, les systèmes de recherche et les flux de travail par lots. Ce modèle peut produire jusqu'à 350 tokens par seconde, avec un prix d'entrée de 0,3 $ par million de tokens et un prix de sortie de 2,5 $.
Une autre version de Gemini 3.5 Flash Cyber ne sera pas accessible au public. Google la réserve aux organismes gouvernementaux et aux partenaires approuvés pour la détection et la correction de vulnérabilités logicielles.
Gemini 4 a lancé la pré-formation
Google a également confirmé que la pré-formation de Gemini 4 a commencé. La pré-formation est la phase où le modèle apprend à grande échelle les données de base, ce qui signifie que Gemini 4 est désormais dans le processus de développement réel, et non plus seulement en phase de planification.
Gemini 3.6 Flash et Gemini 3.5 Flash-Lite sont désormais disponibles sur l'application Gemini, Google AI Studio et l'API.
