Google semble préparer deux nouveaux modèles d’IA pour déploiement, avec des identifiants pour Gemini 3.6 Flash et Gemini 3.5 Flash Lite apparus dans l’infrastructure de développement de l’entreprise. L’identifiant du modèle gemini-3.6-flash-tiered a été repéré dans l’IDE Antigravity de Google, ce qui suggère que ces modèles sont au moins proches d’être prêts pour un accès externe via AI Studio et l’API Vertex.
Ce que nous savons réellement sur les nouveaux modèles
Les inscriptions de Gemini 3.6 Flash et 3.5 Flash Lite ont été initialement notées le 21 juillet 2026. L'inscription interne dans les outils de développement est généralement l'une des dernières étapes avant que le modèle ne devienne accessible au public, bien qu'elle ne garantisse pas un lancement imminent.
Le modèle existant Gemini 3.5 Flash de Google reste opérationnel sur AI Studio et Vertex AI. Ce modèle fonctionne actuellement à environ 1,50 $ le million de jetons d'entrée et 9 $ le million de jetons de sortie, avec une fenêtre de contexte de 1 million de jetons.
Le suffixe « tiered » dans l'ID enregistré du modèle 3.6 Flash suggère une structure tarifaire avec plusieurs niveaux d'accès, différenciant probablement les niveaux gratuits limités en débit et les niveaux payants de production.
Aucun des deux modèles n’a fait l’objet d’une annonce publique formelle de la part de Google, et aucune documentation n’est apparue sur les pages développeur de l’entreprise à ce jour.
Le problème Gemini 3.5 Pro
Le Gemini 3.5 Pro de Google a été étrangement retardé. Le modèle Pro représente l'offre supérieure de Google en matière de raisonnement et de capacité, conçue pour rivaliser avec les modèles les plus avancés d'OpenAI, d'Anthropic et d'autres laboratoires de pointe. Publier des variantes Flash et Flash Lite en solution provisoire tandis que le modèle Pro fait face à des retards est conforme au schéma historique de Google, qui associe des releases rapides de la gamme Flash à des modèles Pro plus raffinés.
Ce que cela signifie pour le marché de l'IA et les investisseurs
Le parent de Google, Alphabet, reste l'une des plus grandes entreprises investissant dans l'infrastructure et le développement de modèles d'IA à l'échelle mondiale. L'enregistrement de nouvelles variantes de modèles témoigne d'un engagement continu à élargir l'écosystème Gemini, même si la date de sortie du modèle phare est repoussée.
À environ 1,50 $ à 9 $ par million de jetons pour le modèle Flash actuel, Google se positionne de manière compétitive face à ses concurrents. Un modèle Flash Lite pourrait réduire encore davantage ces coûts, potentiellement en proposant des tarifs inférieurs à ceux des concurrents qui facturent des tarifs premium pour une qualité d’inférence comparable.
