Google améliore Gemini 3.8 Flash, le prix est gelé jusqu'en 2026

icon币界网
Partager
AI summary iconRésumé
Google a lancé Gemini 3.8 Flash et la variante 3.8 Flash Cyber pour la mise à niveau du réseau, seulement trois semaines après la version 3.7. La version standard 3.8 Flash est désormais disponible via l'API Gemini, Google AI Studio, Android Studio et dans certains produits grand public, tandis que la version Cyber est uniquement accessible aux agences gouvernementales et aux opérateurs d'infrastructures. Les prix restent gelés à 0,75 $ par million de jetons d'entrée et 3,75 $ par million de jetons de sortie jusqu'à la fin de 2026, après quoi ils doubleront. Les tâches complexes peuvent utiliser davantage de jetons, augmentant ainsi les coûts. Les nouvelles sur les prix des crypto-monnaies indiquent une tarification stable pour le moment, mais des changements sont prévus l'année prochaine.
CoinDesk rapporte :

Google a lancé Gemini 3.8 Flash et 3.8 Flash Cyber dédié à la défense cybernétique le 2 septembre. À seulement trois semaines après le lancement de 3.7 Flash, il s'agit du troisième mise à jour de la série Flash en six semaines. Google positionne 3.8 comme le modèle Flash le plus puissant en matière de raisonnement et de codage actuel ; la version standard est désormais disponible sur Gemini API, Google AI Studio, Android Studio, Gemini Enterprise et certains produits grand public ; la version Cyber est uniquement accessible en priorité aux organismes gouvernementaux fiables, aux exploitants d'infrastructures critiques et aux mainteneurs de logiciels via le nouveau programme Fairwind. Les deux versions partagent une intelligence de base, mais diffèrent par leurs autorisations de déploiement et leurs protections de sécurité.

Le prix d'introduction de GPT-3.8 Flash reste de 0,75 dollar par million de jetons d'entrée et de 3,75 dollars pour la sortie, identique à celui de la version 3.7. Toutefois, ce tarif ne sera valable qu'jusqu'au 31 décembre 2026 ; à compter du 1er janvier 2027, les prix officiels passeront à 1,50 dollar pour l'entrée et 7,50 dollars pour la sortie. Ce qui est plus facile à négliger, c'est que le modèle effectue davantage d'étapes d'inférence et appelle répétitivement des outils lors de tâches complexes ; Google a clairement averti qu'un niveau d'effort élevé pourrait consommer davantage de jetons. Une augmentation du prix unitaire n'équivaut pas à une facture totale inchangée pour une tâche donnée.

Flash commence à concourir pour les tâches longues, avec un accent sur le taux d'achèvement, au-delà de la vitesse

Les preuves présentées par Google couvrent le codage à long terme, l'analyse professionnelle et le raisonnement en plusieurs étapes. 3.8 Flash dépasse la plupart des modèles de pointe plus grands dans l'évaluation Long-Term Software Engineering de DeepSWE v1.1 ; il obtient 54,9 % sur HLE-Verified. L'entreprise cite également des benchmarks pour des agents financiers et juridiques, indiquant qu'elle cherche à faire évoluer Flash d'un modèle de réponse à faible latence vers un modèle capable de planifier en continu, d'appeler des outils et de livrer des résultats complets. Des démonstrations telles que la visualisation de la décomposition matérielle, la génération d'une carte en version DOS à partir d'une seule invite et un jeu 3D soulignent que le modèle ne se contente pas de produire des extraits de code, mais peut vérifier et modifier en boucle le produit final.

Cependant, le score de référence ne peut pas être échangé directement contre la productivité de l'entreprise. Le taux de réussite des tâches longues est souvent influencé par la taille du dépôt de code, l'environnement de dépendance, la qualité des tests, les autorisations des outils et le budget de réessais. La stratégie « plus assidue » de 3.8 augmente le taux d'achèvement, mais accroît également le temps d'exécution et la consommation de tokens. Les équipes de développement doivent enregistrer le coût par appel, le nombre total de tokens par tâche, le nombre d'appels d'outils, le nombre de réessais avant succès et le temps de retraitement humain pour déterminer si la mise à niveau est véritablement moins coûteuse. Pour les charges de travail où la latence ou le budget sont prioritaires, Google recommande toujours de réduire le niveau d'effort ou de continuer à utiliser 3.7 Flash ; les anciennes versions ne sont pas immédiatement abandonnées à la sortie d'un nouveau produit.

La version standard est désormais disponible pour les développeurs et les entreprises ; les utilisateurs de Google AI Pro et Ultra peuvent également l'utiliser dans l'application Gemini, le mode IA de recherche et Gemini dans Sheets. Les fonctionnalités, les quotas et la disponibilité régionale peuvent varier selon les points d'accès, donc il ne faut pas affirmer que « le modèle est publié » signifie que tous les utilisateurs et tous les produits ont accès aux mêmes capacités. En particulier, les flux de travail avec des outils autonomes dépendent de la capacité de l'application à fournir au modèle les outils, les autorisations et un environnement d'exécution réversible appropriés.

La version Cyber est plus forte et plus étroite ; 47,2 % ne sont pas des engagements de réparation automatique.

Gemini 3.8 Flash Cyber se concentre sur la détection de vulnérabilités et la génération de correctifs. Google affirme qu'il a obtenu un taux de réussite supérieur à 70 % dans des évaluations internes de détection de vulnérabilités couvrant 20 langages de programmation ; dans les évaluations externes de correctifs CWE-Bench, il atteint un pass@1 de 47,2 %, proche du 47,8 % d'un modèle de pointe leader, mais à un coût inférieur. Les utilisations internes par l'équipe de sécurité de Chrome montrent que 3.8 Flash Cyber génère 2,6 fois plus de correctifs de vulnérabilités corrects que le meilleur modèle commercial grand public. Wiz rapporte également une amélioration de 7,5 à 9,7 points de pourcentage du rappel sur ses benchmarks internes de tests d'intrusion, avec un coût réduit de 2,3 à 5,2 fois.

Ces chiffres ont une valeur de référence, mais aussi des limites. Les échantillons, les indications et les méthodes d'évaluation humaine pour les références internes ne sont pas entièrement détaillés dans l'annonce ; un pass@1 de 47,2 % signifie également qu'une seule génération ne garantit pas que la majorité des problèmes soient correctement réparés. Google privilégie la réparation par rapport à l'exploitation et ajoute une protection contre les abus chimiques, biologiques, radiologiques, nucléaires et cybernétiques à la version 3.8 standard. La version Cyber, conçue pour répondre aux besoins de défense professionnelle, adopte des restrictions de cybersécurité plus souples et n'est donc pas entièrement publiée ; elle est uniquement disponible pour les défenseurs de confiance du programme Fairwind.

Ce que cette mise à jour change réellement, c'est l'approche de la série Flash : elle ne repose plus uniquement sur des prix bas et une vitesse élevée pour attirer les demandes en masse, mais cherche à améliorer le taux de réussite des tâches complexes grâce à des cycles d'inférence plus longs. L'erreur la plus courante pour les entreprises qui remplacent directement la version 3.7 par la 3.8 consiste à comparer uniquement les prix par million de tokens. La méthode la plus sûre consiste à tester les tâches réelles par niveaux : limiter l'effort pour les demandes simples, autoriser davantage de cycles pour les tâches longues, et maintenir une approbation humaine et un environnement isolé pour les tâches sensibles. La version 3.8 Flash est déjà disponible, et Cyber est entré dans un programme restreint ; quant à savoir si elle peut accomplir davantage de tâches de production à un coût total inférieur, seule la donnée end-to-end de chaque équipe pourra le déterminer.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.