Google et Tencent ont effectué presque la même démarche sur leurs modèles : petits modèles, efficacité, vitesse d'inférence, coût réduit, intégration dans les écosystèmes, avec un accent mis sur la densité intelligente plutôt que sur la limite maximale d'intelligence. Google a lancé trois modèles, dont le principal est Gemini 3.6 Flash. Du côté de Tencent, le modèle HunYuan Hy3 a été officiellement publié le 6 juillet. Les deux n'ont pas cherché à rivaliser avec les modèles phares les plus coûteux. Le modèle 3.5 Pro de Google n'est toujours pas rendu public ; selon Bloomberg, il n'a pas atteint les seuils internes de performance. Le Hy3 de Tencent compte 295 milliards de paramètres totaux, mais n'active que 21 milliards grâce à son architecture MoE, consommant seulement 7 % des ressources de calcul lors de chaque inférence. C'est très intéressant. Le prix de sortie de 3.6 Flash est passé de 9 à 7,5 dollars, tandis que sa vitesse est passée de 165 à 304 tokens/s — soit presque un doublement. L'indice d'intelligence reste à 50, mais il utilise moins de tokens : la facture pour les mêmes évaluations est tombée de 1 041 à 727 dollars, soit une réduction de 30 %. Hy3 va encore plus loin : le taux de résolution des tâches d'agent bureautique est passé de 72 % à 90 %, avec une économie de 47,4 % des tokens pour les documents et de 49,0 % pour les présentations. Aujourd'hui, ces deux géants ne cherchent plus à savoir qui a le modèle le plus intelligent. Ils se battent pour un bien bien plus précieux : l'entrée par défaut. L'intelligence suffit tant qu'elle est adaptée ; ce qui compte vraiment, c'est d'intégrer le modèle dans les produits que les utilisateurs utilisent déjà. Google dispose de Copilot, Workspace et Antigravity. Tencent possède WeChat, Yuanbao, WorkBuddy, Tencent Docs et des jeux. Lorsque vous utilisez Hy3 dans WorkBuddy pour exécuter des flux de travail, ou que vous générez une présentation en une seule phrase dans Yuanbao, cette expérience disparaît hors de l'écosystème Tencent. Google intègre Flash dans Copilot, et des développeurs du monde entier l'utilisent quotidiennement pour coder. Pour les plateformes maîtrisant les canaux de distribution, la meilleure stratégie n'est pas d'atteindre la première place au classement, mais de faire en sorte que leur modèle devienne l'option par défaut, choisie sans réflexion. L'intelligence devient une marchandise ; l'intégration est la barrière à l'entrée. Pour les fabricants indépendants de modèles, c'est très difficile : la concurrence est homogénéisée et le coût de remplacement est faible. Même un score plus élevé n'a pas d'impact : les utilisateurs avancés sont limités, les utilisateurs ordinaires ne changent pas, et pour les tâches courantes, le changement de modèle n'a guère d'effet. À moins d'atteindre une nette supériorité dans une capacité verticale spécifique, il est impossible de briser le verrouillage des plateformes. Au cours de la prochaine année, le facteur décisif ne sera plus les paramètres du modèle, mais la stabilité des agents. Celui dont les flux de travail à plusieurs étapes seront les plus stables, les plus économiques et les moins sujets aux erreurs remportera la partie. Google et Tencent, qui contrôlent les points d'accès au trafic, ont choisi la bonne voie ; leur commercialisation s'effectuera avec davantage de fluidité.
链研社|AI First🔶💧Partager
Source:Afficher l'original
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations.
Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.