Le PDG d'AWS déclare que l'inférence IA alimente désormais deux tiers de la demande en calcul, impactant les mineurs de crypto

iconCryptoBriefing
Partager
AI summary iconRésumé
Les actualités sur l’IA et la crypto ont fait surface lors d’AWS re:Invent 2025, lorsque le PDG Matt Garman a révélé que l’inférence IA alimente désormais deux tiers de la demande en calcul, contre un tiers en 2023. Il a déclaré que l’inférence générera 80 à 90 % de la valeur de l’IA pour les entreprises. AWS lance des puces Trainium3 pour les charges de travail d’inférence. Les actualités sur la crypto montrent que les mineurs utilisant du matériel pour l’entraînement de l’IA pourraient faire face à des obstacles, car l’inférence nécessite un matériel différent. Les réseaux de calcul décentralisés pourraient voir une utilisation accrue s’ils gèrent l’inférence à faible latence.

Lors d'AWS re:Invent 2025, le PDG d'AWS, Matt Garman, a présenté un indicateur simple mais significatif : l'inférence IA représente désormais environ deux tiers de la demande totale de calcul IA. Cela représente une hausse par rapport à environ un tiers en 2023.

L'entraînement consiste à apprendre à un modèle à penser. L'inférence consiste réellement à le faire penser. L'industrie a dépensé des milliards pour entraîner ces modèles, et les dépenses se déplacent désormais vers leur mise en œuvre.

Garman, qui a pris la direction d'AWS en juin 2024 après avoir succédé à Adam Selipsky, a décrit l'inférence comme « un nouveau Lego » dans l'informatique. Il affirme que l'inférence devient un bloc de construction de base que les entreprises assembleront pour automatiser des tâches, exécuter des agents IA et transformer fondamentalement la manière dont les entreprises fonctionnent.

Publicité

Il est allé plus loin en prédisant que 80 à 90 % de la valeur de l'IA dans les entreprises proviendront finalement d'agents alimentés par l'inférence. Pas des chatbots résumant vos e-mails, mais des systèmes autonomes accomplissant réellement des tâches.

AWS met également du matériel derrière ce pari. L'entreprise a présenté ses puces Trainium3 lors de re:Invent, conçues spécifiquement pour les charges de travail d'inférence, et non les GPU optimisés pour l'entraînement qui ont dominé les actualités et les rapports financiers de Nvidia.

Ce changement est extrêmement important pour le secteur du minage de crypto-monnaies, qui traverse une crise d'identité. Alors que les marges de minage de bitcoin se sont resserrées après le halving d'avril 2024, plusieurs grands mineurs ont pivoté vers l'offre de services d'intelligence artificielle et de calcul haute performance. Des entreprises comme Core Scientific, Hut 8 et d'autres réaffectent leurs parcs GPU et leur capacité de centres de données pour répondre aux besoins d'entraînement de l'IA.

Mais si Garman a raison et que la courbe de demande se courbe fortement vers l'inférence, les exigences matérielles changent. L'entraînement exige un traitement parallèle massif à travers des clusters de GPU de haut niveau fonctionnant pendant des semaines ou des mois. L'inférence nécessite une optimisation différente : une latence plus faible, un débit plus élevé par requête, et souvent des architectures de puces complètement différentes.

Pour les investisseurs natifs de la crypto, le signal ici concerne la durabilité de la thèse du « pivot IA » qui a soutenu plusieurs actions minières. Surveillez les entreprises minières qui annoncent des partenariats avec des fournisseurs de cloud ou investissent dans du matériel optimisé pour l’inférence. Celles qui continuent de promouvoir un accès GPU générique pour l’entraînement risquent de se retrouver du mauvais côté d’une courbe de demande déjà déplacée.

Les réseaux de calcul décentralisés comme Render, Akash et io.net se positionnent comme des alternatives aux fournisseurs de cloud centralisés pour les charges de travail IA. Si la demande en inférence croît au rythme décrit par Garman, ces protocoles pourraient connaître une utilisation accrue, mais uniquement s’ils peuvent offrir le service à faible latence et haute fiabilité requis par l’inférence. L’entraînement tolère les interruptions réseau. L’inférence, elle, ne les tolère pas.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.