AMD annonce la plateforme Helios AI et prévoit 60 % de l'infrastructure informatique dédiée à l'inférence d'ici 2026

iconMetaEra
Partager
AI summary iconRésumé
AMD a annoncé la plateforme Helios AI, le processeur EPYC Venice de sixième génération, ainsi que les cartes Instinct MI430X et MI350P lors de l'événement Advancing AI 2026. La PDG Lisa Su a déclaré que 60 % de la puissance informatique mondiale dédiée à l'IA sera utilisée pour l'inférence d'ici 2026, soulignant la nécessité de ressources GPU et CPU. AMD collabore avec OpenAI, Meta et Anthropic sur Helios, avec des livraisons prévues à partir du T3 2026. Cette initiative s'aligne sur les tendances croissantes en matière d'actualités IA + crypto et sur l'évolution des politiques crypto mondiales.
AMD a dévoilé lors de la conférence Advancing AI 2026 sa plateforme d'IA en rack Helios, son processeur serveur EPYC Venice de sixième génération, ainsi que les accélérateurs Instinct MI430X et MI350P, marquant ainsi l'entrée d'AMD dans la compétition des usines d'IA avec un système complet composé de GPU, de CPU, de réseaux et de logiciels. Lisa Su prévoit que près de 60 % de la puissance d'IA mondiale en 2026 sera utilisée pour l'inférence ; les agents nécessitent à la fois une grande quantité de GPU pour l'inférence et un grand nombre de CPU pour orchestrer chaque étape. Elle a souligné que AMD a choisi une approche différenciée basée sur l'architecture Chiplet et un portefeuille de produits, en collaborant avec des leaders tels qu'OpenAI, Meta et Anthropic au développement d'Helios, dont les premiers produits seront livrés à la fin du troisième trimestre.

Auteur et source de l'article : Tencent Technology

Lisa Su a résumé la stratégie d'AMD en trois points lors de sa keynote : la supériorité en calcul, une plateforme ouverte et « rendre l'IA omniprésente ».

Advancing AI est l'événement annuel de AMD dédié à l'écosystème du calcul IA. Le 24 juillet 2026, heure de Pékin, AMD a lancé en continu la plateforme IA Helios en rack, le CPU serveur EPYC de sixième génération « Venice », les accélérateurs Instinct MI430X et MI350P, ROCm.AI, ainsi que les plateformes « Gorgon Halo » et Kria AI Robotics dédiées aux agents locaux et aux robots. Avec le MI455X comme cœur de calcul, Helios a été le centre de cette présentation, marquant le fait que AMD entre désormais dans la compétition des usines IA avec un système complet composé de GPU, de CPU, de réseau et de logiciels.

Lisa Su a résumé la stratégie d'AMD lors de sa Keynote en trois points : la supériorité en calcul, une plateforme ouverte, et « rendre l'IA omniprésente ». Derrière ces trois orientations se trouve un jugement clair d'AMD sur l'évolution de l'industrie de l'IA : l'entraînement continuera de s'étendre, mais le centre de consommation de puissance de calcul s'est rapidement déplacé vers l'inférence ; les agents étendent une seule invocation de modèle en une inférence continue, des appels d'outils, l'exécution de code et l'accès aux données, transformant ainsi l'infrastructure IA d'un problème GPU en un projet systémique impliquant le CPU, le réseau, le logiciel, l'alimentation électrique et les centres de données.

Lisa Su prévoit qu'en 2026, environ 60 % de la puissance de calcul mondiale pour l'IA sera utilisée pour l'inférence, et souligne que les agents ont besoin à la fois de « beaucoup de GPU pour l'inférence » et de « beaucoup de CPU pour orchestrer chaque étape ».

Le 24 juillet, lors de l'événement AMD Advancing AI 2026, la présidente du conseil et PDG d'AMD, Dr. Lisa Su, le vice-président senior de la division IA d'AMD, Vamsi Boppana, ainsi que le vice-président senior et directeur général de la division Calcul et IA entreprise d'AMD, Dan McNamara, ont échangé pendant près d'une demi-heure avec des médias mondiaux, y compris Tencent Technology. Contrairement à la présentation produit du Keynote, cet échange a abordé plusieurs des questions les plus cruciales pour AMD actuellement : la demande en IA continuera-t-elle de croître à un rythme soutenu, Helios sera-t-il livré selon le planning prévu, comment AMD peut-il rattraper NVIDIA, et l'écosystème ouvert est-il une voie commerciale viable.

Lisa Su a également fourni une analyse d'AMD sur la demande : « Plus l'IA est utile, plus les gens veulent l'utiliser. » Selon elle, les investissements des entreprises dans l'IA sont passés de la réduction des coûts initiale à la création de valeur plus directe, comme le développement de produits et la croissance des activités. Par conséquent, même si les entreprises commencent à limiter leurs budgets en tokens, cela ne changera pas la tendance à long terme à la hausse de la demande en puissance de calcul.

Face à la question directe de savoir si AMD suit toujours NVIDIA, Lisa Su n’a pas évité la réponse. Elle a déclaré qu’AMD avait choisi une voie différente : utiliser l’architecture Chiplet et une gamme de produits pour couvrir diverses charges de travail, tout en reliant les clients et les partenaires grâce à un écosystème ouvert. Elle a souligné qu’AMD ne se contentait pas de la croissance naturelle du marché, mais « prévoit une croissance supérieure à la moyenne du marché dans chaque segment dans lequel elle participe » ; passer du MI450 au MI500 « n’est pas une simple mise à jour, mais un autre saut majeur ».

Cette approche compétitive se reflète également dans la méthode de développement d’Helios. Lisa Su a déclaré qu’Helios n’a pas été conçu indépendamment par AMD avant d’être remis aux clients, mais plutôt co-conçu avec des entreprises de premier plan telles qu’OpenAI, Meta et Anthropic. Les clients intègrent plus tôt le processus de définition du produit, du chip au logiciel, en passant par les centres de données et la chaîne d’approvisionnement. Elle a qualifié cette collaboration de « arme secrète » essentielle pour la production en série d’Helios à temps.

Les entreprises commencent à contrôler les budgets Token, pourquoi AMD croit-elle toujours que le marché de l'IA connaîtra une croissance rapide ?

Lisa Su : C'est une excellente question.

Premièrement, il faut reconnaître que prévoir les marchés est l'une des tâches les plus difficiles, car les prévisions ne sont presque jamais entièrement précises.

Ce que nous pouvons déterminer, c’est que nous avons passé beaucoup de temps à échanger avec nos clients pour comprendre les changements fondamentaux qui se produisent au niveau des charges de travail. Ce que nous observons maintenant, c’est une demande très forte en puissance de calcul. Cela s’applique au domaine des GPU et des accélérateurs, mais la vitesse des changements dans le domaine des CPU est en réalité encore plus radicale.

Quant à la raison pour laquelle nous croyons que cette tendance se poursuivra, vous avez tous entendu aujourd'hui les points de vue d'OpenAI, de Meta et d'autres grands clients. Nous devons planifier des années à l'avance pour être prêts en matière de puces, d'électricité, de centres de données et de toute la chaîne d'approvisionnement. C'est pourquoi nous collaborons maintenant avec nos clients plus étroitement que jamais.

L'IA est un exemple typique : plus elle est utile, plus les gens veulent l'utiliser. Bien sûr, tout le monde continuera à l'optimiser.

Dan a précédemment mentionné ce que nous observons lors de notre collaboration avec des clients professionnels. Mais quelle que soit la situation, la tendance générale à l'adoption de l'IA continue d'augmenter. Nous constatons que l'IA joue un rôle de plus en plus important dans le développement de produits ainsi que dans d'autres domaines clés utilisés par les entreprises pour créer de la valeur.

La valeur apportée par l'IA dépasse largement la réduction des coûts. Bien que la réduction des coûts ait pu être le point de départ initial des entreprises pour déployer l'IA, elle est désormais de plus en plus utilisée pour créer une véritable valeur entreprise.

Nous avons donc une grande confiance dans la courbe de demande.

En parallèle, les gens commencent progressivement à comprendre que la question ne se limite plus à un seul processeur : il faut une famille complète de puces, un portefeuille de produits et un écosystème matériel. C’est toujours ce jugement unique qu’AMD défend.

Quelle est la complexité d’Helios ? Le projet Helios est prévu pour être déployé au second semestre de cette année ; comment AMD définit-il ce déploiement ? Pourquoi êtes-vous confiant de pouvoir le réaliser selon le planning ?

Lisa Su : Tout d'abord, je veux reconnaître cela de manière très claire. Vous avez probablement déjà vu, à partir du matériel présenté sur scène, que Helios est vraiment impressionnant.

C'est un accomplissement ingénieur incroyable, impliquant une puissance de calcul élevée, une alimentation électrique, une intégration système, une densité, et de nombreux autres éléments.

Mais il faut se souvenir que nous nous préparons à ce moment depuis plusieurs années.

Cela inclut nos capacités internes, telles que ROCm et les compétences logicielles de la plateforme ; les capacités développées par l'équipe réseau ; ainsi que nos acquisitions de Pensando et ZT Systems, et l'intégration de ces compétences.

Ce que je souhaite que vous ressentiez aujourd'hui comme une « arme secrète », c'est que nous restons parfaitement synchronisés avec nos partenaires. Autrement dit, AMD ne développe pas indépendamment puis transmet les produits à ses partenaires. Nous les développons ensemble.

OpenAI travaille avec nous, Meta travaille avec nous. Vous avez également entendu le partage de Tom Brown, cofondateur d'Anthropic. C'est pourquoi nous sommes très confiants dans la montée en puissance de notre produit.

« La production à grande échelle » signifie que nous sommes prêts à expédier. Nous commencerons les expéditions à la fin du troisième trimestre, puis augmenterons progressivement notre volume au quatrième trimestre et au premier semestre de l'année prochaine.

Les premiers produits seront déployés dans quels centres de données ? Nous avons déjà établi un plan clair. Nous collaborons également étroitement avec nos partenaires ODM. Une différence majeure de Helios par rapport aux produits précédents est que chaque maillon de la chaîne d'approvisionnement a déjà été aligné. C’est aussi une raison fondamentale de notre confiance.

Je suis très enthousiaste à propos des progrès de Helios.

Aujourd'hui, AMD a lancé de nouveaux racks de centre de données et annoncé des collaborations avec Cerebras ainsi que des progrès logiciels. Toutefois, selon la feuille de route, ces produits semblent toujours suivre NVIDIA. Ou bien la stratégie d'AMD n'est-elle pas de viser la première place, mais plutôt de considérer que le marché de l'IA est suffisamment vaste pour qu'une part de marché modeste, même en deuxième position, soit acceptable ?

Lisa Su : Nous avons effectivement lancé de nombreux produits aujourd'hui. Mais sérieusement, nous pensons que nous traçons la voie vers ce dont le calcul IA aura réellement besoin à l'avenir. Les GPU sont bien sûr extrêmement importants, et nous sommes très confiants dans notre feuille de route pour les GPU.

Comme je l'avais annoncé aujourd'hui, passer de MI450 à MI500 n'est pas une simple mise à jour mineure, mais un autre saut majeur.

Nous croyons qu'AMD prendra une position de leader dans l'extension des performances de calcul Scale-up. Il s'agit d'un jugement très important, mais c'est bien la direction que nous observons actuellement.

Nous avons choisi un chemin différent. Au cours des dix dernières années, et particulièrement des cinq dernières années, nous avons investi dans l'architecture Chiplet et l'architecture de portfolio de produits.

Avec EPYC comme exemple, tout le monde commence à trouver les processeurs intéressants, mais nous préparons ce moment depuis de nombreuses années.

Mark Papermaster et son équipe ont constamment réfléchi à la manière de créer un écosystème permettant à différentes charges de travail d'utiliser la puce la plus adaptée. Cette vision sous-tend également notre feuille de route globale.

Nous sommes donc très confiants dans notre position actuelle. Il s'agit d'un marché énorme. AMD estime que l'opportunité de marché totale à laquelle nous nous adressons atteindra 2 000 milliards de dollars d'ici 2030, un chiffre très considérable.

Mais nous ne souhaitons pas seulement partager la croissance du marché. Nous prévoyons qu'AMD connaîtra une croissance supérieure à la moyenne du marché dans chacun des segments dans lesquels nous participons.

AMD participera à la concurrence à sa manière. Notre approche repose sur des technologies de pointe, un écosystème ouvert et le choix du calcul adapté à chaque charge de travail. Il faut donc à la fois de la largeur et de la profondeur.

Vamsi Boppana : Lisa a déjà tout dit.

De nouveaux segments émergent constamment sur le marché. Nous devons rester concentrés et exécuter rigoureusement les tâches les plus importantes à court terme, sinon nous risquons facilement d’être dispersés par diverses directions.

Mais à un moment donné, nous choisirons un segment spécifique et affirmerons clairement que nous croyons fermement atteindre une avance indiscutable dans ce domaine. Nous sommes très confiants à ce sujet.

Lisa Su : Au moins aujourd'hui, nous pouvons affirmer avec certitude qu'AMD détient une position de leader indiscutée dans le domaine des CPU.

En 2025, AMD a conclu un accord de commande et de déploiement de puces avec OpenAI et lui a délivré des warrants pouvant équivaloir à jusqu'à environ 10 % des actions. Pourquoi la structure de cette transaction diffère-t-elle de celle avec Anthropic ? Quels changements le marché a-t-il connus au cours de la dernière année ?

De plus, quel est l'état actuel du déploiement d'OpenAI ? Selon le plan initial, les déploiements associés devraient commencer au second semestre 2026.

Lisa Su : Tout d'abord, nous sommes très heureux, honorés et enthousiastes de collaborer avec les entreprises les plus innovantes au monde en matière d'IA, notamment OpenAI, Anthropic, Meta et d'autres.

Je l'expliquerais ainsi : chaque transaction est différente.

Nous entretenons une relation très particulière avec OpenAI. Vous avez probablement pu le ressentir aujourd'hui à travers les partages de Sachin et Philippe.

Nous avons collaboré avec OpenAI dès le début avec le MI300. Les deux parties ont conjointement étudié la feuille de route et avancé le logiciel. Franchement, OpenAI a fait un engagement important envers AMD, incluant un déploiement pouvant atteindre jusqu'à 6 GW.

Nous avons précédemment indiqué que le premier 1 GW serait déployé à partir du second semestre 2026 et se poursuivrait jusqu'en 2027. Je peux confirmer que ce plan avance exactement comme prévu.

Sans cibler un client spécifique et en parlant uniquement de la situation globale, la demande totale pour la série MI450 dépasse les attentes initiales.

Les clients ont vu les performances réelles du matériel et ont aimé les résultats observés. Nous augmentons donc la capacité de production et l'échelle d'approvisionnement pour les prochains trimestres.

Concernant Anthropic, j'ai également mentionné brièvement cela sur scène : AMD suit Anthropic depuis plusieurs années. Dès la création de l'entreprise par Dario et Tom, nous avons toujours porté une grande attention à cette société.

Mais ce type de partenariat nécessite toujours de trouver le bon moment. Pour toute entreprise, intégrer une nouvelle plateforme de puces exige un important investissement en ingénierie. Nous comprenons donc que pour Anthropic, dédier ses ressources en ingénierie, ses ressources, son financement et son temps à la plateforme AMD représente une décision très importante.

Chaque transaction est différente. Le protocole d'Anthropic repose principalement sur MI450, avec une capacité maximale pouvant atteindre 2 GW. Le premier projet de 1 GW devrait commencer à être déployé au premier semestre 2027. Nous discutons également avec Anthropic de plans à plus long terme.

Ainsi, les deux transactions utilisent simplement des structures différentes.

Comment Anthropic et AMD collaborent-ils exactement ? Cela implique-t-il des ressources de centre de données ?

Lisa Su : Bien sûr. La relation entre AMD et Anthropic repose d'abord sur la fourniture d'une grande capacité de calcul pour soutenir la croissance continue d'Anthropic.

Les utilisateurs peuvent s'attendre à ce qu'Anthropic utilise les GPU et CPU d'AMD via plusieurs canaux, notamment des services cloud, et potentiellement également ses propres centres de données.

Nous collaborons étroitement avec Anthropic pour prendre en charge ces différentes formes de déploiement. La portée de cette collaboration va bien au-delà de l'achat simple de puces ; les deux parties travailleront ensemble à la mise en œuvre et au démarrage du système, ainsi qu'à la collaboration sur le fonctionnement de Claude sur la plateforme AMD.

Du point de vue logiciel, Claude et Codex sont parmi les plateformes les plus puissantes et les plus populaires actuellement.

Nous souhaitons que les développeurs puissent utiliser ces plateformes pour développer de manière très efficace sur du matériel AMD. Cela fait également partie des éléments importants de cette collaboration.

En ce qui concerne les centres de données, nous nous efforçons activement de garantir une capacité de déploiement suffisante sur le marché. C'est effectivement l'un des domaines prioritaires d'AMD, mais il ne concerne pas uniquement Anthropic, il s'agit plutôt de répondre à la demande globale du système et de l'écosystème.

Étant donné que AMD possède ses propres ressources et expérience en conception de puces, continuera-t-elle à collaborer à long terme avec Cerebras, ou cette collaboration n’est-elle qu’une mesure temporaire, AMD développant finalement son propre produit similaire ?

Lisa Su : Je ne considère aucune collaboration comme une solution transitoire temporaire. Nous n'entamons pas de collaborations en pensant « au départ, ce n'est qu'une mesure provisoire ».

Nous collaborons avec Cerebras parce que Cerebras possède une technologie très intéressante. Il existe de nombreuses voies différentes pour réaliser l'accélération adaptée à des charges de travail spécifiques. La technologie de Cerebras en est une particulièrement intéressante et peut très bien s'intégrer avec Helios.

L'écosystème ouvert mentionné par AMD signifie que nous collaborerons avec plusieurs entreprises possédant des technologies précieuses, à condition que ces technologies répondent à notre jugement en matière de développement à long terme.

À long terme, je pense qu’il y aura davantage de découplage et de séparation des charges de travail. La vitesse à laquelle cette tendance progressera dépend en partie de la structure des coûts et des niveaux de prix des différentes solutions.

Mais du point de vue d'AMD, nous disposons d'une feuille de route fondamentale très solide, incluant les MI400, MI500 et MI600. En parallèle, nous possédons également la capacité de combiner et d'associer différentes technologies de calcul.

Nous sommes très enthousiastes à l'idée de notre collaboration avec Cerebras. Vous pouvez vous attendre à ce qu'AMD continue de promouvoir la séparation et l'accélération ciblée de davantage de charges de travail à l'avenir.

Vamsi Boppana : Je vais rapidement ajouter un point. En réalité, il n'est pas nécessaire de regarder trop loin : la gamme actuelle de produits AMD contient déjà de nombreux petits moteurs d'IA capables d'effectuer des tâches à ultra-faible latence, ultra-faible consommation et réponse en temps réel.

Vous pouvez consulter notre gamme de produits intégrés et leurs applications dans des domaines tels que l'automobile et les équipements médicaux. L'idée principale est qu'AMD croit que l'IA entrera dans diverses formes de calcul de manière étroitement intégrée, avec des caractéristiques différentes selon les scénarios. Nous proposons des solutions adaptées à chacun de ces scénarios.

Cet article provient de Tencent Technology, auteur : Xiao Jing, éditeur : Xu Qingyang, publié avec autorisation de 36Kr.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.