Compilation originale : Shenchao TechFlow
Invité : Doug O'Loughlin, analyste chez SemiAnalysis (fondateur de Fabricated Knowledge)
Animateur : Dylan Patel, fondateur de SemiAnalysis
Source du podcast : SemiAnalysis Weekly
Ép. 022 - Correction du marché, bulles historiques, financement du développement, politique de l'IA (Doug est de retour)
Date de diffusion : 29 juillet 2026
Déclaration d'intérêts : Doug O'Loughlin et Dylan Patel sont tous deux employés de SemiAnalysis, un organisme de recherche payant dans l'industrie des semi-conducteurs dont le modèle économique dépend de la santé du secteur. Le contenu suivant reflète fidèlement le texte original de la conversation et ne constitue pas un conseil en investissement.
Résumé des points clés
Doug O'Loughlin revient après une longue absence dans le SemiAnalysis Weekly, juste après un fort recul du secteur des semi-conducteurs suivant ce qui a été considéré comme le meilleur premier semestre de l'histoire. Le KOSPI coréen a chuté de 40 %, les particuliers avec un levier 2x ont été liquidés, et SK Hynix a déçu les attentes en raison d'un ralentissement de la hausse des prix lié à son passage à la LTA. Doug compare la situation actuelle à la bulle de Taïwan dans les années 1980, estimant que les comportements de bulle sont très similaires, mais que les fondamentaux restent solides.
Deux personnes débattent violemment sur la question de la véritable ampleur de la demande en IA. Dylan s'appuie sur l'expérience de SemiAnalysis : après le déploiement des agents de codage, les dépenses en IA de l'entreprise ont augmenté de 100 fois, le nombre d'utilisateurs est passé de 9 à 90, et la consommation par utilisateur a également augmenté de 10 fois. Doug ne nie pas la force de la demande, mais soulève une préoccupation fondamentale : l'offre peut être calculée avec précision, mais la demande est un « problème de mille milliards » dont personne ne possède la réponse. Plus crucial encore, les lois d'échelle exigent un doublement des puces, mais les contraintes physiques et institutionnelles — comme les électriciens, le capital et les autorisations — ne peuvent pas doubler en parallèle. Cette année, les géants du cloud ont déjà émis des obligations pour 450 milliards de dollars, financées par des fonds de retraite et des pensions, alors que ces fonds eux-mêmes sont en réduction.
Résumé des points de vue intéressants
À propos du retrait du marché
« À la fin du deuxième trimestre, c’était la meilleure performance de l’histoire du secteur des semi-conducteurs. Ensuite, nous avons commencé à rembourser nos dettes. Plus quelque chose augmente vite, plus la gravité est forte. »
Les Coréens ont un historique de 20 ans : ils achètent toujours au sommet. En 2007, ils ont acheté des banques, en 2021, ils ont acheté des SaaS, cette fois, ils ont fait un yolo sur eux-mêmes.
Le KOSPI a chuté de 40 %, et les personnes avec un effet de levier de 2x ont été entièrement liquidées. Ensuite, une spirale auto-réalisatrice s'est produite : chacun, en voyant son compte réduire, a décidé de vendre, aggravant ainsi la chute.
À propos du cycle mémoire
SK Hynix passe à davantage de LTA, la hausse des prix ralentit de trois fois à 30 à 50 %. Les esprits du monde financier sont défaillants, ils ne regardent que les taux de variation. Dès que la dérivée seconde baisse, ils pensent que le cycle est terminé.
Le scénario des semi-conducteurs est toujours le même : en cas de pénurie, tout le monde passe deux commandes, et les usines, voyant la demande, augmentent follement leur production. Puis, quand la demande éternue, l'offre est encore en augmentation, le taux d'utilisation chute de 100 % à 50 %, et il ne reste plus qu'à négocier les prix.
Concernant la demande en IA
La courbe de demande est la question des mille milliards de dollars. La courbe d'offre est relativement facile à comprendre, mais personne ne sait si la demande est 10 fois ou 100 fois supérieure.
SemiAnalysis est elle-même un exemple : après le déploiement de l'agent de codage, le nombre d'utilisateurs techniques est passé de 9 à 90, et la consommation de jetons par utilisateur a augmenté de dix fois. Les dépenses IA de l'entreprise ont été multipliées par 100.
Concernant les goulets d'étranglement de la chaîne d'approvisionnement
Les États-Unis manquent de 100 000 électriciens. Un électricien intermédiaire gagne 250 000 dollars par an, et jusqu'à 400 000 ou 500 000 dollars avec des heures supplémentaires. Certains utilisent des avions Cessna pour transporter des électriciens jusqu'à des chantiers isolés.
Les géants du cloud ont émis 450 milliards de dollars d'obligations cette année, soit le deuxième plus grand montant après les emprunts du gouvernement américain et de la Chine. Ces fonds proviennent des fonds de retraite et des pensions, mais les réserves des fonds de retraite ne doubleront pas.
TSMC représente directement et indirectement 20 % du PIB de Taïwan. Si ce chiffre doublait, Taïwan devrait avoir plus d'enfants pour suffire à la demande de main-d'œuvre.
Sur la politique de l'IA
L'IA est moins populaire que la glace, moins populaire que les politiciens. Cela n'est pas pris en compte dans les prix. Lors des élections de mi-mandat, l'IA servira de bouc émissaire pour la question du coût de la vie.
Le projet de loi ROSA a été adopté à la Chambre des représentants par 300 voix contre 20, mais il est bloqué au Sénat. Les lobbies d'entreprises empêchent l'adoption de mesures visant à restreindre l'accès à distance chinois aux GPU.
Body
Le meilleur premier semestre de l'histoire de l'industrie des semi-conducteurs, suivi d'un début de remboursement
Dylan : Le marché boursier connaît un recul, tous les noms liés à l'IA baissent. Aujourd'hui, nous allons soit ajouter de l'huile sur le feu, soit apporter un peu de réconfort.
Doug : Jusqu'à la fin du Q2 le 30 juin, ce fut probablement la meilleure performance de l'histoire du secteur des semi-conducteurs. Ensuite, nous avons commencé à défaire cette hausse. Une grande partie peut être attribuée à des facteurs techniques : levier, retournement de momentum. Mais la réalité est que plus quelque chose monte vite, plus la gravité est forte. Nous payons pour le rallye de momentum fou précédent.
La situation en Corée du Sud est folle. Chaque jour, des actions atteignent leur limite baissière. Un tweet dit : « Comment fais-je pour travailler ? » Le directeur des ressources humaines a perdu tout son argent, tout le monde est déprimé car toutes les actions ont chuté. Si vous revenez en arrière sur l’histoire des marchés financiers asiatiques, ce genre d’événement se produit plus fréquemment que vous ne le pensez.
Mon livre préféré traite de la bulle de Taïwan chinois. Taïwan chinois a connu une bulle de 100 fois son revenu par habitant, avec des transactions bancaires à un multiple de 500 fois le bénéfice, tout était fou.
Dylan : À quelle heure est-ce ?
Doug : fin des années 1980.
Dylan : Penses-tu que les fondamentaux en Corée du Sud sont différents maintenant par rapport à cette époque ?
Doug : Les fondamentaux sont bons. Mais le problème, c'est que les choses ne sont jamais aussi mauvaises que la peur le suggère, ni aussi bonnes que vous l'imaginez. SK Hynix a manqué ses prévisions aujourd'hui car elle a opté pour davantage de LTA. Ironiquement, pendant leurs roadshows ADR, ils se plaignaient encore que Micron obtienne des prix plus bas pour ses LTA.
Les prix de la mémoire ont augmenté d'environ trois fois l'année dernière ; il est impossible qu'ils augmentent à nouveau de trois fois l'année prochaine, une hausse de 30 à 50 % est plausible. Mais les acteurs financiers ont perdu la tête et ne regardent que les taux de variation. Historiquement, dans les cycles de la mémoire, dès que la dérivée seconde baisse, c'est généralement la fin. Car le taux de variation ne s'arrête pas à 30 % ; il chute directement à -50 %.
Le scénario de ce cycle est toujours le même : tout le monde investit dans des usines, la capacité est mise en ligne, puis tout le monde se rend compte : « Mon Dieu, pourquoi la demande est-elle si faible ? » Car auparavant, les commandes étaient doublées, voire triplées. La capacité des usines passe de 100 % à 50 %, et la seule façon de retrouver l'équilibre financier est de négocier des prix plus bas. C'est la nature même du marché des semi-conducteurs.
Le KOSPI a chuté de 40 %. Les personnes avec un effet de levier de 2x ont été complètement éliminées. Ensuite, vient une spirale auto-réalisatrice : chacun, en voyant son compte diminuer, décide de vendre, ce qui aggrave encore la chute.
Mémoire chinoise : pourrait gâcher la fête, mais la demande reste supérieure à l'offre
Dylan : Récemment, la mémoire chinoise a intégré l'écosystème, avec les gros IPO de CXMT et YMTC. Qu'en pensez-vous ?
Doug : Ils ont la capacité de production, même si le taux de rendement est faible, cela n'a pas d'importance. Les entreprises chinoises ne concourent pas sur la rentabilité ou les BPA.
CXMT est désormais clairement le quatrième acteur du marché, mais dans ce contexte de pénurie, ils parviennent toujours à générer des bénéfices. Apple a déjà commencé à utiliser la mémoire de CXMT car Micron pratique une « fraude aux prix ». Personne ne pleure dans un casino, Tim Apple. Vous devez acheter au prix du marché.
CXMT pourrait gâcher la fête, mais la réalité est que la demande reste supérieure à l'offre. La vraie question des mille milliards de dollars est : où est exactement la demande ? La courbe d'offre est relativement facile à comprendre. Nous ne connaissons pas la courbe de demande. Nous savons que les agents de codage et les chatbots impliquent une demande accrue, mais nous ne savons pas si elle sera 10 fois ou 100 fois plus élevée. L'offre augmentera aveuglément jusqu'à ce qu'elle heurte un jour la courbe de demande.
L'agent de codage est un tournant : les dépenses IA de SemiAnalysis elles-mêmes multipliées par 100
Dylan : Je pense que la demande est clairement très forte et le restera pendant longtemps. Je n'ai qu'à regarder la consommation interne de ma propre entreprise. Si vous pensez que la demande va se stabiliser ou diminuer à l'avenir, vous devez croire que les modèles ne s'amélioreront plus. Je ne vois aucun signe de stagnation, seulement des signaux dans la direction opposée.
Doug : Laissez-moi jouer l'avocat du diable. Quel est le principal argument à la baisse ? La vitesse des progrès technologiques pourrait dépasser celle de leur adoption par les gens. Supposons que l'application phare de l'IA soit la saisie de données — Kimi K3 suffit. Nous construisons des voitures de plus en plus rapides et des produits de plus en plus performants, mais la courbe de la demande réelle est satisfaite par un produit que nous maîtrisons déjà.
C'est comme la bulle internet : à l'époque, on disait que la demande doublait tous les 90 jours, mais la technologie de fibre optique s'améliorait de 2 à 3 fois par an. La performance de la dernière fibre optique est devenue 500 000 fois supérieure, puis tout le monde a dit : « Attendez, on n'a peut-être pas besoin de tant de fibres optiques ».
Dylan : Je ne suis pas d'accord, mais c'est une discussion valable. Ma réfutation est la suivante : il y a encore 100 à 1000 fois plus de personnes qui n'utilisent aucun modèle pour le moment. Deuxièmement, les cas d'utilisation de l'IA vont bien au-delà du codage. Elle peut également être utilisée pour la génération vidéo, la découverte de médicaments, la science des matériaux. Quelqu'un utilise l'IA pour créer des composants supraconducteurs : combien cela vaut-il ? Beaucoup d'argent en GPU.
Et le codage lui-même ne se résume pas à « centrer un div ». Il représente toute une catégorie de tâches dont la valeur économique dépasse largement celle du débogage frontend. Sam Altman parle de RSI (amélioration récursive de soi), et Anthropic prépare un nouveau modèle. Les agents de codage, à la version Claude 4.5, constituent un tournant clair : vous franchissez une ligne d’intelligence, et un tout nouveau marché émerge. Ce que vous ne pouviez pas faire la veille, vous le pouvez déjà le lendemain.
Doug : Vous êtes l'utilisateur prototype. Il y a un an à cette époque, moins de 10 personnes de l'équipe technique de SemiAnalysis utilisaient l'agent de codage, puis vous avez dit à Dylan : « Tout le monde dans l'entreprise doit apprendre à l'utiliser ». Maintenant, nous avons 90 utilisateurs.
Dylan : De 9 à 90, un facteur 10. Ensuite, dans les 3 à 4 mois suivants, la consommation par personne augmente également d'environ 10 fois. Les dépenses IA des entreprises augmentent de 100 fois. La question maintenant est : toutes les entreprises feront-elles de même ? Peut-être pas avec cette intensité, mais beaucoup d'entreprises ont beaucoup de travaux à réduire.
Le H100 ne deviendra pas de la ferraille, mais les modèles deviennent plus grands
Doug : Je pense que les anciens processeurs deviendront inutiles. Tout le monde dit que « l’H100 est un actif qui se valorise », mais un jour, il faudra 100 H100 pour faire de l’inférence sur un modèle. À ce moment-là, tu diras : « Laissons la vieille fille à la retraite et achetons une B300 ». Le véritable signal de confirmation sera la divergence de prix entre la B200 et la B300.
Dylan : Je ne suis pas du tout d'accord. La raison fondamentale est que personne ne démonte un H100 pour le remplacer par un B300. La conception des centres de données est totalement différente. Vous ne pouvez pas remplacer un Hopper par un Blackwell ou un Rubin dans le même data center ; vous devez tout démonter et tout reconstruire. Pour justifier la mise à la retraite d'un centre de données Hopper entier, il faut d'abord prouver que les revenus générés par ces puces sont inférieurs aux coûts d'exploitation. Ce n'est pas un coût variable, c'est un coût irrécupérable.
Doug : Dans un monde sans friction, vous avez raison, mais le monde dans lequel nous vivons connaît une friction croissante. Les frictions pour créer de nouvelles capacités de calcul incluent les autorisations d'électricité, les terrains et les approbations.
Dylan : Oui, je suis d'accord. Le scénario d'une baisse des prix des GPU correspond à une stagnation des progrès des modèles, tandis que le scénario d'une hausse correspond à une poursuite des progrès des modèles. Il y a aussi un facteur X : l'intervention gouvernementale auprès des laboratoires de pointe. Si l'on limite qui peut utiliser les puces les plus récentes et les plus performantes, la demande sera compressée, et les prix des anciennes puces en subiront également la baisse.
Capital and Electricians: The Physical Ceiling of Scaling Laws
Doug : Ce qui me préoccupe le plus, ce n'est pas la demande, mais les contraintes physiques du côté de l'offre. La première, ce sont les électriciens. Les États-Unis manquent de 100 000 électriciens. Un électricien intermédiaire gagne 250 000 dollars par an ; ceux qui acceptent de travailler 18 heures par jour peuvent atteindre 400 000 à 500 000 dollars. Un site web suit les offres d'emploi pour les électriciens ; sur Wayback Machine, on peut voir que les salaires horaires sont passés de 15 à 20 dollars à 50, 100, voire 200 dollars. Il faut 18 mois pour former un électricien. Pour doubler ce nombre, nous n'avons jamais formé autant de personnes.
Le deuxième est le capital. Les géants du cloud ont émis environ 450 milliards de dollars d'obligations cette année, un record historique, derrière uniquement les États-Unis et la Chine. Quelqu'un doit acheter ces obligations. Pour les inciter à en acheter davantage, il faut offrir des taux d'intérêt plus élevés. Or, la source de ces fonds provient en grande partie des retraites et des pensions. Les fonds de retraite connaissent une contraction structurelle. Les pensions ont massivement basculé vers les 401k, qui n'achètent pas d'obligations. Vous devez donc essentiellement croire que tout le monde a besoin de deux fois plus d'assurance, ce qui n'a pas de sens.
Les lois d'échelle disent : « Super, doublons la taille du modèle ». Mais tout ne peut pas être augmenté de deux ou trois fois de manière synchronisée.
Dylan : Attends, tu veux dire que les retraites financent la construction de centres de données ?
Doug : Oui. Les rentes sont principalement achetées avant la retraite, et la génération du baby boom entre en retraite, ce qui crée un important pool d'actifs. Mais peut-il doubler ? Peut-il tripler ? Je n'en suis pas convaincu. L'assurance-vie est également une source. Mais il faudrait croire que tout le monde a besoin de deux fois plus d'assurance. Personne n'achète deux fois plus d'assurance-vie.
Dylan : C'est intéressant. Les retraites se contractent structurellement, mais il y a effectivement beaucoup d'argent là-bas.
Doug : Un autre exemple est Taïwan. TSMC représente directement ou indirectement 20 % du PIB de Taïwan. Si TSMC doublait ou triplait sa production, Taïwan devrait avoir plus d'enfants pour avoir suffisamment de travailleurs. Taïwan ne joue qu'à un seul jeu. Le PIB de Taïwan a augmenté de 25 % cette année, uniquement grâce à TSMC qui fabrique des puces. Mais si cela doublait encore, il n'y aurait plus assez de personnes.
Politisation de l'IA : bouc émissaire des élections de mi-mandat
Dylan : Beaucoup de gens n'aiment pas l'IA, et cela n'est pas encore pris en compte dans le prix. Comment cela pourrait-il être pris en compte ? Je pense que c'est à cause des élections de mi-mandat.
Doug : L'IA est probablement en cinquième position parmi les priorités, pas dans les trois premières. La santé et le coût de la vie sont en tête. Personne ne se présentera aux élections avec l'IA comme programme.
Dylan : Mais l’IA deviendra un sous-agent du débat sur le coût de la vie. Il ne s’agira plus de « soutenons-nous l’IA », mais de « préoccupez-vous de l’économie, blamez les geeks de la tech et l’IA ». Le projet de loi ROSA a été adopté à la Chambre des représentants par 300 voix contre 20, mais il est bloqué au Sénat. Les lobbyistes d’entreprises empêchent son adoption.
Doug : Si ce n'est pas une priorité前三, la pression de lobbying l'emportera sur l'opinion publique.
Dylan : Mais l’IA est déjà le bouc émissaire des gens sur d’autres sujets : changement climatique, logement, inflation, l’IA et les technophiles seront toujours pointés du doigt.
Doug : Un sondage intéressant : les personnes qui détestent les centres de données vivent généralement loin de ceux-ci. En revanche, ceux qui vivent à proximité, en particulier les jeunes, ont une attitude positive en raison des emplois. J'ai visité un centre de données près de Buffalo, et les habitants étaient extrêmement favorables. Construire des centres de données dans des régions éloignées est en réalité une bonne chose, car il élargit la participation économique. Un centre de données d'un gigawatt nécessite environ dix mille personnes. Soixante-dix gigawatts représentent 700 000 emplois. Cela commence à influencer les votes.
Conclusion : cinq mille milliards d'investissement, cinq cent milliards de revenus
Doug : L'essor technologique du futur se réalisera inévitablement, la question réside dans le calendrier des flux de trésorerie. Tu dépenses un billion, tu en récupères cent milliards ; il est vrai qu'un jour, cela deviendra un billion. Mais ce pourrait être dans cinq ans, et à ce moment-là, tu diras : « Hé, je n'ai plus d'argent ».
Supposons que le ARR actuel de l'écosystème IA soit de 150 milliards, avec un CAPEX cumulé de 1 000 milliards. Un rendement sur revenu de 15 %, soit un taux de profit de 50 %, équivaut à 7,5 %. Ce n'est pas mauvais, mais ce n'est pas non plus extrêmement rentable. Vous devez croire que les 150 milliards peuvent passer à 500 milliards, ce qui est possible. Ensuite, 500 milliards pourraient soutenir un CAPEX de deux à trois billions. Mais doubler à nouveau serait très difficile.
OpenAI et Anthropic croient que la pré-formation finale est imminente, car elles préparent leur IPO. Le modèle issu de la pré-formation finale est effectivement excellent et génère une croissance des revenus rapide, mais pas assez rapide pour couvrir les factures. Vous avez construit une maison que vous ne pouvez pas vous permettre. Vous avez investi cinq mille milliards, avec des revenus de cinq milliards : cela représente dix ans de revenus.
Dylan : Tu dis que c'est un revenu, pas un bénéfice. Et tu le dis en sachant quelles sont les marges bénéficiaires actuelles de ces entreprises pour leurs services.
Doug : Oui, nous n’en sommes pas encore là. Nous sommes encore sur un chemin étroit, où l’on peut voir comment les revenus s’alignent. Les géants du cloud à très grande échelle ont d’autres activités qui génèrent énormément de cash ; s’ils veulent arrêter les CAPEX, les bénéfices surgiront immédiatement. Mais plus vous investissez, plus les enjeux augmentent et le chemin se rétrécit. À un moment donné, vous devez exiger que tout le monde l’utilise. Le problème, c’est que les décideurs et les utilisateurs réels habitent deux mondes complètement différents. Zuck pense que tout le monde portera des lunettes Meta pour brûler des billions de tokens chaque jour dans le métavers, mais la grand-mère du Nebraska ne sait même pas utiliser un nouvel iPhone.
Dylan : Les revenus ne viennent pas de la grand-mère, mais des entreprises, des banques, des compagnies de télécommunications, des détaillants, des organismes de défense et de renseignement. Je vois chaque banque, chaque compagnie de télécommunications, chaque détaillant l'utiliser dans leur travail quotidien. Les contraintes les plus intéressantes se situent du côté de l'offre : pouvez-vous installer assez de GPU, pouvez-vous recruter assez de personnes pour vendre ?
Doug : Oui, les problèmes liés à l'offre sont plus intéressants et plus complexes. Les électriciens, le capital, les autorisations — ces éléments ne peuvent pas être doublés selon les lois d'échelle. Mais avec du temps, cela arrivera. Ils pourraient effectivement émettre un billion de dollars d'obligations l'année prochaine. Le vrai problème, c'est que le chemin deviendra plus étroit, les enjeux augmenteront, et vous devrez exiger que tout le monde y participe. Cette courbe d'adoption prend du temps.
