AWS demande aux ingénieurs de réduire le gaspillage de CPU face à la pression sur la capacité EC2

iconCryptoBriefing
Partager
AI summary iconRésumé
Amazon Web Services a ordonné aux ingénieurs de réduire le gaspillage de CPU et d'éliminer les instances EC2 sous-utilisées alors que la demande en ressources de calcul augmente fortement. Les ingénieurs doivent désormais respecter des échéances pour nettoyer les instances inactives, qui représentent environ 65 % des instances actives. Cette initiative inclut le dimensionnement approprié, l'arrêt automatisé et une meilleure suivi des actualités sur chaîne pour l'utilisation des ressources. Les nouveaux listings de jetons et les charges de travail pilotées par l'IA intensifient la pression sur la capacité CPU, obligeant AWS à privilégier l'efficacité avant le déploiement de nouveaux matériels.

Amazon Web Services, le plus grand fournisseur de cloud au monde, a émis des directives internes exigeant que ses équipes d'ingénierie réduisent le gaspillage de CPU et éliminent les instances EC2 sous-utilisées. La raison est simple : la demande en calcul, largement stimulée par les charges de travail liées à l'IA, dépasse l'offre, et les ingénieurs demandant une nouvelle capacité CPU doivent désormais attendre plusieurs jours pour l'obtenir.

Que se passe-t-il réellement à l'intérieur d'AWS ?

Les directives remontent à des réunions internes tenues en mai, où la direction a souligné la nécessité de maximiser l'infrastructure existante avant d'attendre l'arrivée de nouveaux équipements. Les ingénieurs ont reçu des échéances pour identifier et réduire les instances EC2 inactives, une catégorie qui représenterait environ 65 % de toutes les instances en cours d'exécution sous-utilisées.

Le playbook d'optimisation que AWS promeut en interne inclut un meilleur ajustement des tailles (correspondance des types d'instances aux besoins réels des charges de travail), des arrêts automatisés pour les instances inactives, et des améliorations globales de l'efficacité dans la façon dont les équipes provisionnent et gèrent les ressources.

Publicité

Les retards de plusieurs jours pour la capacité des serveurs CPU sont le symptôme le plus révélateur. AWS a historiquement fonctionné avec suffisamment de marge pour que les équipes internes puissent activer des ressources relativement rapidement. Lorsque les délais de provisionnement s'allongent de quelques heures à plusieurs jours, l'infrastructure fonctionne plus près de sa limite maximale que ce que l'on souhaiterait.

L’IA consomme les centres de données

AWS n’est pas le seul à ressentir la pression. Microsoft Azure et Google Cloud ont tous deux reconnu des contraintes de capacité lors de leurs récentes conférences sur les résultats, la disponibilité des GPU devenant en particulier un goulot d’étranglement dans toute l’industrie. Mais la tension sur la capacité CPU chez AWS est un phénomène plus récent, ce qui suggère que la pression s’étend au-delà des clusters GPU qui attirent le plus l’attention.

Amazon investit fortement dans des puces personnalisées, notamment ses processeurs Graviton pour le calcul général et ses puces Trainium pour l'entraînement de l'IA, en partie pour réduire sa dépendance vis-à-vis des fournisseurs externes et en partie pour améliorer la performance par watt. Mais les délais de fabrication de puces signifient que ces investissements prennent des trimestres ou des années pour se traduire par une capacité déployée.

Ce que cela signifie pour les clients du cloud et le marché plus large

Pour les entreprises exécutant des charges de travail sur AWS, une pression interne sur la capacité au niveau du fournisseur peut se manifester de plusieurs façons. Certains types d'instances peuvent devenir plus difficiles à réserver dans des régions spécifiques. Le prix des instances Spot, qui varie en fonction de la capacité excédentaire disponible, pourrait augmenter à mesure que cette capacité excédentaire diminue. AWS a déjà ajusté les prix publiés des capacités réservées, notamment une augmentation notable d'environ 15 % pour les familles GPU au début de 2026.

Les clients professionnels les plus susceptibles de ressentir l'impact sont ceux qui exécutent des applications gourmandes en ressources sans engagement de capacité réservée. Les entreprises qui ont verrouillé leur capacité via des plans d'épargne ou des instances réservées sont en partie protégées. Celles qui dépendent du provisionnement à la demande pourraient se retrouver confrontées à des interruptions de disponibilité ou à des tarifs premium pendant les périodes de forte demande.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.