Amazon Web Services, le géant du calcul cloud qui alimente une part surprenante d’Internet, fait quelque chose qui semble presque désuet pour une entreprise d’un billion de dollars : demander à ses ingénieurs d’éteindre les ordinateurs qu’ils n’utilisent pas.
La directive cible les instances EC2 inactives, les serveurs virtuels qui constituent la colonne vertébrale de l'infrastructure cloud d'AWS. Avec les charges de travail IA qui consomment la capacité GPU à un rythme accéléré, même le plus grand fournisseur de cloud au monde ressent la pression.
L'ampleur du problème des déchets
Les chiffres révèlent un niveau d'inefficacité impressionnant. Environ 65 % des instances EC2 présentent une utilisation moyenne du processeur inférieure à 20 % sur des fenêtres de mesure de 30 jours.
L'outil Compute Optimizer d'AWS a été mis à jour pour détecter ces serveurs fantômes. Il analyse désormais l'utilisation du CPU et le trafic réseau sur des périodes de rétroaction de 14 jours, en signalant les instances où le pic d'utilisation du CPU reste inférieur à 5 % et le trafic réseau est négligeable.
Le PDG d'Amazon, Andy Jassy, a révélé qu'AWS a ajouté plus de 3,8 gigawatts de capacité énergétique l'année dernière. À titre de comparaison, cela suffit à alimenter environ 2,8 millions de foyers. L'entreprise prévoit de doubler sa capacité d'ici 2027.
La demande d'IA brise l'économie
La pénurie de capacité a un moteur clair : l’intelligence artificielle. Les instances accélérées par GPU, les machines de base derrière l’entraînement et l’exécution de grands modèles linguistiques, sont devenues la ressource la plus rare dans le cloud computing.
Cette pression de la demande s'est traduite directement par une hausse des prix. Les blocs de capacité EC2 pour l'apprentissage automatique ont vu leur prix augmenter d'environ 15 % en janvier, suivi d'une autre hausse d'environ 20 % d'ici juillet. Deux augmentations de prix en six mois pour le même service reflètent le déséquilibre entre l'offre et la demande.
La pénurie persistante de GPU aurait poussé certains clients AWS à envisager de déplacer leurs opérations vers des fournisseurs de cloud concurrents.
Ce que cela signifie pour le marché du cloud
Pour les entreprises exécutant des charges de travail sur AWS, la trajectoire des prix mérite d’être suivie de près. Deux augmentations significatives des prix pour les blocs de capacité ML en une seule année suggèrent que les entreprises fortement dépendantes du traitement AI basé sur le cloud devraient prévoir une augmentation continue des coûts.
Le chiffre de 65 % de sous-utilisation ne concerne pas uniquement AWS. Il reflète des habitudes répandues dans l'industrie consistant à surprovisionner des ressources, car démarrer une nouvelle instance a toujours été plus facile que de dimensionner correctement une instance existante.
Le plan d'Amazon pour doubler sa capacité de centres de données d'ici 2027 représente l'une des plus grandes extensions d'infrastructure de l'histoire corporative. Mais entre-temps, l'entreprise semble adopter une approche prudente : construire davantage de capacité tout en extrayant davantage d'utilité de ce qui existe déjà.
