Amazon Web Services, найбільший у світі провайдер хмарних послуг, видала внутрішні інструкції, які вимагають від інженерних команд зменшити витрати CPU та прибрати недо використовувані екземпляри EC2. Причина проста: попит на обчислювальні ресурси, який у значній мірі підтримується завданнями ШІ, перевищує пропозицію, і інженери, які запитують нову CPU-потужність, зараз чекають кілька днів, щоб її отримати.
Що саме відбувається всередині AWS
Директиви сягають внутрішніх зустрічей, проведених у травні, де лідерство підкреслило необхідність максимізації існуючої інфраструктури до прибуття нового обладнання. Інженерам були встановлені терміни для виявлення та зменшення простою EC2-екземплярів — категорії, яка, за повідомленнями, становить приблизно 65% усіх запущених екземплярів, що не використовуються повністю.
План оптимізації, який AWS продвігає внутрішньо, включає краще відповідність розмірів (зіставлення типів інстансів з реальними потребами навантаження), автоматичне вимкнення неактивних інстансів та загальні покращення ефективності у процесах виділення та управління ресурсами командами.
Багатоденні затримки з введенням нової потужності серверів CPU — найбільш виявний симптом. Раніше AWS завжди мала достатній запас, що дозволяло внутрішнім командам швидко запускати ресурси. Коли терміни виділення ресурсів збільшуються з годин до днів, інфраструктура працює ближче до максимальної межі, ніж хтось би хотів.
Штучний інтелект споживає центр обробки даних
AWS не є єдиною компанією, яка відчуває тиск. Microsoft Azure та Google Cloud обидві визнали обмеження потужності на останніх звітах про фінансові результати, зокрема доступність GPU стала вузьким місцем у всій галузі. Але зменшення потужності CPU в AWS — це новий тренд, що свідчить про те, що навантаження поширюється за межі GPU-кластерів, які отримують найбільшу увагу.
Amazon інвестує значні кошти у власну силіконову технологію, включаючи процесори Graviton для загальних обчислень та чіпи Trainium для навчання ШІ, частково для зменшення залежності від зовнішніх постачальників і частково для покращення продуктивності на ват. Але терміни виробництва чіпів означають, що ці інвестиції перетворюються на впроваджену потужність через квартали або роки.
Що це означає для клієнтів хмари та ширшого ринку
Для компаній, які запускають завдання на AWS, внутрішній навантаження на рівні провайдера може проявлятися кількома способами. Певні типи інстансів можуть стати складнішими для бронювання в певних регіонах. Ціни на spot-інстанси, які коливаються залежно від наявної надлишкової потужності, можуть зростати, оскільки цей надлишок скорочується. AWS вже відкоригувала опубліковані ціни на зарезервовані потужності, включаючи значне збільшення приблизно на 15% у сімействах GPU на початку 2026 року.
Підприємства-клієнти, які найбільше почувають вплив — це ті, хто запускає ресурсоємні застосунки без зобов’язань щодо зарезервованої ємності. Компанії, які забезпечили ємність за допомогою планів заощаджень або зарезервованих інстансів, дещо захищені. Ті, хто залежить від виділення за запитом, можуть зіткнутися з перебоями у доступності або платити преміальні ціни під час пікового попиту.
