Amazon Web Services, гігант хмарних обчислень, який забезпечує роботу дивовижної частини інтернету, робить щось, що звучить майже застаріло для компанії вартістю в трильйон доларів: просить своїх інженерів вимикати комп’ютери, які вони не використовують.
Директива спрямована на неактивні екземпляри EC2 — віртуальні сервери, які є основою хмарної інфраструктури AWS. Зі зростанням навантажень на штучний інтелект, які поглинають потужність GPU все швидше, навіть найбільший у світі провайдер хмарних послуг відчуває тиск.
Масштаб проблеми з відходами
Ці цифри малюють картину захоплюючої неефективності. Приблизно 65% екземплярів EC2 мають середню завантаженість CPU нижче 20% протягом 30-дневних періодів вимірювання.
Інструмент Compute Optimizer від AWS було оновлено, щоб виявляти ці привиди-сервери. Тепер він аналізує використання ЦП та мережевий I/O за періоди відстеження 14 днів, позначаючи екземпляри, де пікове використання ЦП залишається нижче 5%, а мережевий трафік незначний.
Генеральний директор Amazon Енді Джасі розкрив, що AWS додав понад 3,8 гігаватта потужності за минулий рік. Для порівняння, цього електроенергії достатньо, щоб живити приблизно 2,8 мільйона домогосподарств. Компанія планує подвоїти свою потужність до 2027 року.
Попит на ШІ руйнує економіку
Проблема з переповненням потужностей має чітку причину: штучний інтелект. Інстанси з прискоренням за допомогою GPU, які є основою для навчання та запуску великих мовних моделей, стали найбільш дефіцитним ресурсом у хмарних обчисленнях.
Цей тиск з боку попиту безпосередньо відобразився на цінах. Ціни на EC2 Capacity Blocks для машинного навчання зросли приблизно на 15% у січні, а потім ще на 20% до липня. Два підвищення цін за шість місяців для одного й того ж сервісу свідчать про дисбаланс між пропозицією та попитом.
Завдяки тривалій нестачі GPU деякі клієнти AWS, як повідомляється, розглядають можливість перенесення своїх операцій на конкуруючі хмарні провайдери.
Що це означає для ринку хмарних сервісів
Для бізнесу, який виконує завдання на AWS, варто уважно стежити за динамікою цін. Два значні збільшення цін на блоки ML-потужності за один рік свідчать про те, що компаніям, які сильно залежать від хмарного AI-оброблення, слід планувати подальше зростання витрат.
Цифра 65% недо використання — це не лише проблема AWS. Вона відображає галузеві звички надмірного виділення ресурсів, оскільки запуск нового екземпляра завжди був простішим, ніж оптимізація існуючого.
План Amazon щодо подвоєння потужності центрів обробки даних до 2027 року є одним із найбільших проектів інфраструктурного розвитку в історії корпоративного сектору. Але між теперішнім часом і тим моментом компанія, схоже, застосовує підхід «і пояс, і брючні стрічки»: будує більше потужностей, водночас ефективніше використовуючи вже існуючі.
