Amazon Web Services, крупнейший в мире провайдер облачных услуг, выпустил внутренние указания, требующие от инженерных команд сократить потери CPU и устранить недоиспользуемые экземпляры EC2. Причина проста: спрос на вычислительные ресурсы, в основном обусловленный задачами ИИ, опережает предложение, и инженеры, запрашивающие новую мощность CPU, теперь вынуждены ждать несколько дней, чтобы её получить.
Что на самом деле происходит внутри AWS
Директивы восходят к внутренним встречам, проведённым в мае, где руководство подчеркнуло необходимость максимального использования существующей инфраструктуры до прибытия нового оборудования. Инженерам были установлены сроки для выявления и сокращения неиспользуемых экземпляров EC2 — категории, которая, как сообщается, составляет примерно 65% всех запущенных экземпляров, находящихся в состоянии низкой загрузки.
Практическое руководство по оптимизации, которое AWS продвигает внутренне, включает более точное подбор размеров (соответствие типов инстансов реальным потребностям рабочей нагрузки), автоматическое отключение неактивных инстансов и более широкие улучшения эффективности в процессах выделения и управления ресурсами командами.
Многодневные задержки с добавлением новой серверной мощности CPU — наиболее показательный симптом. Ранее AWS функционировала с достаточным запасом, позволяющим внутренним командам быстро запускать ресурсы. Когда сроки подготовки увеличиваются с часов до дней, инфраструктура работает ближе к предельной нагрузке, чем кто-либо хотел бы.
ИИ поглощает центр обработки данных
AWS не одинока в ощущении давления. Microsoft Azure и Google Cloud также признали ограничения по мощности в последних отчетах о прибылях, причем доступность GPU особенно стала узким местом по всей отрасли. Однако сжатие мощности CPU в AWS — это более новое явление, что указывает на то, что нагрузка распространяется за пределы GPU-кластеров, которые получают наибольшее внимание.
Amazon активно инвестирует в собственные полупроводники, включая процессоры Graviton для общих вычислений и чипы Trainium для обучения ИИ, частично с целью снизить зависимость от внешних поставщиков и частично для повышения производительности на ватт. Однако сроки производства чипов означают, что эти инвестиции требуют кварталов или лет, чтобы превратиться в внедренную мощность.
Что это означает для клиентов облачных сервисов и более широкого рынка
Для компаний, запускающих рабочие нагрузки на AWS, внутреннее напряжение мощностей на уровне провайдера может проявляться несколькими способами. Некоторые типы инстансов могут стать сложнее забронировать в определенных регионах. Цены на спот-инстансы, которые колеблются в зависимости от доступной избыточной мощности, могут вырасти по мере сокращения этой избыточности. AWS уже скорректировала опубликованные цены на зарезервированные мощности, включая заметное повышение примерно на 15% по семействам GPU в начале 2026 года.
Наиболее подвержены влиянию корпоративные клиенты, запускающие ресурсоемкие приложения без обязательств по зарезервированной емкости. Компании, которые закрепили емкость с помощью планов сбережений или зарезервированных инстансов, частично защищены. Те, кто полагается на предоставление ресурсов по требованию, могут столкнуться с перебоями в доступности или платить премиум-цены в периоды пикового спроса.
