Odaily Planet Daily сообщило: Marvell Technology объявила о запуске нового поколения решений для памяти, ориентированных на инфраструктуру ИИ, включая серверную память для ИИ, расширение и пулинг памяти CXL на уровне стойки, а также оптическую взаимосвязь памяти между несколькими шкафами, чтобы решить растущие проблемы с емкостью и пропускной способностью памяти в процессе инференса Agentic AI.
Marvell отметила, что с ростом размера моделей ИИ, расширением окон контекста и увеличением потребности в KV Cache традиционная архитектура, тесно связанная вычислениями и памятью, ограничивает эффективность ИИ-вывода. За счет декомпозиции памяти (memory disaggregation) ресурсы памяти могут масштабироваться независимо от вычислительных ресурсов, повышая использование GPU и снижая задержки при перемещении данных. Среди представленных продуктов:
Контроллер SSD Bravera SC6 PCIe 6.0: предназначен для сценариев хранения при AI-выводах, помогает облачным провайдерам перемещать больше KV Cache на высокопроизводительные SSD, повышая эффективность инфраструктуры. Продукт использует архитектуру, совместимую с NAND от нескольких поставщиков, и образцы планируется начать отправлять в четвертом квартале 2026 года.
Решение Marvell Structera X для расширения памяти: на основе технологии CXL, поддерживает расширение памяти и пулинг ресурсов на уровне стойки, помогая центрам обработки данных более гибко делиться и распределять ресурсы памяти, снижая стоимость инфраструктуры ИИ.
Marvell Photonic Fabric: решение для оптической связи памяти — создание архитектуры общей памяти через несколько стойек с использованием оптических технологий связи, поддерживающее сброс до 32 ТБ теплого KV-кэша и повышающее пропускную способность кластеров для AI-выводов.
Marvell заявила, что решение Photonic Fabric позволяет увеличить пропускную способность токенов в 2–3 раза при существующих ограничениях по пространству и энергопотреблению в центрах обработки данных, поддерживая более крупные модели и приложения ИИ с более длинными контекстами.
Менеджер Marvell Уилл Чу заявил, что инфраструктура ИИ переходит от архитектуры отдельных серверов к системам, в которых вычисления, память и соединение работают совместно; в будущем память должна масштабироваться независимо для повышения эффективности использования ресурсов и токенов.
По мере постоянного роста спроса на AI-агентов и вывод больших моделей, емкость памяти, пропускная способность и эффективность передачи данных становятся новой областью конкуренции в инфраструктуре ИИ после вычислительной мощности.
