Odaily Planet Daily informa que Marvell Technology ha lanzado una nueva gama de soluciones de memoria para infraestructura de IA, que abarca almacenamiento de IA a nivel de servidor, expansión y agrupación de memoria CXL a nivel de rack, y memoria compartida con interconexión óptica entre múltiples gabinetes, con el objetivo de resolver los cuellos de botella crecientes en capacidad y ancho de banda de memoria durante el proceso de inferencia de IA Agentic.
Marvell indica que, a medida que los modelos de IA aumentan de tamaño, se extienden las ventanas de contexto y crece la demanda de KV Cache, la arquitectura tradicional de cálculo y memoria estrechamente acoplada está limitando la eficiencia de la inferencia de IA. A través de la desagregación de memoria (memory disaggregation), los recursos de memoria pueden expandirse de forma más independiente de los recursos de cálculo, mejorando la utilización de la GPU y reduciendo la latencia de movimiento de datos. Los productos lanzados en esta ocasión incluyen:
Controlador Bravera SC6 PCIe 6.0 SSD: diseñado para escenarios de almacenamiento en inferencia de IA, ayuda a los proveedores de nube a migrar más caché KV a SSD de alto rendimiento, mejorando la eficiencia de la infraestructura. Este producto utiliza una arquitectura compatible con NAND de múltiples proveedores y se espera que comience a enviar muestras en el cuarto trimestre de 2026.
Solución de extensión de memoria Marvell Structera X: basada en tecnología CXL, admite la extensión de memoria a nivel de rack y la agrupación de recursos, ayudando a los centros de datos a compartir y asignar recursos de memoria de forma más flexible, reduciendo los costos de la infraestructura de IA.
Solución de memoria interconectada por fotónica Marvell: construye una arquitectura de memoria compartida entre múltiples gabinetes mediante tecnología de interconexión óptica, capaz de soportar hasta 32 TB de caché KV térmica y mejorar la capacidad de throughput de los clústeres de inferencia de IA.
Marvell indica que la solución Photonic Fabric puede lograr un aumento de 2 a 3 veces en el rendimiento de tokens dentro de los límites actuales de espacio y consumo de energía de los centros de datos, permitiendo modelos de mayor escala y aplicaciones de IA con contextos más largos.
Will Chu, ejecutivo de Marvell, señaló que la infraestructura de IA está pasando de una arquitectura de servidor único a sistemas en los que la computación, la memoria y la conexión operan en conjunto; en el futuro, la memoria necesitará escalar de manera más independiente para mejorar la utilización de recursos y la eficiencia de los tokens.
Con el crecimiento continuo de la demanda de agentes de IA y la inferencia de modelos grandes, la capacidad de memoria, el ancho de banda y la eficiencia de transmisión de datos se han convertido en el nuevo foco de competencia en la infraestructura de IA, tras el poder de cómputo.
