Odaily Planet Daily : Marvell Technology annonce la mise sur le marché d'une nouvelle génération de solutions mémoire dédiées à l'infrastructure IA, couvrant le stockage IA niveau serveur, l'extension et le partage mémoire CXL niveau rack, ainsi que la mémoire partagée par interconnexion optique entre plusieurs armoires, afin de résoudre les goulots d'étranglement croissants en capacité et en bande passante mémoire lors de l'inférence Agentic AI.
Marvell indique qu'avec l'augmentation de la taille des modèles d'IA, l'allongement des fenêtres de contexte et la croissance des besoins en KV Cache, l'architecture traditionnelle couplant étroitement calcul et mémoire limite l'efficacité de l'inférence IA. Grâce à la désagrégation de la mémoire, les ressources mémoire peuvent être étendues de manière indépendante des ressources de calcul, augmentant ainsi l'utilisation des GPU et réduisant la latence de déplacement des données. Les produits lancés aujourd'hui incluent :
Contrôleur SSD Bravera SC6 PCIe 6.0 : conçu pour les scénarios de stockage en inférence IA, il permet aux fournisseurs de cloud de migrer davantage de KV Cache vers des SSD haute performance, améliorant ainsi l'efficacité de l'infrastructure. Ce produit utilise une architecture compatible avec du NAND de plusieurs fournisseurs et devrait être disponible en échantillons à partir du quatrième trimestre 2026.
Solution d'extension de mémoire Marvell Structera X : basée sur la technologie CXL, elle permet l'extension de la mémoire au niveau du rack et la mise en pool de ressources, aidant les centres de données à partager et à allouer plus facilement les ressources mémoire, réduisant ainsi les coûts des infrastructures AI.
Solution de mémoire interconnectée par photonique Marvell : construit une architecture de mémoire partagée entre plusieurs armoires via la technologie d'interconnexion optique, permettant de décharger jusqu'à 32 To de cache KV chaud et augmentant la capacité de débit des clusters d'inférence IA.
Marvell indique que la solution Photonic Fabric permet d'augmenter le débit de tokens de 2 à 3 fois maximum, dans les limites d'espace et de consommation énergétique des centres de données existants, en soutenant des modèles plus volumineux et des applications AI avec des contextes plus longs.
Will Chu, cadre de Marvell, a déclaré que l'infrastructure IA évolue vers des systèmes où le calcul, la mémoire et la connexion fonctionnent en synergie, et que, à l'avenir, la mémoire devra pouvoir s'étendre de manière plus indépendante pour améliorer l'utilisation des ressources et l'efficacité des jetons.
À mesure que la demande en agents IA et en inférence de grands modèles continue de croître, la capacité mémoire, la bande passante et l'efficacité de transmission des données deviennent le nouveau point focal de la concurrence dans les infrastructures IA, après la puissance de calcul.
