Odaily Planet Daily News: Marvell Technology anunciou o lançamento de uma nova gama de soluções de memória para infraestrutura de IA, abrangendo armazenamento de IA em nível de servidor, expansão e agregação de memória CXL em nível de rack e memória compartilhada por interconexão óptica entre múltiplos gabinetes, visando resolver os gargalos crescentes de capacidade e largura de banda de memória no processo de inferência de IA Agentic.
Marvell afirmou que, à medida que os modelos de IA aumentam de tamanho, as janelas de contexto se estendem e a demanda por KV Cache cresce, a arquitetura tradicional de computação e memória fortemente acoplada está limitando a eficiência da inferência de IA. Por meio da desagregação de memória (memory disaggregation), os recursos de memória podem ser expandidos de forma mais independente dos recursos de computação, aumentando a utilização da GPU e reduzindo a latência de movimentação de dados. Os produtos lançados nesta ocasião incluem:
Controlador SSD Bravera SC6 PCIe 6.0: voltado para cenários de armazenamento em inferência de IA, ajuda provedores de nuvem a migrar mais KV Cache para SSDs de alto desempenho, aumentando a eficiência da infraestrutura. O produto utiliza uma arquitetura compatível com NAND de múltiplos fornecedores e está previsto para início de amostras no quarto trimestre de 2026.
Solução de expansão de memória Marvell Structera X: baseada na tecnologia CXL, suporta expansão de memória em nível de rack e poolização de recursos, ajudando centros de dados a compartilhar e alocar recursos de memória de forma mais flexível, reduzindo os custos da infraestrutura de IA.
Solução de memória interconectada por fóton da Marvell: constrói uma arquitetura de memória compartilhada entre múltiplos gabinetes por meio de tecnologia de interconexão óptica, suportando até 32 TB de cache KV térmico e ajudando a aumentar a capacidade de throughput dos clusters de inferência de IA.
Marvell afirmou que a solução Photonic Fabric pode aumentar o throughput de tokens em até 2 a 3 vezes, dentro dos limites existentes de espaço e consumo de energia dos data centers, permitindo modelos de maior escala e aplicações de IA com contextos mais longos.
Will Chu, executivo da Marvell, afirmou que a infraestrutura de IA está passando de uma arquitetura de servidor único para sistemas onde computação, memória e conexão operam em conjunto; futuramente, a memória precisará ser escalada de forma mais independente para aumentar a utilização de recursos e a eficiência dos tokens.
Com o crescimento contínuo da demanda por AI Agent e inferência de grandes modelos, a capacidade de memória, a largura de banda e a eficiência de transmissão de dados estão se tornando o novo foco da competição na infraestrutura de IA, após o poder de processamento.
