Odaily Planet Daily melaporkan Marvell Technology mengumumkan pelancaran rangkaian penyelesaian memori generasi baru bagi infrastruktur AI, mencakup penyimpanan AI peringkat pelayan, ekspansi dan pengumpulan memori CXL peringkat rak, serta memori berkongsi melalui interkoneksi optik antar-rak, bertujuan untuk menyelesaikan bottleneck kapasiti dan lebar pita memori yang semakin meningkat dalam proses inferens Agentic AI.
Marvell menyatakan bahawa dengan pertumbuhan skala model AI, peningkatan jendela konteks, dan permintaan KV Cache yang meningkat, arsitektur tradisional yang menggabungkan komputasi dan memori sedang membatasi kecekapan inferensi AI. Melalui pemisahan memori (memory disaggregation), sumber memori boleh diperluaskan secara bebas daripada sumber komputasi, meningkatkan penggunaan GPU dan mengurangkan latensi pergerakan data. Produk yang dilancarkan kali ini termasuk:
Pengawal SSD Bravera SC6 PCIe 6.0: Dirangkaikan untuk skenario penyimpanan AI inference, membantu penyedia awan memindahkan lebih banyak KV Cache ke SSD berprestasi tinggi, meningkatkan kecekapan infrastruktur. Produk ini menggunakan arsitektur yang kompatibel dengan NAND pelbagai pembekal, dijangka bermula penghantaran sampel pada suku keempat 2026.
Solusi ekspansi memori Marvell Structera X: Berdasarkan teknologi CXL, menyokong ekspansi memori dan pengumpulan sumber peringkat rak, membantu pusat data berkongsi dan mengalokasikan sumber memori dengan lebih fleksibel, serta mengurangkan kos infrastruktur AI.
Solusi memori interkoneksi fotonik Marvell: Membina arsitektur memori berkongsi merentasi banyak rak melalui teknologi interkoneksi fotonik, menyokong pemindahan KV Cache panas sehingga 32TB, serta meningkatkan kapasiti throughput untuk kumpulan inferens AI.
Marvell menyatakan bahawa penyelesaian Photonic Fabric dapat meningkatkan throughput Token sehingga 2 hingga 3 kali ganda dalam batasan ruang dan penggunaan kuasa pusat data semasa, menyokong model berskala lebih besar dan aplikasi AI dengan konteks yang lebih panjang.
Manajer Marvell, Will Chu, menyatakan bahawa infrastruktur AI sedang berpindah dari arsitektur pelayan tunggal kepada sistem di mana komputasi, memori, dan sambungan beroperasi secara serasi; pada masa depan, memori perlu dikembangkan secara lebih berdiri sendiri untuk meningkatkan penggunaan sumber dan kecekapan Token.
Seiring dengan pertumbuhan berterusan dalam permintaan untuk Agen AI dan inferensi model besar, kapasiti memori, lebar pita, dan kecekapan penghantaran data kini menjadi fokus baharu dalam persaingan infrastruktur AI selepas kuasa pengiraan.
