Marvell ra mắt kiến trúc phân tách bộ nhớ AI để giải quyết các điểm nghẽn băng thông suy luận

iconKuCoinFlash
Chia sẻ
AI summary iconTóm tắt
Marvell đã công bố kiến trúc bộ nhớ AI mới nhằm giải quyết các vấn đề về băng thông suy luận trong các hệ thống AI. Danh mục sản phẩm bao gồm lưu trữ cấp máy chủ, mở rộng bộ nhớ CXL và kết nối quang học. Tin tức về AI + tiền điện tử cho thấy sự giao thoa ngày càng tăng khi các công ty tìm kiếm cơ sở hạ tầng có khả năng mở rộng. Bravera SC6, Structera X và Photonic Fabric nhằm tăng hiệu quả GPU và thông lượng token. Dữ liệu lạm phát vẫn là yếu tố vĩ mô quan trọng, nhưng sự đổi mới công nghệ tiếp tục thúc đẩy các nâng cấp cơ sở hạ tầng.

Odaily Planet Daily tin: Marvell Technology công bố ra mắt bộ giải pháp bộ nhớ thế hệ mới dành cho cơ sở hạ tầng AI, bao gồm bộ nhớ AI cấp máy chủ, mở rộng và gộp bộ nhớ CXL cấp khung, cũng như bộ nhớ chia sẻ qua kết nối quang giữa nhiều tủ, nhằm giải quyết các điểm nghẽn về dung lượng và băng thông bộ nhớ ngày càng gia tăng trong quá trình suy luận của Agentic AI.

Marvell cho biết, khi quy mô mô hình AI tăng lên, cửa sổ ngữ cảnh kéo dài và nhu cầu về KV Cache gia tăng, kiến trúc truyền thống tích hợp chặt chẽ giữa tính toán và bộ nhớ đang hạn chế hiệu suất suy luận AI. Thông qua việc tách rời bộ nhớ (memory disaggregation), tài nguyên bộ nhớ có thể được mở rộng độc lập với tài nguyên tính toán, nâng cao hiệu suất sử dụng GPU và giảm độ trễ di chuyển dữ liệu. Các sản phẩm được phát hành lần này bao gồm:

Bộ điều khiển SSD Bravera SC6 PCIe 6.0: Được thiết kế cho các kịch bản lưu trữ AI inference, giúp các nhà cung cấp dịch vụ đám mây chuyển nhiều KV Cache hơn sang SSD hiệu năng cao, nâng cao hiệu quả cơ sở hạ tầng. Sản phẩm này sử dụng kiến trúc tương thích với NAND từ nhiều nhà cung cấp, dự kiến sẽ bắt đầu gửi mẫu vào quý IV năm 2026.

Giải pháp mở rộng bộ nhớ Marvell Structera X: Dựa trên công nghệ CXL, hỗ trợ mở rộng bộ nhớ cấp khung và phân bổ tài nguyên, giúp các trung tâm dữ liệu chia sẻ và phân bổ tài nguyên bộ nhớ linh hoạt hơn, giảm chi phí cơ sở hạ tầng AI.

Giải pháp bộ nhớ kết nối quang học Marvell Photonic Fabric: Xây dựng kiến trúc bộ nhớ chia sẻ xuyên nhiều tủ thông qua công nghệ kết nối quang, hỗ trợ tối đa 32TB bộ nhớ KV Cache nóng và giúp tăng khả năng thông lượng cho cụm suy luận AI.

Marvell cho biết, giải pháp Photonic Fabric có thể tăng gấp 2 đến 3 lần thông lượng Token trong các giới hạn không gian và công suất hiện có của trung tâm dữ liệu, hỗ trợ các mô hình quy mô lớn hơn và các ứng dụng AI với ngữ cảnh dài hơn.

Ông Will Chu, quản lý cấp cao của Marvell, cho biết cơ sở hạ tầng AI đang chuyển từ kiến trúc máy chủ đơn lẻ sang các hệ thống nơi tính toán, bộ nhớ và kết nối hoạt động đồng bộ, trong tương lai, bộ nhớ cần được mở rộng một cách độc lập hơn để nâng cao hiệu quả sử dụng tài nguyên và hiệu suất Token.

Do nhu cầu về AI Agent và suy luận mô hình lớn không ngừng tăng trưởng, dung lượng bộ nhớ, băng thông và hiệu quả truyền dữ liệu đang trở thành trọng tâm cạnh tranh mới trong cơ sở hạ tầng AI sau năng lực tính toán.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.