Nvidia vừa biến một thỏa thuận cấp phép 20 tỷ USD thành phần cứng hoạt động. Công ty xác nhận hệ thống suy luận AI Groq 3 LPX độ trễ thấp của họ đã bước vào sản xuất hàng loạt và sẽ hoạt động trước cuối năm nay, đánh dấu một trong những chu kỳ từ thỏa thuận đến triển khai nhanh nhất trong lịch sử hạ tầng AI gần đây.
Hệ thống, tích hợp 256 đơn vị xử lý ngôn ngữ trong thiết kế làm mát bằng chất lỏng, là sản phẩm hữu hình đầu tiên của thỏa thuận cấp phép thành công giữa Nvidia và startup chip suy luận Groq, được ký vào đêm Giáng sinh năm 2025. Nebius sẽ là công ty đầu tiên triển khai nó thông qua nền tảng Token Factory của mình.
Cách một thỏa thuận cấp phép trở thành một dàn sản xuất trong tám tháng
Giao dịch tạo ra phần cứng này là không bình thường theo tiêu chuẩn của ngành bán dẫn. Thay vì mua lại Groq hoàn toàn, Nvidia đã trả 20 tỷ USD để cấp phép không độc quyền các thiết kế LPU (đơn vị xử lý ngôn ngữ) của Groq, tuyển chọn một số nhân sự chủ chốt bao gồm người sáng lập và CEO của Groq, Jonathan Ross, và để Groq tiếp tục hoạt động như một công ty độc lập. Simon Edwards hiện dẫn dắt Groq, công ty vận hành 13 trung tâm dữ liệu trên toàn cầu.
Groq 3 LPX nằm trong nền tảng Vera Rubin của Nvidia, hệ thống cơ sở hạ tầng AI thế hệ tiếp theo rộng lớn hơn của công ty. Những con số hiệu suất mà Nvidia đang quảng bá thật ấn tượng: lên đến 35 lần thông lượng trên mỗi megawatt so với các thiết lập truyền thống.
Sức hút huy động vốn của Groq và vị thế chiến lược của Nvidia
Groq huy động được 650 triệu USD vào tháng 6 năm 2026, tiếp theo là thêm 350 triệu USD vào tháng 8 năm 2026, đưa định giá của công ty lên 3,5 tỷ USD. Nvidia tham gia vào đợt huy động tháng 8, củng cố thêm mối quan hệ tài chính với một công ty mà họ đã trả hàng tỷ USD để cấp phép.
Groq hoạt động như một Đối tác Cloud của Nvidia, có thể tích hợp các hệ thống của Nvidia cùng với các sản phẩm độc quyền của mình.
Nebius và việc triển khai thực tế đầu tiên
Việc lựa chọn Nebius làm đối tác triển khai đầu tiên là đáng chú ý. Nền tảng Token Factory của công ty được thiết kế cho các tác vụ suy luận quy mô lớn, khiến nó trở thành môi trường thử nghiệm tự nhiên cho phần cứng tuyên bố cải thiện đáng kể hiệu suất suy luận.
Nvidia xác nhận trạng thái sản xuất đầy đủ vào ngày 24 tháng 8 năm 2026, với kế hoạch triển khai trước cuối năm.
