Nvidia ra mắt bộ định tuyến AI cá nhân miễn phí cho mạng gia đình

iconCryptoBriefing
Chia sẻ
AI summary iconTóm tắt
Nvidia đã công bố một công cụ miễn phí và mã nguồn mở có tên Personal AI Router (PAIR) để kích hoạt xử lý AI tại chỗ trên các mạng gia đình. Phần mềm hỗ trợ các GPU GeForce RTX series 20 trở lên, RTX Pro, DGX Spark và chip Apple M4. Bằng cách phân phối các tác vụ AI qua nhiều GPU, PAIR giảm sự phụ thuộc vào đám mây, phù hợp với xu hướng tin tức on-chain. Công cụ này là một phần của sáng kiến AI Grid của Nvidia. Công ty cũng hợp tác với Perplexity để phát triển một Máy tính Di động chạy các mô hình Qwen tại chỗ trên phần cứng Nvidia, mang lại cái nhìn sâu sắc về các phát triển tin tức AI + crypto.

Nvidia muốn máy tính tại nhà của bạn hoạt động như một đội nhóm. Phần mềm mới của công ty, có tên là Personal AI Router (PAIR), là phần mềm mã nguồn mở miễn phí, có khả năng phát hiện các máy tính tương thích trên mạng cục bộ, kết nối chúng lại với nhau và chuẩn bị để chia sẻ các tác vụ suy luận AI giữa nhiều GPU mà không cần gửi bất kỳ yêu cầu nào lên đám mây.

Hãy tưởng tượng nó như một thiết bị cân bằng tải cho phòng khách của bạn. Thay vì một máy tính để bàn phải tự mình chạy một mô hình ngôn ngữ lớn, PAIR sẽ phân bổ công việc trên mọi thiết bị có khả năng trên mạng, định tuyến yêu cầu đến máy nào có dung lượng sẵn có.

PAIR thực sự làm gì

PAIR không phải là một bộ định tuyến vật lý. Không cần thiết bị phần cứng mới, không cần cắm hộp vào tường.

Đó là phần mềm xử lý phát hiện mạng, phối hợp thiết bị và phân bổ nhiệm vụ cho suy luận AI cục bộ. Các công cụ tương thích bao gồm Ollama và LM Studio, hai trong số các ứng dụng phổ biến hơn để chạy các mô hình ngôn ngữ lớn trên phần cứng người dùng tiêu dùng.

Quảng cáo

Hỗ trợ thiết bị thiên về hệ sinh thái riêng của Nvidia, bao gồm các card GeForce RTX thế hệ 20 và các mẫu mới hơn, các GPU RTX Pro, cùng các hệ thống DGX Spark. Các chip M4 của Apple trở lên cũng tương thích.

DGX Spark của Nvidia là viên ngọc quý trong dòng sản phẩm suy luận tại chỗ. Khi các máy chạy DGX Spark được kết hợp thành cụm và các mô hình được lượng tử hóa, hệ thống có thể xử lý các mô hình trong phạm vi 200 tỷ tham số.

Các card tiêu dùng cao cấp như RTX 5090 đi kèm từ 24 đến 32 GB VRAM. Nhiệm vụ của PAIR là làm cho phần cứng này trở nên hữu ích trên toàn bộ mạng gia đình, thay vì chỉ trên một máy tính để bàn đơn lẻ.

Bức tranh lớn hơn: Nỗ lực của Nvidia trong việc địa phương hóa AI

PAIR phù hợp hoàn hảo với sự chuyển đổi chiến lược rộng hơn mà Nvidia đang thực hiện song song. Công ty đã phát triển cái mà họ gọi là AI Grid, một sáng kiến nhằm giảm độ trễ và chi phí liên quan đến AI dựa trên đám mây bằng cách giữ việc tính toán càng gần người dùng càng tốt.

Nvidia cũng công bố hợp tác với Perplexity vào ngày 25 tháng 8 năm 2026, cho ra đời thiết bị mà các công ty gọi là Portable Computer, một thiết bị được thiết kế để chạy các mô hình Qwen phân khúc trung bình ngay trên phần cứng Nvidia. VRAM tối thiểu bắt đầu từ 24 GB, phù hợp với phân khúc RTX 5090.

Các tác nhân AI hiện đại không chỉ gửi một yêu cầu rồi dừng lại; chúng nối tiếp hàng chục lần gọi mô hình, sử dụng công cụ và các bước suy luận theo chuỗi. Độ trễ trên đám mây tăng nhanh trong các chuỗi dài. Một mạng lưới GPU cục bộ được điều phối bởi PAIR giúp duy trì thời gian khứ hồi ở mức tối thiểu và tránh các chi phí theo từng token khiến các ứng dụng tác nhân trở nên đắt đỏ khi chạy quy mô lớn trên các API được lưu trữ.

Điều này có nghĩa gì đối với cảnh quan cạnh tranh

Nvidia đang thực hiện một bước đi tính toán khi phát hành PAIR dưới dạng phần mềm miễn phí và mã nguồn mở. Công cụ này không tạo ra doanh thu trực tiếp, nhưng nó làm sâu sắc thêm sự phụ thuộc của người dùng vào phần cứng Nvidia. Nếu mạng AI tại nhà của bạn được xây dựng xung quanh PAIR và GPU RTX, thì con đường ít trở ngại nhất cho lần nâng cấp tiếp theo của bạn sẽ vẫn nằm trong hệ sinh thái của Nvidia.

AMD và Intel đều cung cấp các dòng GPU cạnh tranh có khả năng thực hiện suy luận tại chỗ, và tính chất mã nguồn mở của các công cụ như Ollama có nghĩa là không bên nào bị loại khỏi quy trình làm việc. Tuy nhiên, hệ sinh thái CUDA của Nvidia và sự tích hợp chặt chẽ với các khung suy luận thống trị mang lại cho PAIR độ sâu tương thích mà các đối thủ sẽ khó có thể sao chép nhanh chóng.

Đối với các nhà cung cấp đám mây, xu hướng mà PAIR đại diện đáng được theo dõi cẩn thận. Amazon Web Services, Google Cloud và Microsoft Azure đều tạo ra doanh thu đáng kể từ lưu lượng API suy luận AI. Các công cụ di chuyển tải công việc này sang phần cứng người tiêu dùng đang làm suy yếu giả định tăng trưởng mà các doanh nghiệp này đã đưa vào các dự báo tương lai của họ.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.