Nvidia 希望您的家用電腦能協同工作。該公司新推出的個人 AI 路由器(PAIR)是一款免費且開源的軟體,可偵測本地網絡上的相容設備,將它們連接起來,並準備好在多個 GPU 之間分配 AI 推理任務,而無需將任何提示發送到雲端。
這就像您客廳的負載平衡器。與其讓一台電腦單獨努力運行大型語言模型,PAIR 會在網路中所有具備能力的裝置之間協調工作負載,將請求路由至具有剩餘資源的機器。
PAIR 實際上是做什麼的
PAIR 不是實體路由器,無需新增硬體,無需插電使用。
這是一款用於處理網路發現、裝置協調和本地 AI 推理任務分發的軟體。相容工具包括 Ollama 和 LM Studio,這兩者是於消費級硬體上運行大型語言模型的熱門應用程式。
設備支援主要偏向 Nvidia 自有的生態,涵蓋 GeForce RTX 20 系列顯卡及更新型號、RTX Pro GPU 和 DGX Spark 系統。Apple 的 M4 處理器或更新型號亦相容。
Nvidia 的 DGX Spark 是本地推理產品線中的皇冠明珠。當運行 DGX Spark 的機器進行叢集部署且模型經過量化後,該系統可處理參數量在 200 億範圍內的模型。
高端消費級顯卡如 RTX 5090 配備了 24 至 32 GB 的 VRAM。PAIR 的任務是讓這類硬體在整個家庭網路中發揮作用,而不僅限於單一桌面。
更大的圖景:英偉達推動 AI 本地化
PAIR 與英偉達同時推行的更廣泛戰略轉型完美契合。該公司一直在開發其所謂的 AI Grid,這項計劃旨在透過將運算盡可能靠近使用者,以降低基於雲端的 AI 所產生的延遲與成本。
Nvidia 亦於 2026 年 8 月 25 日宣佈與 Perplexity 合作,推出雙方稱為 Portable Computer 的裝置,專為在 Nvidia 硬體上本地運行中階 Qwen 模型而設計。最低 VRAM 為 24 GB,與 RTX 5090 等級一致。
現代的 AI 代理不會發出一次請求就停止;它們會按順序串聯數十次模型調用、工具使用和推理步驟。在長鏈中,雲端延遲會迅速累積。由 PAIR 協調的本地 GPU 網絡可將往返時間降至最低,並避免因使用託管 API 運行大規模代理應用時產生的每標記成本。
這對競爭格局意味著什麼
Nvidia 透過釋出 PAIR 作為免費開源軟體,進行了一項有計算的行動。該工具本身不會產生直接收入,但卻加深了用戶對 Nvidia 硬體的依賴。如果你的家庭 AI 網絡是基於 PAIR 和 RTX 顯卡構建的,那麼你下一次升級時,最省力的選擇仍將留在 Nvidia 的生態系統內。
AMD 和 Intel 均提供可用於本地推論的競爭性 GPU 產品線,而 Ollama 等工具的開源特性意味著任何一方都不會被排除在工作流程之外。但 Nvidia 的 CUDA 生態系統及其與主導推論框架的緊密整合,使 PAIR 具有競爭對手難以快速複製的兼容性深度。
對於雲端服務提供商而言,PAIR 所代表的趨勢值得密切關注。亞馬遜 Web 服務、谷歌雲和微軟 Azure 都從 AI 推理 API 流量中獲得可觀的收入。將此工作負載遷移至消費級硬體的工具,正在侵蝕這些企業在其未來預測中所依賴的增長假設。
