Nvidia Melancarkan Router AI Peribadi Percuma untuk Rangkaian Rumah

iconCryptoBriefing
Kongsi
AI summary iconRingkasan
Nvidia mengumumkan alat percuma dan sumber terbuka bernama Personal AI Router (PAIR) untuk membolehkan pemprosesan AI tempatan dalam rangkaian rumah. Perisian ini menyokong GPU GeForce RTX siri 20 dan yang lebih baru, RTX Pro, DGX Spark, dan cip Apple M4. Dengan mengagihkan tugas AI di antara beberapa GPU, PAIR mengurangkan ketergantungan kepada awan, selari dengan tren berita on-chain. Alat ini merupakan sebahagian daripada inisiatif AI Grid Nvidia. Syarikat ini juga bekerjasama dengan Perplexity untuk membina Komputer Portabel untuk menjalankan model Qwen secara tempatan pada peranti Nvidia, menawarkan wawasan mengenai perkembangan berita AI + kripto.

Nvidia ingin komputer rumah anda berkerja sebagai satu tim. Router AI Peribadi baharu syarikat itu, dikenali sebagai PAIR, ialah perisian sumber terbuka percuma yang mengesan mesin-mesin yang serasi dalam rangkaian tempatan, menghubungkannya bersama, dan mempersiapkannya untuk membahagikan tugas inferens AI di antara beberapa GPU tanpa menghantar satu pun permintaan ke awan.

Anggap ia seperti penyeimbang beban untuk ruang tamu anda. Alih-alih satu PC yang berjuang untuk menjalankan model bahasa besar secara sendirian, PAIR mengatur beban kerja di sepanjang setiap peranti yang mampu dalam rangkaian, menghala permintaan ke mesin mana sahaja yang mempunyai ruang yang tersedia.

Apa yang sebenarnya dilakukan PASANGAN

PAIR bukan router fizikal. Tidak diperlukan peralatan baru, tidak perlu mencolokkan kotak ke dinding.

Ia adalah perisian yang mengendalikan penemuan rangkaian, koordinasi peranti, dan pengagihan tugas untuk inferens AI tempatan. Alat yang serasi termasuk Ollama dan LM Studio, dua daripada aplikasi yang lebih popular untuk menjalankan model bahasa besar pada peranti pengguna.

Iklan

Sokongan peranti lebih cenderung kepada ekosistem Nvidia sendiri, yang merangkumi kad GeForce RTX 20-series dan apa sahaja yang lebih baharu, GPU RTX Pro, serta sistem DGX Spark. Cip M4 Apple atau yang lebih baharu juga serasi.

DGX Spark Nvidia adalah permata mahkota dalam jajaran inferensia tempatan. Apabila mesin yang menjalankan DGX Spark dikumpulkan dan model dikuantisasi, sistem ini mampu menangani model dalam julat 200 bilion parameter.

Kad penggunaan tinggi seperti RTX 5090 datang dengan antara 24 hingga 32 GB VRAM. Tugas PAIR adalah menjadikan peranti keras ini berguna sepanjang rangkaian rumah keseluruhan, bukan hanya pada satu desktop.

Gambaran yang lebih besar: Usaha Nvidia untuk melokalkan AI

PAIR sesuai dengan lancar dalam peralihan strategik yang lebih luas yang sedang dilaksanakan oleh Nvidia. Syarikat ini telah membangunkan apa yang disebutnya sebagai AI Grid, inisiatif yang direka untuk mengurangkan latensi dan kos yang berkaitan dengan AI berbendalir dengan mengekalkan pengiraan sedekat mungkin dengan pengguna.

Nvidia juga mengumumkan kerjasama dengan Perplexity pada 25 Ogos 2026, menghasilkan apa yang disebut kedua-dua syarikat sebagai Komputer Mudah Alih, sebuah peranti yang direka untuk menjalankan model Qwen tahap sederhana secara tempatan pada peranti Nvidia. VRAM minimum bermula pada 24 GB, selari dengan tahap RTX 5090.

Agen AI moden tidak menghantar satu permintaan sahaja dan berhenti; mereka menggabungkan puluhan panggilan model, penggunaan alat, dan langkah penalaran secara berturut-turut. Latensi awan bertambah pantas sepanjang rantai yang panjang. Rangkaian tempatan GPU yang dikoordinasikan oleh PAIR mengekalkan masa pusingan serendah mungkin dan mengelakkan kos per-token yang menjadikan aplikasi agen mahal untuk dijalankan pada skala besar melalui API yang disewa.

Apakah yang dimaksudkan ini terhadap landskap persaingan

Nvidia membuat langkah yang dihitung dengan melepaskan PAIR sebagai perisian sumber terbuka percuma. Alat ini sendiri tidak menghasilkan pendapatan langsung, tetapi memperdalam ketergantungan pengguna pada peranti keras Nvidia. Jika rangkaian AI rumah anda dibina di sekitar PAIR dan GPU RTX, laluan paling mudah untuk pengupsian seterusnya tetap berada dalam ekosistem Nvidia.

AMD dan Intel kedua-duanya menawarkan siri GPU yang bersaing dan mampu menjalankan inferens tempatan, dan sifat sumber terbuka alat seperti Ollama bermakna tiada satu pun yang terkunci keluar daripada alur kerja. Tetapi ekosistem CUDA Nvidia dan integrasi rapatnya dengan kerangka inferens yang dominan memberikan PAIR kedalaman kompatibiliti yang sukar disaingi oleh pesaing dalam masa singkat.

Bagi penyedia awan, tren yang diwakili oleh PAIR patut dipantau dengan teliti. Amazon Web Services, Google Cloud, dan Microsoft Azure semuanya menghasilkan pendapatan bermakna daripada trafik API inferens AI. Alat-alat yang memindahkan beban kerja itu ke peranti pengguna mengikis anggaran pertumbuhan yang telah dibina oleh perniagaan-perniagaan tersebut dalam ramalan masa depan mereka.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.