Nvidia Meluncurkan Router AI Pribadi Gratis untuk Jaringan Rumah

iconCryptoBriefing
Bagikan
AI summary iconRingkasan
Nvidia mengumumkan alat gratis dan open-source bernama Personal AI Router (PAIR) untuk memungkinkan pemrosesan AI lokal di jaringan rumah. Perangkat lunak ini mendukung GPU GeForce RTX seri 20 dan yang lebih baru, RTX Pro, DGX Spark, serta chip Apple M4. Dengan mendistribusikan tugas AI di berbagai GPU, PAIR mengurangi ketergantungan pada cloud, sejalan dengan tren berita on-chain. Alat ini merupakan bagian dari inisiatif AI Grid Nvidia. Perusahaan juga bermitra dengan Perplexity untuk membangun Komputer Portabel guna menjalankan model Qwen secara lokal di perangkat keras Nvidia, memberikan wawasan tentang perkembangan berita AI + crypto.

Nvidia ingin komputer rumah Anda bekerja sebagai tim. Router AI Pribadi baru perusahaan, dikenal sebagai PAIR, adalah perangkat lunak gratis dan sumber terbuka yang menemukan mesin yang kompatibel di jaringan lokal, menghubungkannya bersama, dan menyiapkannya untuk membagi tugas inferensi AI di beberapa GPU tanpa mengirimkan satu pun permintaan ke cloud.

Bayangkan seperti load balancer untuk ruang tamu Anda. Alih-alih satu PC yang kesulitan menjalankan model bahasa besar sendirian, PAIR mengoordinasikan beban kerja di seluruh perangkat yang mampu di jaringan, mengarahkan permintaan ke mesin mana pun yang memiliki kapasitas tersedia.

Apa yang sebenarnya dilakukan PAIR

PAIR bukan router fisik. Tidak diperlukan perangkat keras baru, tidak ada kotak yang perlu dicolokkan ke dinding.

Ini adalah perangkat lunak yang menangani penemuan jaringan, koordinasi perangkat, dan distribusi tugas untuk inferensi AI lokal. Alat yang kompatibel termasuk Ollama dan LM Studio, dua aplikasi paling populer untuk menjalankan model bahasa besar pada perangkat konsumen.

Iklan

Dukungan perangkat sangat condong ke ekosistem Nvidia sendiri, mencakup kartu GeForce RTX 20-series dan apa pun yang lebih baru, GPU RTX Pro, serta sistem DGX Spark. Chip Apple M4 atau yang lebih baru juga kompatibel.

DGX Spark dari Nvidia adalah mahkota dari jajaran inferensi lokal. Ketika mesin yang menjalankan DGX Spark diklusterkan dan model dikuantisasi, sistem ini dapat menangani model dalam rentang 200 miliar parameter.

Kartu konsumen kelas atas seperti RTX 5090 dilengkapi dengan antara 24 hingga 32 GB VRAM. Tugas PAIR adalah membuat perangkat keras tersebut bermanfaat di seluruh jaringan rumah, bukan hanya pada satu desktop.

Gambaran lebih besar: Dorongan Nvidia untuk melokalisasi AI

PAIR cocok dengan sempurna dalam pergeseran strategis yang lebih luas yang sedang dijalankan Nvidia secara paralel. Perusahaan ini telah mengembangkan apa yang disebutnya AI Grid, sebuah inisiatif yang dirancang untuk mengurangi latensi dan biaya yang terkait dengan AI berbasis cloud dengan menjaga komputasi sedekat mungkin dengan pengguna.

Nvidia juga mengumumkan kemitraan dengan Perplexity pada 25 Agustus 2026, menghasilkan apa yang disebut perusahaan sebagai Portable Computer, perangkat yang dirancang untuk menjalankan model Qwen kelas menengah secara lokal di perangkat keras Nvidia. VRAM minimum dimulai dari 24 GB, konsisten dengan tier RTX 5090.

Agen AI modern tidak hanya mengirim satu permintaan dan berhenti; mereka menghubungkan puluhan panggilan model, penggunaan alat, dan langkah penalaran secara berurutan. Latensi cloud meningkat pesat sepanjang rantai panjang. Jaringan lokal GPU yang dikoordinasikan oleh PAIR menjaga waktu bolak-balik seminimal mungkin dan menghindari biaya per token yang membuat aplikasi agen mahal untuk dijalankan dalam skala besar di API yang dihosting.

Apa artinya ini bagi lanskap kompetitif

Nvidia membuat langkah terhitung dengan merilis PAIR sebagai perangkat lunak gratis dan sumber terbuka. Alat itu sendiri tidak menghasilkan pendapatan langsung, tetapi memperdalam ketergantungan pengguna pada perangkat keras Nvidia. Jika jaringan AI rumah Anda dibangun di sekitar PAIR dan GPU RTX, jalur dengan resistansi terkecil untuk upgrade berikutnya tetap berada dalam ekosistem Nvidia.

AMD dan Intel keduanya menawarkan lini GPU bersaing yang mampu melakukan inferensi lokal, dan sifat open-source dari alat-alat seperti Ollama berarti tidak ada yang terkunci dari alur kerja. Namun, ekosistem CUDA Nvidia dan integrasi eratnya dengan kerangka inferensi dominan memberikan PAIR kedalaman kompatibilitas yang sulit disalin pesaing dalam waktu singkat.

Untuk penyedia cloud, tren yang diwakili oleh PAIR patut dipantau dengan cermat. Amazon Web Services, Google Cloud, dan Microsoft Azure semuanya menghasilkan pendapatan signifikan dari lalu lintas API inferensi AI. Alat-alat yang memindahkan beban kerja tersebut ke perangkat keras konsumen mengikis asumsi pertumbuhan yang telah dibangun oleh bisnis-bisnis ini dalam proyeksi masa depan mereka.

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.