Nvidia, ev bilgisayarlarınızın bir ekip olarak çalışmasını istiyor. Şirketin yeni Personal AI Router’ı, yani PAIR, yerel bir ağda uyumlu makineleri keşfederek birbirine bağlar ve tek bir isteği buluta göndermeden AI çıkarım görevlerini birden fazla GPU arasında bölmek için bunları hazırlar.
Odayınızdaki bir yük dengeleyici gibi düşünün. Büyük bir dil modelini tek bir bilgisayarın tek başına çalıştırmak yerine, PAIR, ağdaki her yetenekli cihaza iş yükünü dağıtır ve istekleri boş kapasitesi olan makineye yönlendirir.
PAIR aslında ne yapar
PAIR fiziksel bir yönlendirici değildir. Yeni donanıma gerek yok, duvara takılacak bir kutu yok.
Yerel AI çıkarımı için ağ keşfi, cihaz koordinasyonu ve görev dağıtımını yöneten bir yazılımdır. Uyumlu araçlar arasında büyük dil modellerini tüketici donanımında çalıştırmak için daha popüler uygulamalardan olan Ollama ve LM Studio bulunur.
Cihaz desteği, GeForce RTX 20 serisi kartlar ve daha yeni modeller, RTX Pro GPU’lar ve DGX Spark sistemlerini kapsayan Nvidia’nın kendi ekosistemine doğru eğilim göstermektedir. Apple’ın M4 çipleri veya daha yeni modeller de uyumludur.
Nvidia’nın DGX Spark’ı, yerel çıkarım serisinin en değerli ürünüdür. DGX Spark ile çalışan makineler bir araya getirildiğinde ve modeller nicelleştirildiğinde, sistem 200 milyar parametre aralığında modelleri işleyebilir.
RTX 5090 gibi yüksek performanslı tüketici kartları, 24 ile 32 GB arasında VRAM ile gelir. PAIR’in görevi, bu donanımı yalnızca tek bir masaüstüde değil, tüm bir ev ağı boyunca kullanışlı hale getirmektir.
Daha geniş resim: Nvidia’nın Yapay Zekayı Yerelleştirmeye yönelik çabaları
PAIR, Nvidia'nın paralel olarak gerçekleştirdiği daha geniş bir stratejik dönüşümle uyumlu şekilde yerini alıyor. Şirket, hesaplama işlemini kullanıcıya mümkün olduğunca yakın tutarak bulut tabanlı Yapay Zeka ile ilişkili gecikmeyi ve maliyeti azaltmayı amaçlayan AI Grid adını verdiği bir girişim geliştirmektedir.
Nvidia, 25 Ağustos 2026 tarihinde Perplexity ile bir ortaklık duyurdu ve şirketlerin Portatif Bilgisayar adını verdiği, Nvidia donanımı üzerinde orta seviye Qwen modellerini yerel olarak çalıştırmak için tasarlanmış bir cihaz üretti. Minimum VRAM miktarı 24 GB'dır ve RTX 5090 serisiyle uyumludur.
Modern AI agenteri bir istek gönderip durmaz; onlar düzgün bir sırayla düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzgün bir şekilde düzenli olarak onlarca model çağrısı, araç kullanımı ve akıl yürütme adımı zincirler. Uzun zincilerde bulut gecikmesi hızla artar. PAIR tarafından koordine edilen yerel GPU ağı, döngü sürelerini minimumda tutar ve agens uygulamalarının barındırılmış API'lerde ölçeklenebilir biçimde çalıştırmak için her token başına maliyetleri ortadan kaldırır.
Bu, rekabet ortamı için ne anlama geliyor
Nvidia, PAIR'i ücretsiz ve açık kaynaklı yazılım olarak yayınlamak suretiyle hesaplı bir adım atıyor. Araç doğrudan gelir sağlamasa da, kullanıcıları Nvidia donanımlarına bağımlı hale getiriyor. Evdeki AI ağınıza PAIR ve RTX GPU'larla kurduysanız, bir sonraki yükseltmeniz için en az dirençli yol, Nvidia ekosisteminde kalacaktır.
AMD ve Intel, yerel çıkarım için rekabet eden GPU serileri sunar ve Ollama gibi açık kaynak araçların doğası nedeniyle hiçbirisi iş akışından dışlanmaz. Ancak Nvidia’nın CUDA ekosistemi ve hakim çıkarım çerçeveleriyle olan sıkı entegrasyonu, PAIR’a rakiplerin hızlıca taklit edemeyeceği bir uyumluluk derinliği sağlar.
Bulut sağlayıcılar için, PAIR'in temsil ettiği eğilim dikkatle izlenmeye değer. Amazon Web Services, Google Cloud ve Microsoft Azure, tümü AI çıkarım API trafiğinden anlamlı gelir elde ediyor. Bu iş yükünü tüketici donanımına taşıyan araçlar, bu işletmelerin ileriye dönük projeksiyonlarına dahil ettikleri büyüme varsayımlarını zayıflatıyor.
