3台のデバイスを使用して、5つのサブエージェントのタスクを18分から8分48秒に短縮。 これはNVIDIAが新たにリリースしたオープンソースツールPAIRである。 誤解されやすいのは、「複数のGPUを1枚に結合する」という点だが、 実際にはVRAMを統合したり、単一のモデルを分割したりすることはない。 PAIRは、ローカルネットワーク内の空きているコンピュータに異なるリクエストを割り当てるだけである。 私の判断:PAIRはVRAM不足の解決ではなく、マルチエージェントの並列処理を実現するものである。 自宅に複数のコンピュータを持つ人には非常に実用的だが、単一の大規模モデルを実行するだけでは、速度が勝手に向上することはない。 GitHub: https://t.co/bPjzZdjEeN

