し...これはインターネット上で最も狂った分散推論プロジェクトだ。 ゼロから作られたWebGPUエンジン、その部屋のすべてのデバイスを結ぶWebRTCメッシュ、同じGPU上でnative llama.cppを上回る推測デコード——すべてがブラウザのタブ内で動作している。 URLを開き、モデルを選択するだけ。すぐに利用可能。 友達が自分のスマホで27Bモデルを動かせるって気づく前に、これを保存しておけ。
NeilXbtし...これはインターネット上で最も狂った分散推論プロジェクトだ。 ゼロから作られたWebGPUエンジン、その部屋のすべてのデバイスを結ぶWebRTCメッシュ、同じGPU上でnative llama.cppを上回る推測デコード——すべてがブラウザのタブ内で動作している。 URLを開き、モデルを選択するだけ。すぐに利用可能。 友達が自分のスマホで27Bモデルを動かせるって気づく前に、これを保存しておけ。