source avatarqinbafrank

Kongsi

Jika mengikut laporan terbaru SemiAnalysis, HBM pada Rubin Ultra telah turun kepada 192GB, maka dalam skenario yang sensitif terhadap memori seperti agentic inference, konteks panjang, dan model MoE besar, 192GB akan lebih terhad berbanding 288GB, bermakna prestasi efektifnya dalam beberapa skenario akan mendekati atau bahkan lebih rendah daripada versi standard Vera Rubin. Prestasi versi Ultra yang ditingkatkan lebih rendah daripada versi standard Vera Rubin; model yang sama mungkin memerlukan lebih banyak GPU untuk dilaksanakan, yang seterusnya meningkatkan overhead komunikasi antar-GPU, pembahagian model, dan penghantaran data, mengurangkan kecekapan penggunaan setiap GPU, serta meningkatkan kos penghasilan setiap Token. Dengan kata lain, walaupun keluaran GPU meningkat, jika setiap tugas memerlukan lebih banyak GPU, kos kekuatan pengiraan pada peringkat sistem tidak semestinya menurun secara serentak. Logik versi yang ditingkatkan ini tidak munasabah. Jadi, adakah lebih baik tidak mempromosikan versi Ultra, dan terus menjual versi Vera Rubin sehingga separuh tahun 2027, kemudian terus ke arsitektur generasi seterusnya pada tahun 2028 iaitu Feynman? 🤔

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.