source avatarqinbafrank

Paylaş

SemiAnalysis'ın en son raporuna göre Rubin Ultra'nın HBM'si 192 GB'a düşürülürse, bellek duyarlı Agentic çıkarım, uzun bağlam ve MoE büyük modelleri senaryolarında 192 GB, 288 GB'dan daha sınırlı olacaktır; bu da gerçek etkili performansının bazı senaryolarda Vera Rubin standart versiyonuna eşit veya ondan daha düşük olacağını anlamına gelir. Yükseltilmiş Ultra Rubin'in performansı, standart Vera Rubin'den daha düşükse, aynı modelin dağıtımını tamamlamak için daha fazla GPU'nun çağrılması gerekecek, bu da GPU arası iletişim, model bölme ve veri taşıma maliyetlerini artırır, tek bir GPU'nun etkili kullanım oranını düşürür ve her Token üretme maliyetini artırır. Başka bir deyişle, GPU üretimi artsa da, her görev daha fazla GPU gerektiriyorsa, sistem düzeyindeki hesaplama maliyeti aynı oranda düşmeyebilir. Bu durumda yükseltilmiş versiyonun mantığı geçersiz hale gelir. O zaman Ultra versiyonunu artık sunmak gerekli mi? 2027 yılının ikinci yarısında Vera Rubin versiyonunu satmaya devam edip, 2028'de doğrudan bir sonraki nesil Feynman mimarisine geçmek daha mantıklı olmaz mı? 🤔

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.