source avatarqinbafrank

مشاركة

إذا كان تقرير SemiAnalysis الأخير يشير إلى أن HBM في Rubin Ultra انخفض إلى 192 جيجابايت، ففي السيناريوهات الحساسة للذاكرة مثل الاستدلال القائم على الوكلاء، والسياقات الطويلة، ونماذج MoE، فإن 192 جيجابايت ستكون أكثر تقييدًا مقارنة بـ 288 جيجابايت، مما يعني أن أدائها الفعلي الفعال في بعض السيناريوهات سيصبح قريبًا من أو حتى أقل من إصدار Vera Rubin القياسي. أداء نسخة Ultra المُرقّية أسوأ من إصدار Vera Rubin القياسي، مما قد يتطلب استدعاء المزيد من وحدات المعالجة الرسومية لنفس النموذج لإكمال النشر، مما يزيد من تكاليف الاتصال بين البطاقات، وتقسيم النموذج، ونقل البيانات، ويقلل من كفاءة الاستخدام الفعلية لكل بطاقة، ويرفع تكلفة توليد كل Token. بعبارة أخرى، على الرغم من زيادة إنتاجية وحدات المعالجة الرسومية، إلا أن تكلفة قدرات الحوسبة على مستوى النظام قد لا تنخفض بالتزامن إذا احتاجت كل مهمة إلى استخدام عدد أكبر من وحدات المعالجة الرسومية. وبالتالي، لا معنى للمنطق وراء نسخة Ultra. إذًا، هل لا داعي لطرح نسخة Ultra، والتركيز على بيع إصدار Vera Rubin حتى النصف الثاني من عام 2027، ثم الانتقال مباشرة إلى الجيل التالي من بنية Feynman في عام 2028؟ 🤔

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.