source avatarqinbafrank

Compartir

Según el último informe de SemiAnalysis, el HBM de Rubin Ultra se ha reducido a 192 GB. En escenarios sensibles a la memoria, como inferencia agente, contextos largos y modelos MoE grandes, 192 GB será más limitado que 288 GB, lo que implica que su rendimiento efectivo en algunos escenarios se acercará e incluso será inferior al de la versión estándar de Vera Rubin. La versión mejorada de Rubin Ultra tiene un rendimiento inferior al de la versión estándar de Vera Rubin; el mismo modelo podría requerir más GPUs para su implementación, aumentando así los costos de comunicación entre tarjetas, división del modelo y transferencia de datos, reduciendo la utilización efectiva por GPU y elevando el costo de generación por token. En otras palabras, aunque la producción de GPUs ha aumentado, si cada tarea requiere más GPUs, el costo de capacidad de cómputo a nivel de sistema no necesariamente disminuirá proporcionalmente. Por lo tanto, la lógica detrás de la versión mejorada no tiene sentido. ¿Entonces, ¿no sería mejor descartar la versión Ultra y seguir vendiendo la versión Vera Rubin hasta finales del 2027, para lanzar directamente la próxima generación con la arquitectura Feynman en 2028? 🤔

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.