source avatarqinbafrank

Compartilhar

Se o relatório mais recente da SemiAnalysis indicar que o HBM do Rubin Ultra foi reduzido para 192 GB, em cenários sensíveis à memória — como inferência agente, contextos longos e modelos MoE grandes —, 192 GB será mais limitado do que 288 GB, o que significa que seu desempenho efetivo em alguns cenários poderá se aproximar ou até ficar abaixo da versão padrão da Vera Rubin. A versão atualizada Ultra Rubin tem desempenho inferior à versão padrão da Vera Rubin; o mesmo modelo pode exigir mais GPUs para implantação, aumentando os custos de comunicação entre GPUs, divisão do modelo e transferência de dados, reduzindo a utilização efetiva por GPU e elevando o custo de geração por Token. Em outras palavras, embora a produção de GPUs tenha aumentado, se cada tarefa exigir mais GPUs, o custo de capacidade de processamento no nível do sistema não necessariamente diminuirá proporcionalmente. Assim, a lógica da versão atualizada não faz sentido. Então, talvez não valha a pena lançar a versão Ultra — continuar vendendo a versão Vera Rubin no segundo semestre de 2027 e esperar até 2028 para introduzir diretamente a próxima geração, com a arquitetura Feynman. 🤔

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.