Tencent Hunyuan lança versão preliminar leve do Hy4 com compressão de modelo de 214 GB

iconKuCoinFlash
Compartilhar
AI summary iconResumo
A Tencent Hunyuan lançou a versão preliminar leve Hy4, comprimindo o peso do modelo de 1,5 TB para 214 GB usando seu algoritmo de quantização esparsa ternária Sherry e a estratégia MIX-STQ1_0. A versão Hy4 mantém um desempenho forte em compreensão de textos longos, recuperação de contexto em múltiplas etapas e assistência em codificação, semelhante ao original BF16. Operadores que avaliam esta atualização podem considerar os níveis de suporte e resistência nos ganhos de eficiência do modelo. A relação risco-recompensa para adotar tais modelos otimizados parece favorável, dado o mínimo compromisso de desempenho.
ME AI mensagem, o Tencent Hunyuan lança a versão preview Hy4 leve, utilizando o algoritmo de quantização esparsa ternária Sherry de desenvolvimento próprio e a estratégia de quantização por camada de precisão mista MIX-STQ1_0, reduzindo os pesos do modelo de 1,5 TB para cerca de 214 GB. A versão quantizada Hy4 preview apresenta desempenho próximo à versão original BF16 em tarefas como compreensão de textos longos, recuperação de contexto em múltiplas rodadas e auxílio à codificação. Fonte: Tencent Hunyuan (fonte: MLion)
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.