Alibaba lança o Qwen3.8-Max: Um modelo de IA gratuito e eficiente para auto-hospedagem em cripto

iconChainGPT
Compartilhar
AI summary iconResumo
A Alibaba lançou o Qwen3.8-Max, um modelo de IA com 2,4 trilhões de parâmetros e design de ativação esparsa para custos mais baixos e inferência eficiente. O modelo é gratuito e disponível no Hugging Face e no ModelScope, com suporte para auto-hospedagem e sistemas descentralizados. Com o crescente interesse em modelos de pesos abertos e possíveis mudanças regulatórias, como a MiCA (Regulamentação de Mercados de Ativos Criptográficos da UE), o lançamento pode impactar a liquidez e os mercados de criptoativos.

A Alibaba acaba de lançar uma surpresa para o mundo da IA — e isso pode fazer uma grande diferença para projetos de criptomoedas que valorizam auto-hospedagem e inferência de baixo custo. O que aconteceu - A Alibaba lançou o Qwen3.8-Max, que a empresa chama de seu modelo mais capaz até agora. Pela primeira vez, está disponibilizando ao público os pesos completos do modelo “Max”: eles serão publicados no Hugging Face e no ModelScope na próxima semana. - O modelo é massivo em termos teóricos — 2,4 trilhões de parâmetros no total — mas utiliza um design de ativação esparsa, de modo que apenas cerca de 95 bilhões de parâmetros estão ativos de cada vez. Esse design reduz drasticamente as necessidades de computação e memória em comparação com um modelo de 2,4T convencional. Por que isso importa - A ativação esparsa/condicional é como uma grande biblioteca onde apenas os estantes necessários para uma determinada consulta são iluminados. Essa eficiência permite que pequenas empresas, laboratórios e potencialmente operadores de nós descentralizados executem um modelo de ponta sem o custo de um datacenter de hiperscaler. - Para desenvolvedores de criptomoedas, isso significa opções mais realistas para inferência auto-hospedada, implantações privadas de agentes ou execução de serviços baseados em LLMs em infraestrutura distribuída. Desempenho e comportamento - A própria abordagem da Alibaba minimiza os benchmarks de destaque e enfatiza resistência e autonomia. Exemplos destacados por ela: - O Qwen passou 16 dias construindo autonomamente uma ferramenta de codificação: 265 commits, 127 pull requests, 151 issues — sem nenhuma digitação humana durante esse período. - Reproduziu os resultados de um artigo de pesquisa em cinco dias (sem acesso prévio ao código do artigo) e depois superou o artigo em 2,7 pontos. - Em um concurso de ML de 24 horas, superou 458 das 526 equipes humanas. - O modelo vem com compatibilidade com os protocolos Claude Code da Anthropic e Codex da OpenAI — a API da Alibaba pode se comunicar com ambos — e muitos benchmarks de codificação foram executados via Claude Code. Benchmarks e custos - Em benchmarks textuais puros (31 testes), o Fable 5 da Anthropic lidera com 15 primeiros lugares, o GPT-5.6 Sol da OpenAI obtém nove, e o Qwen conquista sete. - Em 12 testes de codificação, o Qwen vence apenas uma vez. - Mas onde o Qwen realmente se destaca é na eficiência de custo: seu “custo de inteligência” de inferência pode ser cerca de 30% do cobrado pelo Claude Fable 5. Na prática, isso significa que mesmo se o Qwen precisar de mais etapas de raciocínio, a conta total para concluir tarefas pode ser muito menor. - Em tarefas multimodais — documentos, vídeo, raciocínio espacial — o Qwen lidera a maioria das comparações. Uma mudança estratégica e o momento certo - No início deste ano, a Alibaba migrou para modelos mais fechados e pagos (eliminou o plano gratuito do Qwen Code em abril). O Qwen 3.7 Max manteve o Max atrás de uma API, abrindo apenas uma versão Plus. Agora, com a liberação dos pesos do Max, a Alibaba reabriu a porta. - O momento é notável: modelos chineses de peso aberto aumentaram no OpenRouter de menos de 2% dos tokens no final de 2024 para cerca de 61% em meados de 2026. O Qwen superou o Llama da Meta como o modelo mais auto-hospedado globalmente. - A geopolítica também importa: Washington impôs controles de exportação sobre o Fable 5 e o Mythos 5 da Anthropic em junho, e Pequim supostamente considera restrições sobre modelos chineses sendo enviados ao exterior. Isso torna os pesos chineses gratuitamente baixáveis um movimento poderoso de distribuição. Conclusão para o público de criptomoedas - A Alibaba pode não estar no topo de todos os rankings, mas ao liberar gratuitamente um modelo Max quase de ponta, altamente eficiente, ela está vencendo em distribuição e acessibilidade. Para equipes Web3 que constroem agentes privados, nós de inferência ou serviços de IA descentralizados, o Qwen3.8-Max pode reduzir barreiras para implantação e deslocar mais cargas de trabalho de IA para infraestrutura auto-hospedada e descentralizada. Ser o segundo colocado nos gráficos ainda pode ser uma enorme vantagem quando você controla a distribuição.

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.