Modelo de IA do baterista de 34 anos, Kimi K3, ocupa o 4º lugar globalmente, gerando reação no mercado

iconMetaEra
Compartilhar
AI summary iconResumo
O Kimi K3 da Moonshot AI, lançado em 16 de julho de 2026, ficou em 4º lugar globalmente com 57,1 no Intelligence Index v4.1. O modelo de 2,8 trilhões de parâmetros suporta 1 milhão de tokens e visuais nativos. O fundador Yang Zhilin, um baterista de 34 anos, busca aumentar a presença global da Moonshot em IA. O preço do Kimi K3 é o triplo do seu antecessor, deslocando-se da estratégia chinesa de IA de baixo custo. O lançamento coincidiu com uma queda de 1,4% no Nasdaq, demonstrando o impacto do modelo no sentimento do mercado. A análise on-chain revela aumento no interesse por ativos impulsionados por IA, enquanto o índice de medo e ganância reflete emoções mistas dos investidores.
O verdadeiro ponto de interesse não é a pontuação do modelo, mas a estratégia apostada por Yang Zhilin: pesos abertos + longo contexto + cluster de Agentes — um caminho totalmente diferente do da OpenAI.

Autor do artigo, fonte: 0x9999in1, ME News



TL;DR

  • Em 16 de julho de 2026, Moonshot lançou o Kimi K3, com 2,8 trilhões de parâmetros e contexto de 1 milhão de tokens; a avaliação independente da Artificial Analysis obteve pontuação geral de 57,1, classificando-se em 4º lugar globalmente, superando o Claude Opus 4.8.
  • O fundador, Yang ZhiLin, tem 34 anos, graduado pela Tsinghua University e doutor pela CMU, primeiro autor do Transformer-XL e do XLNet, pertencendo ao pequeno grupo de pessoas que transformam seus próprios artigos acadêmicos em produtos.
  • A Moonshot concluiu uma nova rodada de financiamento de aproximadamente US$ 2 bilhões em maio de 2026, com avaliação ultrapassando US$ 20 bilhões, quadruplicando seu valor em três meses.
  • No dia do lançamento do K3, o Nasdaq caiu mais de 1,4% e a NVIDIA também enfraqueceu — o lançamento de uma empresa de startup chinesa, pela primeira vez, impulsionou concretamente o sentimento do mercado acionário norte-americano.
  • Mas o K3 já não é mais "extremamente barato": $3/$15 por milhão de tokens, cerca de três vezes o valor da geração anterior K2.6, marcando um ponto de virada na era dos "preços de repolho da IA na China".
  • A taxa de ilusão do K3 foi avaliada independentemente em até 51%, a saída é prolixa e os pesos abertos foram adiados para 27 de julho; a história não é perfeita.
  • O verdadeiro ponto de interesse não é a pontuação do modelo, mas a estratégia apostada por Yang Zhilin: pesos abertos + longo contexto + cluster de Agentes — um caminho totalmente diferente do da OpenAI.

Um baterista, por que consegue criar o quarto modelo mais importante do mundo?

Primeiro, a conclusão: Yang Zhilin não teve sorte.

Ele é um dos poucos a realizar o ciclo "teoria para produto".

Transformer-XL, XLNet, dois artigos, primeiro autor. Esses não são artigos comuns. Eles são uma das bases para todos os modelos grandes hoje em dia lidarem com sequências longas.

Muitas pessoas escrevem teses. Poucas transformam teses em empresas. Aquelas que transformam empresas em uma das quatro maiores do mundo podem ser contadas nos dedos de uma mão.

Nascido em 1992, de Shantou, Guangdong. Graduado em Ciência da Computação na Universidade Tsinghua, tocava bateria e compunha músicas na banda de rock universitária Splay enquanto programava. Obteve o doutorado pela Universidade Carnegie Mellon em quatro anos. Trabalhou no Google Brain e no Meta AI, com colaboradores como Bengio e LeCun.

Co-fundou sua primeira empresa de IA aos 24 anos. Em março de 2023, fundou a Moonshot AI.

Este currículo, na Silicon Valley, também é uma amostra rara. Na China, é praticamente o único.

Por que enfatizar isso?

Neste caminho dos grandes modelos, "li todos os artigos relacionados" e "esses artigos foram escritos por mim" representam duas energias potenciais completamente diferentes. A primeira é uma curva de aprendizado; a segunda é intuição de primeira-mover. Yang Zhilin pertence à segunda.

Transformer-XL resolve o problema de "não conseguir lembrar sequências muito longas". XLNet aprimora o paradigma de pré-treinamento além do BERT. Na continuidade dessas duas coisas está a etiqueta de produto mais distintiva do Kimi hoje: contexto longo.

Da fase inicial do assistente inteligente Kimi, com 200 mil caracteres, passando para 2 milhões de caracteres, até o K3, que oferece diretamente 1M de tokens (aproximadamente 1 milhão de tokens).

This is not a marketing topic. It is a natural extension of his academic career.

Onde o Kimi K3 é forte e onde é fraco

Primeiro, veja os dados concretos.

Kimi K3 lançado em 16 de julho de 2026. 2,8 trilhões de parâmetros totais, arquitetura esparsa MoE, com 16 especialistas ativados por token entre 896 especialistas. Janela de contexto de 1.048.576 tokens. Suporte nativo a visual.

Pontuação do Intelligence Index v4.1 da terceira parte independente Artificial Analysis: 57,1, 4º no mundo.

Os três primeiros são Claude Fable 5 (59,9), GPT-5.6 Sol (58,9) e Kimi K3, seguidos de perto por Claude Opus 4.8 (55,7). A seguir, Grok 4.5 está em 53,8, GLM-5.2 em 51,1 e DeepSeek V4 em 44,3.

Esta é a primeira vez que um modelo chinês realmente entra no primeiro escalão global.

Veja os itens específicos. GPQA Diamond: 93,5%. Terminal-Bench 2.1: 88,3%, quase empatando com o 88,8% do GPT-5.6 Sol. BrowseComp: 91,2%. No Frontend Code Arena do Arena.ai, o K3 ficou em primeiro lugar, superando o Claude Fable 5. Também em primeiro lugar no AutomationBench-AA, com 53%.

Na pontuação independente GDPval-AA v2, que mede o "conhecimento do valor econômico real", o Elo do K3 subiu diretamente de 1190 na geração anterior K2.6 para 1668, superando o Claude Opus 4.8 com 1600, o GLM-5.2 com 1514 e o GPT-5.5 com 1494.

A amplitude do salto é de 478 Elo. Muito agressivo.

Onde está a fraqueza?

Taxa de ilusão alta. A Análise Artificial mediu uma taxa de ilusão de 51% para o K3, maior que a geração anterior. A precisão melhorou, mas a "probabilidade de falar besteira" também aumentou.

Redundant. K3 generated 130 million tokens in the full AA evaluation, while the industry average is 63 million. Double. Simon Willison tested a simple "draw a goose" SVG task, costing about $0.25.

Os pesos abertos foram adiados. No dia do lançamento, não havia checkpoint, nem licença, nem model card, nem relatório técnico. A Moonshot prometeu liberar até 27 de julho — ou seja, seis dias após a redação deste artigo. Antes disso, o K3 só pode ser usado por meio de API e App, sendo essencialmente um "modelo hospedado".

Não há pontuação SWE-bench Pro/Verified. Os conjuntos de avaliação escolhidos pela Moonshot, como DeepSWE e FrontierSWE, ainda não podem ser reproduzidos por terceiros.

Então, o K3 é um modelo "realmente bom, mas ainda não perfeito". Isso precisa ser deixado claro, sem tentar exagerar suas qualidades.

Sinal ainda mais relevante: A IA na China não é mais "barata como repolho"

Este é o item mais ignorado, mas possivelmente mais importante da K3.

Preço da API do K3: $3 por milhão de tokens de entrada, $15 por milhão de tokens de saída, $0,30 para entrada em cache.

Quanto era o Kimi K2.6 da geração anterior? $0,95 / $4,00.

Aumentou cerca de três vezes.

O que significa esse preço? Está basicamente alinhado ao nível do Claude Sonnet. Ou seja, a Moonshot voluntariamente abriu mão da carta mais marcante dos últimos anos nos grandes modelos chineses — o preço extremamente baixo.

Why?

Devido aos 2,8 trilhões de parâmetros, ao modo de pensamento profundo sempre ativo e ao contexto de 1M, os custos não podem ser reduzidos. Além disso, a posição do K3 já não é mais a de um "assistente barato para você usar", mas sim a de uma "base de agente que compete diretamente com o Claude Opus e o GPT-5.6".

Curiosamente, mesmo com um aumento de três vezes, o custo unitário do K3 calculado pela Artificial Analysis é de aproximadamente US$ 0,94, cerca da metade do Claude Opus 4.8 (US$ 1,80) e praticamente igual ao GPT-5.6 Sol (US$ 1,04).

Metade do preço, mesma categoria.

Essa foi a razão pela qual o mercado acionário dos EUA tremeram em 17 de julho.

Naquele dia, o Nasdaq caiu mais de 1,4%. A NVIDIA também foi vendida. Um evento de lançamento de uma startup chinesa realmente afetou o sentimento do mercado acionário norte-americano.

Isso era impensável há dois anos. Há dois anos, a transmissão dos modelos chineses para os mercados americanos era quase inexistente.

Agora existe. Porque a narrativa mudou.

A narrativa mudou de "os EUA criam a fronteira, a China segue" para "a China também cria a fronteira, além de ter peso e ser metade do preço". Essa narrativa exerce uma pressão direta, duradoura e estrutural sobre a capacidade de precificação de laboratórios avançados fechados como Anthropic e OpenAI.

Por trás da avaliação de US$ 20 bilhões: uma aposta que quadruplicou em três meses

O ritmo do financiamento também conta a mesma história.

No final de 2024, a avaliação da Moonshot era de aproximadamente US$ 3,3 bilhões. Em maio de 2026, um novo ciclo de financiamento de cerca de US$ 2 bilhões foi concluído, com avaliação superior a US$ 20 bilhões.

Quadruplicou em três meses.

Yang Zhilin disse em 2026, durante o Fórum Zhongguancun em março: "Nos próximos anos, um número cada vez maior de trabalhos de pesquisa será liderado por IA." Ele também revelou três rotas tecnológicas na GTC de 2026: eficiência de tokens, contexto longo e escala de clusters de agentes.

Entenda essas três linhas para compreender a aposta do Moonshot.

Eficiência do token, correspondente aos dois novos mecanismos do K3: Kimi Delta Attention e Attention Residuals, que supostamente aumentaram a velocidade de decodificação em até 6,3 vezes.

Contexto longo, correspondendo a uma corrida de 200.000 palavras até 1 milhão de tokens.

Agent cluster, correspondente ao K3, claramente definido como "agentic reasoning model" — projetado para tarefas de cadeia longa, navegação em repositórios de código e chamada de ferramentas, não para bate-papo.

Essas três rotas são a aposta de Yang Zhilin na "próxima forma de IA".

Ele apostou que um único grande modelo não é o fim; o verdadeiro fim é uma coleção de agentes com geração dinâmica e coordenação colaborativa.

Essa avaliação terá uma resposta em dois anos.

Ciência aberta é o verdadeiro fosso de proteção da IA na China

Aqui é necessário mencionar um contexto maior.

Neste período, um comentário de um pesquisador de IA no exterior tem circulado amplamente no setor, resumidamente: os laboratórios chineses conseguem produzir continuamente modelos como GLM-5.2 e Kimi K3 não porque possuem mais poder de computação, mas por causa da abertura — não apenas a abertura dos pesos, mas também de todo o ecossistema.

Há uma observação muito contundente nisso: grande parte do treinamento de modelos nos principais laboratórios chineses é realizada por estagiários. Além disso, esses alunos de graduação e pós-graduação compreendem profundamente os detalhes do treinamento e têm uma disposição para compartilhar que é 100 vezes maior que a de seus colegas americanos.

Por outro lado, os laboratórios de ponta dos Estados Unidos praticamente não contratam estagiários. Doutorandos de Stanford e Berkeley precisam se esforçar muito para conseguir uma oportunidade de treinar um modelo de "tamanho adequado". A maioria das fórmulas secretas está trancada por um pequeno grupo de pesquisadores privilegiados.

Não é uma disputa entre a China e os EUA. É uma disputa entre ciência aberta e ciência fechada.

A existência do Kimi K3 é, por si só, o melhor comentário para este argumento.

Um empreendedor baterista de 34 anos, usando seu próprio artigo como base, liderou um grupo de jovens ainda na faculdade ou recém-formados para criar o quarto maior modelo do mundo.

Esse evento provavelmente não ocorrerá dentro da OpenAI. Não é que as pessoas não consigam, é que o mecanismo não permite.

Claro, o adiamento do K3 para 27 de julho em si também é um sinal — os defensores da abertura também estão hesitando, calculando e sendo forçados a recuar um passo pela pressão comercial. Esse movimento merece atenção, mas não é suficiente para invalidar a direção geral.

DeepSeek V4 continua aberto sob a licença MIT. GLM-5.2 também. O bloco chinês de pesos abertos não se desfez.

How far can a drummer go?

Voltar a Yang Zhilin.

Empreendedor tecnológico com fundo de baterista de rock, ele é quase um outsider no cenário chinês de IA. Ele não se encaixa no perfil típico de "cientista brilhante de Tsinghua" nem no caminho clássico de "elite retornada da Silicon Valley".

Ele não faz muitos discursos públicos, mas são densos. Naquela palestra no GTC 2026, ele apresentou o roadmap técnico de forma sólida — reestruturar o otimizador, reestruturar o mecanismo de atenção, reestruturar as conexões residuais. Isso não é retórica de PR, é um julgamento técnico.

Ele também reconheceu as limitações do Moonshot. O próprio blog de lançamento da K3 é muito transparente: ainda há uma lacuna em relação à UX em comparação com o Claude Fable 5 e o GPT-5.6 Sol; é sensível ao histórico de pensamentos mantidos; e é "excessivamente proativo" em tarefas ambíguas.

Um CEO sincero, um pesquisador que incorporou seu artigo ao produto, uma jovem equipe unida pela rede de Tsinghua, além de uma rota técnica clara. Este é o alicerce da Moonshot hoje.

Não é perfeito. Ele cometerá erros. Seu caminho de monetização ainda não foi totalmente validado — se o aumento de preço em três vezes poderá sustentar o crescimento, se o custo de computação para contextos de 1M poderá ser reduzido, e quando o formato de Agent realmente se concretizarão — todas essas são incertezas.

Mas é real. Não é uma empresa de PowerPoint, não é uma bolha de avaliação, não é baseada em hype temporário.

Conclusão: O Nasdaq sacudido é apenas o começo

Em 17 de julho de 2026, o Nasdaq caiu 1,4%.

Alguém pode dizer que uma queda de 1,4% não é nada, pois o mercado está sempre em volatilidade.

Mas o que você precisa observar é a cadeia de causalidade: uma startup chinesa lança um modelo que, no mesmo dia, é seriamente avaliado pela Reuters, CNBC e avaliadores independentes como Simon Willison, faz com que a NVIDIA seja vendida simultaneamente e faz com que a Artificial Analysis o classifique diretamente entre os quatro melhores do mundo.

Isso nunca aconteceu antes.

Isso significa uma coisa: o poder de precificação e a voz da IA estão começando a se deslocar silenciosamente da Baía de São Francisco. Não totalmente, mas já estão começando a se deslocar.

Yang Zhilin não é o único impulsionador. A equipe DeepSeek é, Zhipu é, Alibaba Tongyi é. Mas ele é, sem dúvida, o símbolo mais afiado e típico desta rodada — um jovem de 34 anos que entende teoria, produto, abertura e comercialização, e já tocou bateria.

Haverá uma próxima geração de modelos. K4, K5 certamente virão. As pontuações sempre serão empatadas e depois superadas.

O que realmente permanecerá é se esta rota aberta pode ser mantida.

Se for mantido, a IA não será a IA de três empresas.

Se não conseguirmos manter, então apenas estaremos passando de um antigo fechamento para um novo fechamento.

Quanto a Yang Zhilin em pessoa — provavelmente ele não se importa muito com essas grandes narrativas. Com 34 anos, uma empresa avaliada em US$ 20 bilhões, um dos quatro principais modelos do mundo nas mãos e uma equipe composta inteiramente por jovens com quem ele pode conversar, essa posição já é suficiente para que ele continue tocando bateria, escrevendo artigos e sendo um dos poucos que transformam seus artigos acadêmicos em produtos.

Quando foi a segunda vez que a Nasdaq tremera?

Provavelmente não vai demorar muito.

Referências

  1. Reuters, "China's Moonshot lança o maior modelo de IA aberto do mundo, se aproximando das rivais dos EUA", 2026-07-17
  2. CNBC, "China's Moonshot AI lança o Kimi K3 que concorre com OpenAI e Anthropic", 2026-07-17
  3. Os Rankings de IA, "Kimi K3: Benchmark, Preço e Avaliação — O Modelo Fronteiriço de 2,8T da Moonshot", 2026-07
  4. O Decoder, "O modelo aberto Kimi K3 se aproxima do GPT-5.6 Sol e Fable 5, sinalizando o fim da IA chinesa superbarata", 2026-07
  5. Análise Artificial, "Ficha do Modelo Kimi K3 e Índice de Inteligência v4.1", 2026-07
  6. Wall Street Journal, "Yang Zhilin, fundador do Kimi: O desenvolvimento de IA no futuro entrará na era liderada por IA, com avaliação da empresa já em US$ 18 bilhões", 2026-03-25
  7. Era da Inteligência Inteligente, Palestra de Yang Zhilin no GTC 2026: Divulgação Completa pela Primeira Vez do Mapa de Rota Técnica do Modelo Kimi, 2026-03-18
  8. China AI Atlas, "Perfil de YANG Zhilin (杨植麟)"
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.