Autor: Michael Spencer
Tradução: Deep潮 TechFlow
Leitura destacada de Shenchao: Após o lançamento do Kimi K3 da Moonshot, empresas americanas estão migrando para modelos de código aberto chinês para reduzir custos de tokens, abalando as histórias de IPO da OpenAI e da Anthropic. Enquanto grandes provedores de nuvem americanos gastam bilhões para construir centros de dados, modelos chineses alcançam resultados iguais ou superiores com menos poder de computação — isso não é uma competição tecnológica, é uma reorganização do poder da IA.
Geopolítica e IA em confronto direto 🔥
Como você sabe, a empresa chinesa Moonshot AI lançou a nova versão de seu modelo Kimi, o Kimi K3, impulsionando uma grande quantidade de empresas de IA a migrar para modelos de pesos abertos. Este pode ser um dos eventos mais significativos de IA de 2026. Enquanto a guerra no Estreito de Ormuz permanece pendente e o índice Nasdaq 100, repleto de ações de tecnologia, sofre uma queda acentuada, isso está se transformando em um dilema geopolítico e do governo Trump. Nos campos da guerra e da IA, claramente não há soluções claras.

Imagem: A geopolítica dos Estados Unidos novamente provoca agitação no mercado. Uma guerra extremamente impopular e custosa.
Modelos de IA generativa estão evoluindo, mas podem estar freando o crescimento da receita das gigantes de IA, OpenAI e Anthropic. As grandes fornecedoras norte-americanas de nuvem estão se aproximando de fluxo de caixa livre negativo por meio de gastos de capital impressionantes em IA e investimentos em data centers, e você não pode deixar de se perguntar se tudo isso vale a pena — se os modelos chineses estão ficando cada vez maiores e mais eficientes, conseguindo replicar desempenho equivalente com custos significativamente mais baixos. Isso pode evoluir para uma crise de IA no mercado de ações, mesmo enquanto a prosperidade dos semicondutores parece entrar em uma correção de mercado baixista, logo após a estreia da líder sul-coreana de HBM, SK Hynix, nos EUA. A Coreia do Sul (KOSPI) agora se tornou um indicador líder.
Com a iminente estreia da fabricante chinesa de DRAM, CXMT, em Xangai, isso configura uma tensão intensa no confronto futuro entre EUA e China na IA. A notável rodada de financiamento do DeepSeek, juntamente com os planos do DeepSeek, Luna Obscura, OpenAI e outros para IPO em 2027, tornam o próximo ano certamente extraordinário. O DeepSeek arrecadou cerca de US$ 74 bilhões em financiamento em junho do mês passado. Devemos assumir que o Databricks também é um dos beneficiários desta onda de adoção empresarial de IA, roteamento e modelos open-source com tokens mais baratos — o Databricks anunciou uma nova rodada de financiamento com avaliação de US$ 188 bilhões.
O Gemini 3.5 Pro do Google sofreu um atraso crítico no pior momento possível. O lançamento do novo modelo Grok 4.5 da SpaceXAI foi completamente ofuscado pelo momento Kimi K3. A confusão em torno do Anthropic Fable 5 fez a China reviver o retorno definitivo do momento DeepSeek de janeiro de 2025. O próprio lançamento do GPT 5.6 Sol da OpenAI também foi quase totalmente encoberto.
O governo Trump restringiu rapidamente modelos do nível Mythos, mas enfrenta um problema sério: e se modelos chineses conseguirem aproximar-se dessas mesmas capacidades usando pesos de modelos de código aberto — capacidades que originalmente se acreditava exigiriam meses para serem alcançadas? O governo Trump está demonstrando sinais de que pode proibir modelos chineses avançados e adotar medidas agressivas para conter o surgimento da IA chinesa. Eu pensava que eles não regulamentariam a indústria de IA. Assim é o capitalismo de mercado livre global.
O novo mundo corajoso da eficiência de tokens parece muito chinês
As sete grandes fornecedoras de nuvem, incluindo Microsoft, Amazon, Meta e até mesmo Google, perderam parte de sua influência e credibilidade na IA neste ciclo. A gestão inadequada de modelos do nível Mythos, somada ao surgimento de modelos como o Kimi K3, criou uma tempestade perfeita, levando muitas empresas a adotar um uso mais racional e muito mais eficiente em termos de custo de tokens.
Embora o Open-Router não represente o global, é um ponto de amostragem interessante para a tendência macro geral: modelos de peso de código aberto mais baratos provenientes da China parecem estar ganhando participação de mercado.

Figura: A era das dicas deu lugar à realidade da eficiência de roteamento e tokens
Na minha opinião, alguns dos melhores modelos de peso abertos dos Estados Unidos são o Inkling da Thinking Machine (lançado há cerca de uma semana) e qualquer produto que a Reflection possa lançar em breve. O Nemotron da NVIDIA é frequentemente citado como alternativa ao precedente liderança da Meta. O problema é que os Estados Unidos realmente carecem de liderança no campo da IA de código aberto. Para os Estados Unidos, isso representa um potencial desastre em termos de liderança em modelos, tokens e adoção empresarial de IA de ponta.
Mais curiosamente, o discurso mais importante recente do presidente chinês Xi Jinping sobre inteligência artificial foi proferido como discurso principal na Conferência Mundial de Inteligência Artificial (WAIC). O presidente Xi Jinping participou da cerimônia de abertura da WAIC de 2026 em Xangai e proferiu um discurso principal intitulado "Trabalhando Juntos para Construir um Sistema Global de Governança da IA Justo e Equitativo". A China parece estar mais avançada que os Estados Unidos em governança e liderança regulatória em IA, promovendo ativamente a cooperação global em torno desse tema.
O próprio Qwen 3.8 Max da Alibaba (versão de pré-visualização) também terá um componente de reestruturação de licença aberta, acompanhado por um plano agressivo de precificação internacional de tokens. O Kimi K3 não é voltado para desenvolvedores amadores, mas para clientes corporativos, a fim de aumentar o ARR antes de sua IPO, prevista para cerca de seis meses. A competição entre EUA e China em modelos, mesmo com pouquíssimos produtos de aplicação disponíveis, está exagerando a demanda por capacidade de processamento, enquanto a China possui tanto a geração de tokens mais barata quanto energia mais abundante. No momento em que a missão-chave do governo Trump parece ser manter a prosperidade da bolsa de valores impulsionada pela IA para a elite financeira e a classe empresarial, todos, da Anthropic à Lua da Face Oculta, estão ajustando suas posições para maximizar o entusiasmo da IPO e o impulso de vendas de receita.
A classificação dos modelos ainda é importante?
Se ordenado pelo Artificial Analysis Intelligence Index e classificado pelo modelo mais inteligente, a classificação é:
O estado atual do desempenho do modelo de pico é aproximadamente o seguinte:
- Anthropic – Claude Fable 5
- OpenAI – GPT 5.6 Sol
- Lado Oculto da Lua – Kimi K3 (pesos abertos*)
- SpaceXAI – Grok 4.5
- ZhiPu (Z.ai) – GLM 5.2 (pesos abertos)
Essas listas e os respectivos benchmarks nas quais foram treinadas são bastante artificiais e provavelmente mudarão na próxima semana, com certeza mudarão no próximo mês.

Figura: Comparar se os LLMs (modelos de linguagem) ainda são o método correto para medir o progresso da inteligência artificial? Análise de IA
"A desconexão da IA" está piorando 🔎
Os modelos de peso abertos da China sempre foram mais baratos, mas em 2026 eles estão se tornando muito mais capazes. Isso significa que empresas americanas estão começando a adotá-los para tarefas cotidianas, a fim de reduzir orçamentos de tokens descontrolados causados por preços no nível de Fable 5 e Mythos 5. Se cada novo modelo chinês tiver potencial para entrar entre os cinco melhores modelos por classificação inteligente, isso representa um grande problema para o complexo industrial de IA dos EUA. O problema da China em IA para os EUA não apenas existe, mas está piorando.
Respeito profundamente os fundadores do DeepSeek, Moonshot AI e Zhipu AI, pois é possível sentir que eles possuem verdadeiro idealismo, e não apenas incríveis talentos em IA e habilidades comerciais. Sob suas restrições de poder computacional e capital, a capacidade de seus modelos demonstra inovação sofisticada e uma notável perspicácia comercial em IA. Você não sente a mesma coisa com executivos da Meta, Google ou Microsoft — há uma desconexão bastante evidente. Em comparação com os gastos de capital das grandes empresas de tecnologia, isso começa a parecer realmente ruim. A execução em IA das grandes empresas de tecnologia em modelos (e produtos) de IA generativa é surpreendentemente má.
Na última semana, um tweet viral de Dean Ball, recém-nomeado diretor de estratégia e futuro da OpenAI, no X, talvez ilustre melhor isso. Ele afirmou que modelos de pesos abertos são essencialmente减速主义 e refletiu sobre como um mundo dominado por modelos de pesos abertos poderia levar ao comunismo da IA, resultando em uma paisagem distópica infernal.

Imagem: Em julho de 2026, o pânico em torno da inteligência artificial de código aberto atingiu um novo pico. As narrativas sobre a China já cansaram.
É evidente que as empresas de modelos fechados e intensivas em capital estão preocupadas com esses desenvolvimentos recentes, repletas de emoções anti-chinesas e argumentos de defesa sobre dessilação e segurança cibernética. Embora os modelos da série Mythos da Anthropic pareçam impressionantes no papel, não conhecemos suas capacidades mais avançadas, pois foram restritos ao público em geral. Nos Estados Unidos, a fronteira entre estrategistas futuros de IA e lobistas parece bastante nebulosa. Assim como os gastos de capital na guerra de preços de tokens de IA corporativa são bastante ruins do ponto de vista do ROI.

Gráfico: As previsões de gastos com capital das grandes empresas de tecnologia são sombrias para 2027. — Banco da América
O que entendemos sobre o protecionismo dos Estados Unidos é que tudo o que não conseguem competir no mercado global, tentarão proibir e restringir no mercado interno. Mas a transição das empresas para modelos de peso abertos já é a principal história de 2026, e talvez já seja tarde demais — ao fazer isso, eles podem estar criando uma competição de IA aberta para empresas americanas. É esse o dilema da persuasão peculiar dos custos da IA aberta em 2026. Se a tecnologia de IA generativa realmente trouxer ROI confiável, isso não seria um problema, mas é uma tecnologia emergente, e ainda há poucos produtos de IA excelentes capazes de aproveitar esses modelos incríveis.
O Departamento de Comércio dos Estados Unidos considerou listar vários laboratórios chineses de IA em sua "lista de entidades" no ano passado, e tenho certeza de que isso agora voltou à pauta, pois as empresas americanas estão lutando para competir em um mundo onde a eficiência dos tokens está aumentando rapidamente, as ferramentas e rotas são mais importantes do que nunca, os custos dos tokens estão subindo em espiral e há uma crescente complexidade sobre quais modelos usar para quais tarefas.
O governo dos EUA restringir o melhor modelo da sua melhor empresa proprietária, a Anthropic, pode ter sido um erro histórico que permitiu que essa situação dolorosa ocorresse. O momento Kimi K3 torna-se ainda mais dramático por coincidir com o erro cômico de apenas alguns meses antes da altamente divulgada IPO de IA da Anthropic; a publicação Semianalysis analisou o incrível lucro operacional da Anthropic. Você deve assumir que a transição para modelos de peso abertos e a apreensão governamental do Mythos retardaram a empresa de IA número um dos EUA. A Semianalysis acredita que a Anthropic espera atingir mais de US$ 1 bilhão em lucro antes de juros e impostos (GAAP) no terceiro trimestre de 2026 (cerca de 6% de margem), tornando-a uma das primeiras principais laboratórios de IA avançada a alcançar lucratividade contínua trimestral. Todos esses eventos recentes tornam a OpenAI, a Meta e a SpaceXAI os maiores perdedores. Mesmo que o Muse Spark 1.1 da Meta não seja um modelo tão ruim.

Se o governo Trump restringir modelos de peso abertos da China, NVIDIA, Thinking Machines, Meta e Reflection (ainda não lançaram modelos) podem se tornar os grandes vencedores como soluções de token de peso aberto baseadas nos EUA para clientes corporativos.
A narrativa macro de IA em meados de 2026 tornou-se mais interessante. O nível de personalização da IA de código aberto está sendo aprimorado. A eficiência dos tokens e o roteamento tornaram-se mais importantes. Os gastos de capital em IA no mercado estão sendo examinados com cada vez mais atenção.
Muitas histórias de momentos DeepSeek
Modelos de peso abertos: a hegemonia da IA não é comunismo da IA nem ameaça nuclear; tokens mais baratos beneficiam o paradoxo de Jevons e o que empresas, desenvolvedores e consumidores podem fazer com a IA. Nos últimos cinco anos, todo o paradigma de treinamento de modelos de IA generativa foi uma sequestro de multi-cordas da informação linguística do mundo. A demanda por poder computacional não desacelerará porque as empresas escolhem modelos mais baratos — na verdade, acelerará. Este é o dilema de toda a situação macro da IA.
Se capital e capitalismo monopolista são suas barreiras de entrada, os Estados Unidos são um país em dificuldades. O futuro da IA exigirá inovações novas, e não apenas sistemas de capital de risco aprimorados. Claramente, há um abuso de narrativa aqui; integração comercial e geopolítica resolverão tudo como de costume. Enquanto o DeepSeek arrecada mais fundos e se apressa para uma IPO, a pilha de exigências do DeepSeek continua aumentando. Seu modelo principal, o DeepSeek-R2, nunca foi lançado, levantando dúvidas sobre os modelos mais avançados do futuro da China. Liang Wenheng detém entre 78% e 84% das ações do DeepSeek, e eles também estão desenvolvendo seus próprios chips.
A corrida IPO dos Anos 2020
Um mundo em que tanto a Anthropic quanto a Moonshot AI estão limitadas pela capacidade de computação, e o Google se tornou um atrasado nos LLMs, enquanto o Meta e o SpaceXAI permanecem na periferia. Um mundo em que o IPO da OpenAI parece menos atraente a cada trimestre. Um mundo em que estamos cansados de esperar pelos IPOs da Databricks, Crusoe, Anduril, Stripe e outros, mesmo enquanto gigantes chineses de IA física, chips de IA e armazenamento anseiam por entrar no mercado. Supostamente, a oferta pública inicial de 8,6 bilhões de dólares da fabricante chinesa de chips CXMT foi superassinada em mais de 500 vezes por investidores institucionais.
Prevejo que em 2027 ocorrerá o momento ChatGPT da área de robôs (também conhecido agora como AI física), pois circula a notícia de que a Anthropic está em negociações para adquirir a Physical Intelligence. Mesmo que o pioneiro da IA Yann LeCun tenha alertado que esses robôs humanóides serão muito incapazes agora e por um longo tempo no futuro. O Vale do Silício e Wall Street estarão ansiosos para encontrar novas narrativas que sustentem o mercado de ações baseado em IA e provavelmente exagerarão novamente.
Isso ocorreu em um período em que o mercado americano sofreu uma grave escassez de empresas listadas especializadas em robôs ou software de robôs. A China, que estava se recuperando dificilmente da崩盘 imobiliária épica, parecia estar à frente na corrida de IPOs. Embora a Moonshot AI, Zhipu, Minimax ou menores laboratórios chineses de IA sejam impressionantes, o que realmente me fascina é a dinâmica macroeconômica da disputa entre código aberto e código fechado. Em muitos aspectos, trata-se de uma batalha entre capital e talento.
"Esse futuro, para mim, é uma visão distópica do inferno, mas nunca encontrei um defensor de modelos de pesos abertos que não acabasse admitindo que as coisas chegarão a esse ponto," disse Dean Ball ou, ironicamente, a OpenAI.
"Esse futuro, para mim, é uma visão distópica do inferno, mas nunca encontrei um defensor de modelos de pesos abertos que não acabasse admitindo que as coisas chegarão a esse ponto," disse Dean Ball ou, de forma irônica, a OpenAI.
Com os relatórios trimestrais das grandes empresas de tecnologia prestes a serem divulgados esta semana, teremos mais respostas. A história sobre gastos com capital e retorno sobre investimento nunca foi tão crítica. Qualquer falha na execução dos relatórios será punida pelo mercado; nos últimos semanas, algumas avaliações de empresas de crescimento já foram ajustadas, com a SpaceX caindo 25,5%, enquanto o Grok 4.5 novamente não teve impacto suficiente (os padrões são altos). Com a aquisição cara do Cursor, a SpaceX AI parece continuar sendo classificada entre os perdedores da IA.

A Moonshot AI lançou o Kimi K3 em 16 de julho, um modelo grande com até 2,8 trilhões de parâmetros, que se compara aos principais sistemas americanos como Claude e GPT em testes de referência, e planeja abrir totalmente os pesos até 27 de julho para permitir auto-hospedagem de baixo custo.
Até 2027, saberemos quão forte será o IPO da Anthropic, cujo crescimento mais rápido da história da tecnologia de software em ARR enfrenta ventos contrários macroeconômicos da IA e intervenção governamental. O protecionismo dos EUA a protegerá, ou o mercado escolherá o vencedor? Essa tensão se espalhará sem precedentes para uma corrida robótica que abrange espaço, IA e defesa.
O momento GPT do robô está se aproximando
Se a Anthropic realmente adquirir a Physical Intelligence, o momento GPT robótico que mencionei várias vezes pode estar à porta. O IPO chinês da Unitree Technology já é um momento significativo para o futuro da IA física. Ela arrecadará 4,2 bilhões de yuans (619,4 milhões de dólares americanos) e recentemente reduziu em mais de 90% o preço dos robôs quadrúpedes de entrada.
Como a China possui vantagens naturais no campo da robótica, essa competição de IA é uma área em que os Estados Unidos estão se esforçando intensamente para alcançar, com várias rodadas de financiamento em grande escala de capital de risco ocorrendo nesse setor em 2026. Os Estados Unidos parecem estar na liderança em modelos mundiais e startups de cérebros de software dedicadas a tornar os robôs mais práticos, enquanto a China possui um maior número de startups de robôs humanóides (robôs com forma humana) e experimentos com drones e novas formas de hardware robótico.
A Unitree Technology deve fazer sua estreia em bolsa no final deste mês, cerca de três meses antes da importante IPO da Anthropic. A Unitree Technology está rapidamente se tornando a plataforma de hardware padrão de fato para pesquisadores de IA e laboratórios de robótica em todo o mundo, e a competição em robôs humanóides pode aquecer tão rapidamente que a Tesla será obrigada a se fundir com a SpaceX em um futuro próximo. Acredito que isso possa ocorrer no início de 2028. Se a onda de IA generativa recuar de seu pico (como muitos analistas esperam), acho que podemos esperar que a competição em robôs substitua a próxima grande narrativa tecnológica americana.
A competição final entre a China e os Estados Unidos no campo da IA beneficia desenvolvedores, consumidores e empresas globais ao proporcionar mais utilidades do mundo real. Se modelos de IA generativa ou robôs trarão valor prático em breve é uma questão separada em relação ao volume de investimento. É notável o aceleramento dos cronogramas de startups e o aumento significativo nas rodadas de financiamento, embora a urgência de acelerar a aplicação comercial da IA também esteja aumentando. A competição está se intensificando e se tornará ainda mais acirrada em 2027, estabelecendo uma base enorme para a competição tecnológica da década de 2030. A abundância energética da China e a dominância dos Estados Unidos em semicondutores mantêm a situação em suspense.
