Google e Tencent realizaram quase a mesma ação nos modelos: modelos pequenos, eficiência, velocidade de inferência, baixo custo, integração ecológica, priorizando densidade inteligente em vez de limite inteligente. A Google lançou três modelos, sendo o protagonista o Gemini 3.6 Flash. A Tencent lançou oficialmente o Hunyuan Hy3 em 6 de julho. Ambas evitaram competir nos modelos de ponta mais caros. O Gemini 3.5 Pro da Google ainda não foi divulgado publicamente; segundo o Bloomberg, não atingiu os padrões internos de benchmark. O Hy3 da Tencent possui 295 bilhões de parâmetros totais, mas apenas 21 bilhões são ativados no modelo MoE, consumindo apenas 7% da capacidade computacional em cada inferência. Isso é muito interessante. O preço de saída do 3.6 Flash caiu de US$ 9 para US$ 7,5, enquanto a velocidade subiu de 165 tokens/s para 304 tokens/s — quase o dobro. O índice de inteligência permanece em 50, mas usa menos tokens; a fatura do mesmo conjunto de avaliações caiu de US$ 1.041 para US$ 727 — uma redução de 30%. O Hy3 é ainda mais agressivo: a taxa de resolução de tarefas de agente de escritório subiu de 72% para 90%, economizando 47,4% dos tokens ao criar documentos e 49,0% ao fazer apresentações. Agora, ambas as empresas nem sequer querem competir sobre qual modelo é mais inteligente. Elas estão disputando algo muito mais valioso: a entrada padrão. Inteligência suficiente já basta; o verdadeiramente valioso é inserir o modelo nos produtos que os usuários já estão usando. A Google tem Copilot, Workspace e Antigravity. A Tencent tem WeChat, Yuanbao, WorkBuddy, Tencent Docs e jogos. Quando você usa o Hy3 no WorkBuddy para executar fluxos de trabalho ou gera uma apresentação com uma única frase no Yuanbao, essa experiência desaparece fora do ecossistema da Tencent. A Google integrou o Flash no Copilot, e desenvolvedores em todo o mundo já o usam para escrever código. Para plataformas com canais de distribuição, a melhor estratégia não é chegar ao topo das classificações, mas tornar seu próprio modelo a opção padrão inconsciente do usuário. A inteligência está se tornando um produto; a integração é a barreira. Para fabricantes de modelos independentes, isso é difícil: a concorrência é homogênea e o custo de substituição é muito baixo. Pontuações mais altas não importam — usuários avançados são limitados, e usuários comuns não mudam; em tarefas cotidianas, trocar modelos faz pouca diferença. A menos que se destaque claramente em uma capacidade vertical específica, será impossível superar o bloqueio da plataforma. Nos próximos doze meses, o desfecho não estará nos parâmetros do modelo, mas na estabilidade do agente. Quem tiver fluxos de trabalho de múltiplos passos mais estáveis, mais econômicos e com menos erros vencerá. A Google e a Tencent, que controlam as entradas de tráfego, estão no caminho certo — sua monetização seguirá de forma mais fluida.
链研社|AI First🔶💧Compartilhar
Fonte:Mostrar original
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações.
Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.