O Google atualiza o Gemini 3.8 Flash, preço congelado até 2026

icon币界网
Compartilhar
AI summary iconResumo
O Google lançou o Gemini 3.8 Flash e a variante 3.8 Flash Cyber para atualização de rede, apenas três semanas após o 3.7. O Gemini 3.8 Flash padrão já está disponível por meio da API Gemini, Google AI Studio, Android Studio e em alguns produtos consumidores, enquanto a versão Cyber só é acessível a agências governamentais e operadores de infraestrutura. Os preços permanecem congelados em US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída até o final de 2026, após o que dobrarão. Tarefas complexas podem usar mais tokens, aumentando os custos. As notícias sobre preços de criptomoedas indicam precificação estável por enquanto, mas mudanças estão previstas para o próximo ano.
Relatório do CoinNews:

O Google lançou o Gemini 3.8 Flash e o 3.8 Flash Cyber voltado para defesa cibernética em 2 de setembro. Apenas três semanas após o lançamento do 3.7 Flash, este é o terceiro update da série Flash em seis semanas. O Google posiciona o 3.8 como o modelo Flash mais poderoso atualmente em raciocínio e codificação; a versão padrão já está disponível no Gemini API, Google AI Studio, Android Studio, Gemini Enterprise e em alguns produtos de consumo; a versão Cyber, por sua vez, está acessível apenas por meio do novo Fairwind Program, com acesso prioritário para instituições governamentais confiáveis, operadores de infraestrutura crítica e mantenedores de software. Ambas compartilham a inteligência básica, mas possuem permissões de implantação e proteções de segurança diferentes.

O preço de lançamento do Flash 3.8 continua sendo de US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída, igual ao 3.7. No entanto, esse preço só será válido até 31 de dezembro de 2026; a partir de 1º de janeiro de 2027, os preços oficiais aumentarão para US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída. Um detalhe facilmente ignorado é que o modelo executa mais etapas de raciocínio e chama repetidamente ferramentas em tarefas complexas, e o Google alerta explicitamente que níveis de esforço elevados podem consumir mais tokens. O fato de o preço unitário não ter aumentado não significa que a fatura total de uma tarefa permanecerá inalterada.

Flash começa a disputar tarefas longas, com foco além da velocidade na taxa de conclusão

As evidências apresentadas pelo Google abrangem codificação de longo prazo, análise profissional e raciocínio em múltiplos passos. 3.8 Flash superou a maioria dos modelos前沿 maiores na avaliação de engenharia de software de longo prazo DeepSWE v1.1; obteve 54,9% no HLE-Verified. A empresa também citou benchmarks de agentes financeiros e jurídicos para indicar que busca transformar o Flash de um modelo de resposta de baixa latência em um modelo de trabalho capaz de planejar continuamente, chamar ferramentas e entregar resultados completos. Demonstrações como visualização de desmontagem de hardware, geração de mapa da versão DOS por meio de uma única instrução e jogo 3D reforçam que o modelo não se limita a produzir trechos de código, mas pode verificar e modificar continuamente o produto em um ciclo.

No entanto, a pontuação de referência não pode ser convertida diretamente em produtividade empresarial. A taxa de sucesso em tarefas longas geralmente é influenciada pelo tamanho do repositório de código, ambiente de dependência, qualidade dos testes, permissões das ferramentas e orçamento de tentativas. A estratégia mais “dedicada” da 3.8, ao aumentar a taxa de conclusão, também aumenta o tempo de execução e o uso de tokens. As equipes de desenvolvimento precisam registrar simultaneamente o preço por chamada, o total de tokens por tarefa, o número de chamadas de ferramentas, o número de tentativas antes do sucesso e o tempo de retrabalho humano para saber se a atualização realmente é mais barata. Para cargas de trabalho com prioridade em latência ou orçamento, o Google ainda recomenda reduzir o nível de esforço ou continuar usando o 3.7 Flash; versões anteriores não foram descontinuadas imediatamente após o lançamento do novo produto.

A versão padrão já está disponível para desenvolvedores e empresas; usuários do Google AI Pro e Ultra também podem utilizá-la no aplicativo Gemini, no Modo AI da Pesquisa e no Gemini no Sheets. As funcionalidades, cotas e alcance regional podem variar conforme a entrada, portanto, “o modelo foi lançado” não deve ser interpretado como significando que todos os usuários e todos os produtos têm exatamente as mesmas capacidades. Em particular, fluxos de trabalho com ferramentas autônomas dependem de o aplicativo fornecer as ferramentas, permissões e ambiente de execução recuperável apropriados para o modelo.

A versão Cyber é mais forte e mais estreita; 47,2% não é um compromisso de reparo automático

O Gemini 3.8 Flash Cyber concentra-se na detecção de vulnerabilidades e geração de patches. O Google afirma que, em avaliações internas de detecção de vulnerabilidades abrangendo 20 linguagens de programação, obteve uma taxa de sucesso superior a 70%; no benchmark externo CWE-Bench para patches, alcançou um pass@1 de 47,2%, próximo aos 47,8% de um dos principais modelos de ponta, mas com custo mais baixo. Resultados internos da equipe de segurança do Chrome mostram que o 3.8 Flash Cyber gerou 2,6 vezes mais patches corretos de vulnerabilidades do que o melhor modelo comercial grande. A Wiz também relatou um aumento de 7,5 a 9,7 pontos percentuais na taxa de recall em seus benchmarks internos de teste de penetração, com custo 2,3 a 5,2 vezes menor.

Esses números têm valor de referência, mas também limites. As amostras, dicas e métodos de julgamento humano para referências internas não foram totalmente detalhados no anúncio; o pass@1 de 47,2% significa também que uma única geração não garante que mais da metade das questões sejam corrigidas corretamente. O Google prioriza a "correção" em vez da "exploração" e adiciona proteção contra abuso químico, biológico, radiológico, nuclear e cibernético ao modelo 3.8 comum. A versão Cyber, para atender às necessidades de defesa profissional, adota restrições de segurança cibernética mais flexíveis e, portanto, não foi totalmente divulgada, estando disponível apenas para defensores confiáveis no programa Fairwind.

O que realmente muda nesta versão é o equilíbrio da série Flash: em vez de depender apenas de baixo custo e velocidade para atrair solicitações em massa, agora busca uma maior taxa de conclusão de tarefas complexas por meio de ciclos de inferência mais longos. O erro mais comum que as empresas cometem ao substituir diretamente a 3.7 pela 3.8 é comparar apenas os preços por milhão de tokens. Uma abordagem mais segura é testar tarefas reais em camadas: limitar o esforço em solicitações simples, permitir mais ciclos em tarefas longas e manter aprovação humana e ambientes isolados para tarefas seguras. A Flash 3.8 já está disponível, e o Cyber já entrou no programa restrito; se ela consegue realizar mais tarefas de produção com custo total mais baixo ainda será respondido pelos dados end-to-end de cada equipe.

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.