O Google lançou três novos modelos Gemini com o objetivo de tornar os agentes de IA mais rápidos, mais baratos e mais eficientes à medida que a competição aumenta nos campos de codificação, automação empresarial e cibersegurança.
A linha inclui Gemini 3.6 Flash, Gemini 3.5 Flash Lite e Gemini 3.5 Flash Cyber. O Google também confirmou que o Gemini 3.5 Pro está sendo testado com parceiros e que iniciou sua execução de pré-treinamento mais ambiciosa até agora para o Gemini 4.
O Gemini 3.6 Flash serve como o modelo principal na versão, oferecendo desempenho superior em codificação, trabalho de conhecimento e multimodalidade, enquanto consome menos tokens que o Gemini 3.5 Flash.
De acordo com o Google, o modelo utiliza 17% menos tokens de saída no Índice de Análise Artificial. A empresa afirmou que as reduções de tokens atingiram até 65% em certos testes do DeepSWE, com o modelo também exigindo menos etapas de raciocínio e chamadas de ferramentas para concluir fluxos de trabalho com múltiplas etapas.
O Gemini 3.6 Flash custa $1,50 por milhão de tokens de entrada e $7,50 por milhão de tokens de saída, oferecendo aos desenvolvedores um preço mais baixo por tarefa agente em comparação com seu antecessor.
O modelo obteve 49% no DeepSWE, em comparação com 37% para o Gemini 3.5 Flash, refletindo maior precisão e menos alterações de código desnecessárias. Sua pontuação no MLE Bench aumentou para 63,9% de 49,7%.
O uso de computadores também melhorou, com o Gemini 3.6 Flash obtendo 83% no OSWorld Verified, em comparação com 78,4% do modelo anterior. O uso de computadores está disponível como uma ferramenta integrada do lado do cliente por meio da Gemini API e do Gemini Enterprise.
O Google disse que o modelo é particularmente adequado para fluxos de trabalho agentes, tarefas de codificação e processos empresariais de longa duração. Ele suporta texto, imagens, áudio e vídeo, com uma janela de contexto de até um milhão de tokens.
Flash Lite visa cargas de trabalho de IA de alto volume
O Gemini 3.5 Flash Lite é projetado para aplicações onde velocidade, throughput e custo são mais importantes do que o uso de um modelo maior.
O modelo gera cerca de 350 tokens de saída por segundo, segundo a Artificial Analysis, tornando-o o modelo mais rápido da linha Gemini 3.5.
É precificado em $0,30 por milhão de tokens de entrada e $2,50 por milhão de tokens de saída. O Google está posicionando-o para cargas de trabalho de alto volume, como busca agente, processamento de documentos, extração de dados, tradução e resumo.
Desenvolvedores podem ajustar o nível de pensamento do modelo conforme a tarefa. Configurações mínimas e baixas priorizam execução mais rápida e barata, enquanto configurações mais altas suportam fluxos de trabalho de subagentes mais complexos.
O Gemini 3.5 Flash Lite obteve 54% no Terminal Bench 2.1, em comparação com 31% para o Gemini 3.1 Flash Lite. Também atingiu 72,2% no GDM MRCR v2, de 60,1%, e 1.140 no GDPval AA v2, em comparação com 642.
O Google disse que o Flash Lite também superou o maior Gemini 3 Flash em vários benchmarks de codificação e agentes, incluindo SWE Bench Pro e OSWorld Verified.
O Google posiciona a Flash Cyber contra o Mythos da Anthropic
O terceiro modelo, Gemini 3.5 Flash Cyber, é especializado em encontrar, validar e corrigir vulnerabilidades de software.
Desenvolvido no Gemini 3.5 Flash, o modelo opera por meio do CodeMender, o agente de segurança de código da Google. Múltiplos agentes Flash Cyber podem trabalhar juntos para analisar vulnerabilidades e produzir um relatório combinado.
O Google disse que o sistema alcançou desempenho competitivo no CyberGym enquanto operava a um preço menor por token em comparação com modelos maiores de cibersegurança.
As posições de lançamento a Flash Cyber como um concorrente de menor custo para modelos de segurança avançados, como o Mythos da Anthropic, projetado para descoberta de vulnerabilidades e raciocínio cibernético complexo.
O Google está adotando uma abordagem restrita para a implantação do modelo devido ao potencial de uso cibernético indevido. O Flash Cyber estará inicialmente disponível apenas para governos e parceiros confiáveis por meio de um piloto limitado do CodeMender.
A empresa disse que o lançamento tem como objetivo fornecer aos defensores acesso a ferramentas de detecção e correção de vulnerabilidades antes que o modelo seja disponibilizado de forma mais ampla.
O pré-treinamento do Gemini 4 começa
Gemini 3.6 Flash e Gemini 3.5 Flash Lite estão disponíveis por meio da Gemini API, Google AI Studio, Android Studio e Gemini Enterprise.
Gemini 3.6 Flash também está disponível por meio do Google Antigravity e do aplicativo Gemini, enquanto o Flash Lite está sendo lançado por meio do Google Search.
As versões chegam enquanto o Google continua testando o Gemini 3.5 Pro com parceiros. O modelo principal ainda não recebeu uma data de lançamento amplo.
O Google também confirmou que o desenvolvimento de sua próxima geração está em andamento, com a empresa iniciando o que descreveu como seu treinamento prévio mais ambicioso até agora para o Gemini 4.
