O Google parece estar se preparando para lançar dois novos modelos de IA, com identificadores para Gemini 3.6 Flash e Gemini 3.5 Flash Lite aparecendo na infraestrutura de desenvolvimento da empresa. O ID do modelo gemini-3.6-flash-tiered foi detectado no Antigravity IDE do Google, sugerindo que os modelos estão pelo menos próximos de estarem prontos para acesso externo por meio do AI Studio e da API Vertex.
O que realmente sabemos sobre os novos modelos
As inscrições para o Gemini 3.6 Flash e 3.5 Flash Lite foram inicialmente registradas em 21 de julho de 2026. O registro interno nas ferramentas de desenvolvimento geralmente é um dos últimos passos antes de um modelo se tornar acessível ao público, embora não garanta um lançamento iminente.
O modelo atual Gemini 3.5 Flash do Google continua operacional no AI Studio e no Vertex AI. Esse modelo atualmente opera a aproximadamente US$ 1,50 por milhão de tokens de entrada e US$ 9 por milhão de tokens de saída, com uma janela de contexto de 1 milhão de tokens.
O sufixo “tiered” no ID registrado para o modelo 3.6 Flash sugere uma estrutura de preços com múltiplos níveis de acesso, possivelmente diferenciando entre planos gratuitos com limitação de taxa e planos pagos de produção.
Nenhum dos modelos recebeu um anúncio público formal do Google, e nenhum documento apareceu nas páginas de desenvolvedor da empresa até a data deste texto.
O problema do Gemini 3.5 Pro
O Gemini 3.5 Pro do Google foi notavelmente atrasado. O modelo Pro representa a oferta de raciocínio e capacidade de ponta do Google, projetada para competir com os modelos mais avançados da OpenAI, Anthropic e outras laboratórios de ponta. Lançar variantes Flash e Flash Lite como soluções provisórias enquanto o modelo Pro enfrenta atrasos é consistente com o padrão histórico do Google de associar lançamentos rápidos da linha Flash com modelos Pro mais refinados.
O que isso significa para o mercado de IA e para os investidores
A empresa-mãe do Google, Alphabet, permanece como uma das maiores empresas investindo em infraestrutura e desenvolvimento de modelos de IA globalmente. O registro de novas variantes de modelos sinaliza compromisso contínuo em expandir o ecossistema Gemini, mesmo com o prazo de lançamento do modelo principal adiado.
Cerca de US$ 1,50 a US$ 9 por milhão de tokens para o modelo Flash atual, o Google está se posicionando competitivamente contra rivais. Um modelo Flash Lite poderia reduzir ainda mais esses custos, potencialmente subtraindo concorrentes que cobram taxas premium por qualidade de inferência comparável.
