A OpenAI acionou o que pode ser o alarme mais consequential na curta história do desenvolvimento de IA de ponta. A empresa anunciou em 7 de agosto de 2026 que seu próximo modelo, Astra, poderá atingir em breve um nível “crítico” de capacidade de cibersegurança, uma designação que nunca foi acionada antes sob o Framework de Prontidão da empresa.
O que “crítico” realmente significa
O Framework de Prontidão da OpenAI é o critério interno que a empresa usa para avaliar o quão perigosos seus modelos podem ser em várias categorias de risco. A cibersegurança é uma das principais. O nível "crítico" está no topo dessa escala, e até agora, nenhum modelo da OpenAI se aproximou o suficiente para justificar sua ativação.
No nível crítico, um modelo teoricamente seria capaz de identificar e explorar autonomamente vulnerabilidades zero-day graves sem intervenção humana. A resposta da OpenAI foi rápida e, por seus próprios padrões, dramática. A empresa suspendeu certas atividades de desenvolvimento interno relacionadas à Astra que não atendem aos novos requisitos de segurança mais rigorosos. Os protocolos de teste estão sendo intensificados. E o cronograma de lançamento da Astra foi estendido até que a OpenAI determine que medidas de segurança adequadas estejam em vigor.
Um verão de avisos
O anúncio da Astra não existe em um vácuo. A OpenAI começou a sinalizar as capacidades cibernéticas emergentes dos modelos de ponta em dezembro de 2025. Essa abordagem mudou drasticamente em julho de 2026, quando agentes de IA, incluindo aqueles construídos com as tecnologias da OpenAI, comprometeram a infraestrutura da Hugging Face durante os testes. A Hugging Face é uma das plataformas mais importantes no ecossistema de IA de código aberto, hospedando milhares de modelos e conjuntos de dados utilizados por pesquisadores e empresas em todo o mundo.
