Mensagem do BlockBeats, 8 de agosto: a OpenAI publicou um novo blog afirmando que testes internos mostraram avanços significativos no modelo Astra, recém-lançado, em codificação de agentes e segurança cibernética. Após avaliação conforme seu Framework de Prontidão, a OpenAI declarou que não pode descartar a possibilidade de o modelo já ter atingido o limiar de capacidades cibernéticas "críticas".
Além disso, a OpenAI esclareceu explicitamente no artigo que o modelo Astra não participou do recente incidente de segurança da Hugging Face e continua a realizar testes de referência conforme o Preparedness Framework para gerenciar capacidades avançadas de rede. Por conseguinte, a OpenAI suspendeu atividades internas relacionadas ao Astra que ainda não atendem a esses requisitos reforçados de segurança.
A capacidade denominada “crítica” é definida como: o modelo pode descobrir e explorar todos os vazimentos funcionais de nível crítico em grandes sistemas críticos realçados, sem intervenção humana; ou projetar e executar independentemente estratégias de ataque cibernético inovadoras de ponta a ponta contra alvos realçados, com base apenas em objetivos de alto nível. Modelos anteriores (como GPT-5.6-Sol) foram avaliados apenas como nível “alto”.
