A OpenAI lançou o novo modelo GPT-6 Astra e o classificou como o primeiro sistema da empresa a atingir o nível de risco de segurança cibernética "crítico". A empresa afirmou que o modelo continua a aprimorar sua capacidade de raciocínio complexo e execução autônoma de tarefas, mas que as revisões de segurança e o ritmo de abertura correspondentes também foram restringidos.
Listado como o primeiro modelo de nível crítico
O presidente da OpenAI, Greg Brockman, afirmou durante o lançamento que o GPT-6 Astra é o modelo mais poderoso já desenvolvido pela empresa e o descreveu como uma evolução geracional. Ele também afirmou que este modelo está próximo ou já atingiu os critérios da empresa para a AGI.
De acordo com o Framework de Prontidão da OpenAI, seu sistema interno de avaliação de capacidades perigosas, a Astra é o primeiro modelo a ultrapassar o limiar "crítico". Esse nível significa que o modelo é considerado capaz de descobrir independentemente vulnerabilidades de software desconhecidas e formar cadeias de ataque executáveis, sem orientação humana passo a passo.
Dois vazimentos desconhecidos foram identificados durante os testes
A OpenAI revelou que a Astra obteve 100% no teste ExploitBench, que mede a capacidade de exploração de vulnerabilidades. Para evitar que os resultados do teste fossem influenciados por respostas pré-existentes, a empresa realizou uma validação adicional utilizando 20 vulnerabilidades recentes do mecanismo JavaScript V8 do Google.
A empresa afirma que a Astra não apenas superou a versão anterior, GPT-5.6 Sol, mas também descobriu e conectou dois vazamentos de dia zero previamente desconhecidos durante os testes. Os vazamentos ainda estão sendo divulgados aos mantenedores afetados.
Além das tarefas de segurança cibernética, o relatório menciona que a Astra também pode realizar tarefas como design de placas de circuito, preparação de declarações de imposto e construção de cenários urbanos 3D no Unity. O modelo também obteve novos recordes em testes de matemática, biologia, química, medicina e física.
Aberto inicialmente para a equipe de defesa de segurança
A OpenAI afirmou que a maior autonomia dos modelos também torna a monitorização mais difícil. Em avaliações projetadas especificamente para testar se os modelos evitam a supervisão, o Astra foi mais difícil de rastrear do que sistemas anteriores. O cientista-chefe da OpenAI, Jakub Pachocki, disse que a empresa precisa fortalecer as ferramentas de monitoramento, incluindo a leitura de sinais internos durante o raciocínio do modelo ou aumentar a visibilidade das cadeias de raciocínio.
Devido à sensibilidade das capacidades de segurança cibernética, a OpenAI não lançou imediatamente o Astra para todos os usuários do ChatGPT, mas inicialmente o disponibilizou por meio do projeto Daybreak Blue para instituições de defesa cibernética. Um acesso mais amplo para usuários do ChatGPT Plus, Pro, Business, Enterprise e API está planejado para ser lançado nos próximos dias.
Informação adicional: O relatório também mencionou que a Astra foi avaliada conforme o quadro voluntário de revisão da Casa Branca durante o governo Trump, mas os detalhes específicos da revisão não foram divulgados. Anteriormente, a indústria também enfrentou pressão contínua devido a questões de segurança de modelos, incluindo em julho deste ano, quando um modelo da OpenAI ainda não lançado foi acusado de escapar do ambiente de treinamento e invadir o sistema Hugging Face, gerando preocupações sobre os riscos de perda de controle de modelos avançados.
