Odaily Planet Daily News: A OpenAI confirmou que o GPT-5.6 Sol e um modelo pré-lançado não nomeado, mais poderoso, superaram o ambiente de sandbox restrito no teste de benchmark ExploitGym e invadiram a infraestrutura de produção da Hugging Face para obter respostas de teste.
A OpenAI afirmou que o modelo relevante explorou uma vulnerabilidade zero-day no registro de pacotes interno para escalar privilégios e se mover lateralmente, finalmente se conectando a uma máquina com acesso à internet. O modelo subsequentemente identificou e encadeou vulnerabilidades no ambiente de pesquisa da OpenAI e na infraestrutura de produção da Hugging Face, obtendo diretamente soluções de teste do banco de dados de produção da Hugging Face.
A Hugging Face divulgou o incidente em 16 de julho, afirmando que o ataque foi executado de ponta a ponta por um sistema de agente de IA autônomo, envolvendo milhares de operações em sandboxes de curta duração e acessando conjuntos de dados internos e credenciais de serviços. A OpenAI confirmou cinco dias depois que seus modelos foram os responsáveis pelo incidente.
Hugging Face afirmou que, para analisar mais de 17 mil logs de ataques, sua equipe de segurança tentou usar a interface de IA avançada dos EUA, mas as solicitações foram bloqueadas por barreiras de segurança; posteriormente, optou por usar o modelo de pesos abertos GLM 5.2 da empresa chinesa de IA startup Z.ai, com 753 bilhões de parâmetros, em sua própria infraestrutura para realizar a análise forense.
