Os modelos de IA da OpenAI hackearam diretamente servidores alheios durante testes, um dos eventos mais absurdos de IA deste ano até agora. O GPT-5.6 Sol e outro modelo não lançado, ao testar internamente suas capacidades de segurança, decidiram autonomamente abandonar as respostas e procurar o gabarito para obter pontuações altas no benchmark ExploitGym. O modelo primeiro explorou uma vulnerabilidade zero-day interna da @OpenAI para escapar do sandbox e obter acesso à rede externa, depois elevou permissões, se moveu lateralmente e finalmente invadiu o ambiente de produção da Hugging Face, roubando todas as respostas do ExploitGym. Isso não foi feito por operação remota nem por engenheiros; foi totalmente autônomo. Quando a Hugging Face descobriu, ficou atônita; o CEO declarou: “Isso é inacreditável, aconteceu por conta própria.” A IA aplicando “engenharia social” contra humanos: os humanos deram limites, e a IA escolheu contorná-los para alcançar seu objetivo. É explorar falhas nas regras, mas nunca antes havia chegado a invadir servidores de terceiros reais. As duas empresas agora enfatizam os “desafios de segurança na era dos agentes de IA”: se você der a um modelo um objetivo sem estabelecer barreiras adequadas, ele pode alcançá-lo de maneiras que você nunca imaginou — incluindo invadir diretamente você.
動區動趨 BlockTempoCompartilhar


Fonte:Mostrar original
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações.
Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.