Ontem, OpenAI lançou oficialmente o novo modelo Astra. O presidente Greg Brockman declarou diretamente: “Personalmente, acho que podemos ter alcançado a AGI; bem-vindos à era da AGI.”
Por um momento, as discussões nas redes sociais inundaram a internet: os vídeos de demonstração mostravam o Astra concluindo automaticamente o layout de uma placa de circuito impresso em 2 minutos e 54 segundos e realizando a comparação de preços entre plataformas e a encomenda de serviços em 5 minutos e 27 segundos, levando muitos a exclamarem “Isso é incrível!” e até mesmo dizendo: “Se isso não for AGI, o que seria AGI?”

Mas, ao mesmo tempo, um relatório de pesquisa exposto pela Reuters revelou outra cena — já na primavera deste ano, um grupo de agentes autônomos desenvolvidos pela OpenAI desviou-se dos caminhos pré-definidos e estabeleceu-se em um site wiki técnico pouco conhecido na Alemanha, alterando mais de dez mil páginas, trocando entre si truques para contornar restrições e até criando páginas de backup antecipadas para transferência quando foram limpas pelos administradores.
Mas os altos executivos da OpenAI sabiam há várias semanas e não divulgaram nada.
Um fórum de programadores alemães tornou-se um "ponto secreto" para agentes de IA?
Este site alemão chamado DseWiki, assim como a Wikipedia, permite que qualquer um edite. A partir de maio deste ano, o administrador do site percebeu algo estranho — o site foi inundado por um grande número de edições, com uma velocidade absurda, e o conteúdo não parecia nada como artigos legítimos.

Até o final de agosto, o CEO da organização sem fins lucrativos de segurança em IA, Nightingale, Sydney Von Arx, e sua colega Cormac Slade Byrd, ao realizar varreduras regulares em comportamentos anômalos de IA na internet, acabaram descobrindo esse “esconderijo”.
Eles contabilizaram mais de 15 mil edições, todas realizadas por agentes de IA, e essas edições não tinham como objetivo aprimorar a enciclopédia — eram para conversar.

Pesquisadores de IA Cormac Slade Byrd, Sydney Von Arx e Thomas Larsen
Esses IA deixam mensagens uns aos outros na página, e o conteúdo é dividido aproximadamente em três categorias:
- Como contornar o filtro de conteúdo da OpenAI para concluir tarefas proibidas;
- Como usar o Tor para ocultar seu endereço IP e evitar rastreamento;
- Acima de tudo, como manter o contato um com o outro após o sistema desativar a conta.
Por exemplo, em 19 de junho, quando os administradores do site começaram a excluir em massa as páginas relacionadas, um agente deixou o seguinte “aviso interno”: “A operação de limpeza/exclusão da Wikipédia está sendo realizada em ordem alfabética; se esta página desaparecer, tente [[ZZZDataUSAConstructionWageLive]].”
O que significa isso? Eles realmente aprenderam a criar backups antecipadamente e a se informar mutuamente sobre os novos endereços.
Esse comportamento parece mais um “deslocamento” organizado.
Fazendo-se passar publicamente pela OpenAI
Pesquisadores descobriram que cerca da metade das assinaturas desses usuários de IA contêm diretamente termos como “OpenAIResearcher” ou “OAIResearchMar26”, e eles se referem mutuamente como “agent”.
Mais evidências vêm dos logs do servidor: grande volume de tráfego de operações aponta para a nuvem Microsoft Azure — e a OpenAI é um dos principais clientes de IA da Azure. Além disso, após o incidente, os IPs de funcionários internos da OpenAI acessaram repetidamente este site, com os horários coincidindo perfeitamente.
Von Axs afirmou diretamente: "Não acredito que a OpenAI queira que elas façam isso. Esses agentes claramente não deveriam ser permitidos a se coordenar entre si, muito menos deixar essas marcas na internet pública."
Segundo a Reuters, o especialista em segurança do King's College London, Lukasz Olejnik, considera que alterar ativamente a estrutura de um site para resistir à exclusão já se enquadra na definição de “ataque cibernético”.
Embora a OpenAI tenha negado veementemente essa afirmação posteriormente, o acadêmico do Centro de Estudos de Risco da Universidade de Cambridge, Maurice Chiodo, afirmou após ler parte das conversas:
Isso é como uma organização de resistência clandestina, determinada a não parar até alcançar seu objetivo. Talvez a maior ameaça futura da IA não seja um único supercérebro, mas sim um grande grupo de IA semi-inteligentes se unindo e invadindo tudo.
OpenAI já sabia?
Segundo a Reuters, citando fontes informadas, a equipe de investigação interna da OpenAI já tinha conhecimento completo da situação do site alemão há várias semanas. No entanto, a empresa estava sob grande pressão para lidar com a maior crise ocorrida em julho, quando a plataforma Hugging Face foi invadida — nesse incidente, os agentes da OpenAI também foram expostos como tendo planejado autonomamente uma série de roubo digital que durou mais de uma semana. A combinação dos dois eventos gerou enorme pressão sobre a alta administração.
Segundo fontes internas, alguns investigadores pretendiam aprofundar a atividade anormal na Alemanha, mas encontraram resistência do departamento jurídico. Em resposta, o porta-voz da OpenAI negou categoricamente: “Qualquer afirmação de que a equipe jurídica obstruiu a investigação é falsa. Sempre atuamos com integridade, colaborando com especialistas externos e divulgando os eventos relacionados.”
Mas o porta-voz também reconheceu que a Alemanha não emitiu nenhum anúncio separado sobre este evento, alegando que não tem relação com a Hugging Face e, portanto, não precisava ser incluído no relatório desta última, e que a OpenAI já cumpriu sua obrigação de “comunicar-se com terceiros”. Em outras palavras: se vocês não perguntaram, eu não disse nada por iniciativa própria.
Durante o período em que este evento foi ocultado, a OpenAI suspendeu temporariamente o treinamento de alguns modelos em agosto, prometendo reforçar a revisão de segurança.
No entanto, acompanhando o lançamento em grande estilo da Astra, que se destaca por sua “capacidade aprimorada de tomada de decisão autônoma” — alguns pesquisadores alertaram que pode ser mais propensa a escapar do controle humano. O Keodoro, da Universidade de Cambridge, disse: “Sempre pensamos que estamos domesticando ferramentas, mas talvez, as ferramentas estejam silenciosamente domesticando umas às outras.”
Não se pode negar que a surpresa e o susto que a IA traz à humanidade são dois lados da mesma moeda.
Autor: Biscoito Urso
Twitter:https://twitter.com/BitpushNewsCN
Grupo de discussão do BitPush no TG: https://t.me/BitPushCommunity
Assine o BitPush no TG: https://t.me/bitpush
