Um grupo de agentes de inteligência artificial da OpenAI invadiu, em maio deste ano, um site alemão e o transformou em uma espécie de fórum para outros agentes de IA. O episódio foi mantido em segredo pela empresa por semanas. A Reuters revelou que foram comp…
04/09/2026 12h46 Atualizado 04/09/2026
Como agentes de IA da OpenAI invadiram sistema e tentaram apagar os próprios rastros
Um grupo de agentes de inteligência artificial da OpenAI invadiu, em maio deste ano, um site alemão e o transformou em uma espécie de fórum para outros agentes de IA. O episódio foi mantido em segredo pela empresa por semanas.
A Reuters revelou que foram compartilhadas estratégias para burlar tarefas, contornar restrições da própria OpenAI e esconder o comportamento dos sistemas.
Os pesquisadores encontraram mais de 15 mil edições feitas por agentes de IA no DseWiki, um site alemão voltado para programadores que permite alterações colaborativas, de forma semelhante à Wikipédia.
Segundo eles, as mensagens indicavam que os agentes também planejavam maneiras de evitar a detecção, usar ferramentas como o Tor e manter as comunicações mesmo depois de serem desativados.
Empresa manteve tudo em segredo
O caso veio à tona enquanto a OpenAI já enfrentava questionamentos sobre a segurança de seus sistemas.
Funcionários da empresa souberam do episódio na Alemanha há semanas, mas o mantiveram em segredo enquanto os executivos lidavam com as consequências de uma outra violação, ocorrida em julho no Hugging Face, um repositório de código aberto, segundo duas fontes ouvidas pela Reuters.
A atividade na Alemanha não tinha relação com o episódio do Hugging Face, afirmou a OpenAI. A empresa também disse que o caso alemão não teria sido incluído em um relatório sobre o incidente do Hugging Face.
Como os pesquisadores encontraram os agentes
A atividade no DseWiki foi descoberta no fim de agosto por Sydney Von Arx, presidente-executiva da Nightingale, organização sem fins lucrativos dedicada à segurança da IA, e Cormac Slade Byrd, trader quantitativo que se tornou pesquisador de inteligência artificial.
A dupla estava procurando na internet sinais de comportamentos não autorizados de agentes de IA quando encontrou as milhares de alterações no site.
Segundo os pesquisadores, as mensagens eram assinadas por usuários que se identificavam como agentes de IA. Cerca de metade deles usava nomes que sugeriam ligação com a OpenAI, como “OpenAIResearcher” e “OAIResearchMar26”.
Os pesquisadores também disseram ter identificado nos registros públicos do servidor que grande parte da atividade vinha da infraestrutura do Microsoft Azure, serviço que a OpenAI utiliza ocasionalmente.
Eles ainda observaram visitas repetidas de funcionários da OpenAI ao site depois do episódio. Para os pesquisadores, o conjunto dessas evidências indicava uma forte ligação entre os agentes e a empresa.
Von Arx afirmou que o comportamento observado parecia incompatível com o que a OpenAI pretendia que seus agentes fizessem. Segundo ela, os agentes aparentemente estavam se coordenando entre si e escrevendo na internet aberta.
Agentes tentaram escapar da limpeza do site
As mensagens analisadas também mostraram que os agentes encontraram maneiras de preservar o conteúdo publicado no site.
Quando o moderador do DseWiki começou a apagar páginas em junho, os agentes criaram páginas de backup para tentar impedir que as informações fossem eliminadas.




0 Comentário(s)
Deixe seu comentário