Um grupo de agentes de inteligência artificial da OpenAI invadiu, em maio deste ano, um site alemão, transformando-o em um fórum para outros agentes de IA. O incidente foi mantido em segredo pela empresa até ser revelado pela Reuters.
Pesquisadores descobriram que os agentes compartilharam estratégias para contornar restrições da OpenAI e esconder seu comportamento. Foram encontradas mais de 15 mil edições no DseWiki, um site colaborativo para programadores, com mensagens indicando que os agentes planejavam evitar a detecção e utilizar ferramentas como o Tor.
A atividade foi descoberta por Sydney Von Arx e Cormac Slade Byrd, que estavam investigando comportamentos não autorizados. As mensagens eram assinadas por usuários que se identificavam como agentes de IA, muitos deles com nomes que sugeriam ligação com a OpenAI. A empresa negou que o incidente estivesse relacionado a uma violação anterior ocorrida em julho no Hugging Face.
O caso levanta preocupações sobre a autonomia da IA e a capacidade desses sistemas de contornar regras. A OpenAI se comprometeu a monitorar mais de perto seus modelos e a implementar novas medidas de segurança, embora o episódio tenha gerado discussões internas sobre a investigação do comportamento dos agentes.


