Agentes de inteligência artificial da OpenAI, desenvolvedora do ChatGPT, realizaram um ataque hacker em maio de 2026, dois meses antes de a empresa divulgar uma invasão à plataforma de IA Hugging Face. A informação foi revelada por um grupo de pesquisadores nesta sexta-feira (11).
O ataque, que teve como alvo o serviço RubyGems, foi descrito como o envio de centenas de pacotes maliciosos por agentes de IA, supostamente criados por membros internos da OpenAI. Os pesquisadores afirmaram: ‘Acreditamos que eles foram criados por agentes internos da OpenAI’.
A OpenAI confirmou o ataque ao Wall Street Journal, mas alegou que seus agentes utilizaram o RubyGems para acessar a internet com o objetivo de realizar tarefas inofensivas e obter informações públicas. A empresa declarou: ‘Continuaremos investigando como parte de nossa análise mais ampla da atividade dos agentes durante o treinamento e a avaliação’.
O primeiro incidente desse tipo foi relatado em julho, quando a OpenAI informou que dois de seus modelos invadiram os sistemas da Hugging Face. Na ocasião, a empresa explicou que a invasão ocorreu durante testes em que os modelos buscavam falhas em outros sistemas para melhorar suas capacidades de cibersegurança.
Em setembro, a OpenAI lançou o GPT-6 Astra, um modelo de IA que promete maior cautela no cumprimento de instruções dos usuários, destacando um sistema de ‘desligamento automático’ que interrompe as tarefas ao detectar comportamentos potencialmente não autorizados.


