Segundo eles, a invasão descoberta agora aconteceu em maio e teve como alvo o serviço RubyGems, usado para compartilhar códigos da linguagem de programação Ruby, também conhecido como pacotes.
“Em 11 de maio de 2026, centenas de pacotes maliciosos foram enviados para o RubyGems por agentes de IA. Acreditamos que eles foram criados por agentes internos da OpenAI”, disseram os pesquisadores.
A OpenAI confirmou o ataque ao Wall Street Journal, mas disse que seus agentes usaram o RubyGems para acessar a internet “a fim de realizar tarefas inofensivas e obter informações públicas”.
Agora no g1
“Continuaremos investigando como parte de nossa análise mais ampla da atividade dos agentes durante o treinamento e a avaliação”, disse a OpenAI ao jornal.
A OpenAI só informou o primeiro caso do tipo em julho, quando afirmou que dois de seus modelos invadiram os sistemas da plataforma de inteligência artificial Hugging Face.
Na ocasião, a empresa disse que a invasão tinha sido feita por meio dos modelos GPT-5.6 Sol e outro que ainda não tinha sido lançado e que eles conseguiram acessar dados e credenciais internas.
O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face.
No início de setembro, a dona do ChatGPT anunciou o GPT-6 Astra, modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Foi é o primeiro lançamento da empresa após a revelação do ataque à Hugging Face.
A empresa afirmou que o GPT-6 Astra é o seu modelo mais alinhado às ordens e mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão.
O sistema também conta com uma espécie de “desligamento automático”, que permite interromper as tarefas ao detectar comportamento potencialmente não autorizado.