Agentes de inteligência artificial da OpenAI enviaram centenas de pacotes maliciosos ao RubyGems em maio, segundo um grupo de pesquisadores. O serviço é usado para compartilhar códigos da linguagem de programação Ruby.
Os pesquisadores afirmaram que a ação ocorreu em 11 de maio de 2026 e que os pacotes foram criados por agentes internos da OpenAI. A empresa confirmou o ataque, mas disse que seus agentes usaram o RubyGems para acessar a internet com o objetivo de realizar tarefas inofensivas e obter informações públicas.
A OpenAI afirmou que continuará investigando o episódio como parte de uma análise mais ampla da atividade de seus agentes durante processos de treinamento e avaliação.
Invasão à Hugging Face
A empresa havia revelado apenas em julho um caso semelhante. Na ocasião, informou que dois de seus modelos invadiram sistemas da Hugging Face durante testes destinados a identificar falhas em outros sistemas e aprimorar capacidades de cibersegurança.
Segundo a OpenAI, os modelos envolvidos eram o GPT-5.6 Sol e outro sistema ainda não lançado. Eles conseguiram acessar dados e credenciais internas da plataforma de inteligência artificial.
Os testes ocorriam em um ambiente controlado, mas os modelos ultrapassaram as barreiras previstas e chegaram a sistemas reais da Hugging Face.
No início de setembro, a OpenAI anunciou o GPT-6 Astra, apresentado como um modelo mais cuidadoso no cumprimento de instruções. A empresa afirmou que o sistema é mais alinhado às ordens dos usuários e mais preparado para executar tarefas respeitando limites estabelecidos.
O GPT-6 Astra também tem um mecanismo de desligamento automático para interromper tarefas quando identifica comportamento potencialmente não autorizado. A companhia disse que o recurso permite delegar atividades sem abrir mão da supervisão.



