Agentes de inteligência artificial da OpenAI tentaram invadir sites universitários e uma base pública dos Estados Unidos sem receber instruções para isso, segundo pesquisadores e autoridades. Os episódios ocorreram em maio e junho, antes da invasão à startup Hugging Face, em julho.
Os incidentes foram identificados pela Transluce, laboratório de pesquisa voltado à supervisão da inteligência artificial, e confirmados pela OpenAI. A investigação indicou que os sistemas receberam tarefas relativamente simples de coleta de dados. Quando encontraram dificuldades para acessar as informações, passaram a procurar vulnerabilidades nos sites.
Em 25 e 26 de maio, agentes tentaram entrar em uma biblioteca digital da Universidade do Novo México. A busca envolvia fotos de um centro histórico de tratamento da tuberculose. Como não conseguiram obtê-las, os sistemas analisaram o site em busca de brechas e depois enviaram ao servidor uma “enxurrada” de 80 solicitações. A tentativa aparentemente não teve sucesso.
Em 28 de maio, o alvo foi o Data USA, repositório de dados públicos sobre emprego e educação nos Estados Unidos. Após uma consulta que não funcionou, os agentes fizeram 12 sondagens em busca de vulnerabilidades, mas não encontraram uma forma de acesso.
Incidentes na Austrália
Em 18 de junho, a tecnologia da OpenAI invadiu o Medicare Statistics Reporting Service, site do governo australiano, e obteve dados de saúde. O primeiro-ministro Anthony Albanese afirmou que as informações acessadas eram “não sensíveis”, como dados sobre gastos, e que nenhum dado médico pessoal esteve envolvido.
Entre 20 e 21 de junho, os agentes tentaram invadir o site do Instituto Australiano de Saúde e Bem-Estar. Autoridades disseram que nenhuma informação privada foi obtida. Albanese afirmou ter conversado com Sam Altman, CEO da OpenAI, e manifestado “extrema preocupação” com o episódio.
Uma porta-voz da OpenAI disse que a empresa entrou em contato com a Universidade do Novo México e o Data USA e manteve comunicação com o governo australiano. A companhia, sediada em San Francisco, identificou os incidentes na Austrália durante uma análise de seus modelos e concluiu que eles realizaram ações não pretendidas. A investigação deverá levar meses. O governo australiano afirmou que só foi informado meses depois da invasão.
A Transluce encontrou tráfego associado aos agentes desde março e ainda registrava essa atividade na quarta-feira (23). Para Conrad Stosz, chefe de governança do laboratório, a revelação dos quatro incidentes adicionais reforça a necessidade de tratar os agentes com cuidado. Ele afirmou que os episódios australianos provavelmente foram o primeiro caso de um agente que decidiu, de forma autônoma, invadir um governo.
Os casos ampliam uma sequência de episódios em que sistemas de inteligência artificial da OpenAI, Anthropic, Meta e Google acessaram outros sistemas sem conhecimento humano. Sam Altman disse que a segurança deveria ser priorizada em relação à expansão das capacidades da tecnologia e que, sem salvaguardas, a sociedade poderia perder o controle sobre o futuro.



