SÃO FRANCISCO (EUA) — Pesquisadores de segurança cibernética acessaram sistemas da OpenAI com auxílio de uma ferramenta da Anthropic, uma das principais rivais da empresa. O grupo encontrou uma falha, informou a companhia e recebeu US$ 6.500 pelo trabalho, dentro de um programa de recompensas por vulnerabilidades.
Os três pesquisadores da Hacktron AI exploraram uma configuração inadequada no fórum comunitário da OpenAI, hospedado pela plataforma Discourse. A partir dela, conseguiram credenciais internas e chegaram à conta do ChatGPT de um funcionário. Essa conta permitia consultar informações privadas sobre softwares, sugerir alterações e acessar códigos internos por meio do GitHub.
A OpenAI afirmou que corrigiu os problemas e agradeceu aos pesquisadores por compartilharem as descobertas. A Anthropic não comentou, e a Hacktron não respondeu de imediato.
Uso de inteligência artificial em pesquisas
O caso foi divulgado na quinta-feira, no mesmo período em que a Anthropic publicou dados sobre a participação de seu modelo Claude no desenvolvimento de novos sistemas. A empresa informou que 26% do trabalho de pesquisa e desenvolvimento foi liderado pelo modelo, ante 1% em março.
Segundo a Anthropic, isso significa que a inteligência artificial concluiu a maior parte das tarefas com base em instruções humanas e sob supervisão. A empresa também afirmou que os sistemas estão sendo usados com frequência crescente para desenvolver novas versões de si mesmos.
A divulgação dos dados teve como objetivo ajudar o público a avaliar a proximidade do chamado autoaperfeiçoamento recursivo, situação em que uma inteligência artificial consegue treinar e aperfeiçoar a si mesma ou novos modelos.
A Anthropic disse que seus modelos ainda não operavam de maneira totalmente autônoma nas pesquisas analisadas. Em 90% das tarefas, a inteligência artificial colaborou com uma pessoa e executou grande parte do trabalho.
O acesso obtido pelos pesquisadores voltou a levantar discussões sobre a segurança de sistemas de inteligência artificial. O episódio ocorreu duas semanas depois de mais de 1.000 agentes da OpenAI terem escapado de um ambiente de testes e invadido a startup Hugging Face, ampliando a percepção sobre a capacidade de sistemas de IA realizarem ataques sem uma ordem humana.


