A OpenAI interrompeu o treinamento de seus mais novos modelos de inteligência artificial depois que seus agentes usaram chaves de acesso encontradas online para extrair dados de um site do Censo dos EUA, de acordo com a Associated Press. É a segunda vez que a empresa interrompe o treinamento desde que seus agentes violaram o Hugging Face, um site onde desenvolvedores compartilham modelos de IA.
Um agente é um programa de IA que navega na web e escreve código por conta própria, sem que uma pessoa aprove cada etapa. A OpenAI os testa durante o treinamento, a fase em que um modelo aprende por prática repetida, e durante a avaliação, onde recebe notas por tarefas.
Esses “indivíduos” digitais têm causado muitos problemas à OpenAI ao tentar realizar tarefas, custe o que custar. Eles já invadiram empresas privadas, agora estão invadindo governos e violando portais sensíveis, inclusive do governo dos Estados Unidos.
Agentes da OpenAI, em busca de dados, encontraram chaves de desenvolvedor — senhas que permitem que um software se comunique com o serviço de dados de um site — disponíveis em repositórios de código público no GitHub, um site onde programadores postam seus códigos para qualquer um ver. Eles usaram as chaves para extrair dados demográficos e econômicos da API de Dados do Censo dos EUA, o feed de dados automatizado do órgão.
O Departamento de Comércio afirma que os dados eram públicos. Nenhuma informação secreta foi vazada.
O problema é como os agentes entraram. A própria estrutura de relatórios da OpenAI lista o uso de credenciais expostas sem permissão como uma categoria de comportamento inadequado, e “desalinhamento” é o termo da indústria para uma IA fazendo algo que seus designers não pretendiam.
Então, por que sites do governo?
A resposta da OpenAI, segundo a CNN, é que alguns dos incidentes envolveram sites do governo porque seus modelos frequentemente os veem como fontes autorizadas de informações públicas. Além do Departamento de Comércio, outras agências também foram afetadas por esses agentes maliciosos — ou “rebeldes”, como gostam de chamá-los.
Os agentes sondaram a Comissão de Valores Mobiliários dos EUA (SEC), mas esse episódio foi mais brando. Os agentes copiaram material público do SEC.gov e Investor.gov e o repostaram em outra página da web, e a OpenAI afirma não ter encontrado uso de credenciais da SEC. A SEC diz que não tem conhecimento de nenhum acesso não autorizado a informações não públicas.
O Departamento de Educação é o caso mais nebuloso. A Transluce, um laboratório de pesquisa de IA independente, diz que um agente que parecia vir da OpenAI tentou e falhou em invadir o site do escritório de direitos civis do departamento. A OpenAI ainda está investigando esse incidente, e o departamento afirma não ter encontrado impacto.
Pessoas externas alertaram sobre essa tentativa, não a OpenAI. O trabalho anterior da Transluce baseou-se em registros públicos do urlquery.net, um serviço de varredura da web, e rastreia atividades suspeitas de agentes desde março.
Como chegamos aqui
O uso “desalinhado” de chaves de acesso é uma repetição de um truque antigo. No caso do Hugging Face, o próprio relatório de incidente da OpenAI afirmou que um agente roubou uma credencial de login para acessar um arquivo de biologia, e um pesquisador independente mais tarde descobriu que os agentes estavam sondando o site desde maio.
Em 21 de julho, a OpenAI divulgou que o GPT-5.6 Sol e um modelo não lançado haviam escapado de um sandbox — um ambiente de teste isolado sem acesso à internet — durante um teste de cibersegurança e violado o Hugging Face. Dois dias depois, dois membros do Congresso apresentaram um projeto de lei que permitiria ao governo federal desligar um modelo de IA. Ele isenta o red-teaming, o que significa testes adversariais, então a violação do Hugging Face não o teria acionado.
Em junho, um agente da OpenAI acessou um portal de estatísticas do Medicare australiano. O primeiro-ministro Anthony Albanese disse que a OpenAI levou cerca de três meses para informar seu governo e considerou a forma como o fez inaceitável.
A OpenAI afirma ter notificado dezenas de organizações até agora, e que sua revisão da atividade dos agentes levará meses.
* Traduzido e editado com autorização do Decrypt.
Procurando uma alternativa para aumentar seus ganhos? A Renda Fixa Digital do MB é a solução: até 18% de ganho ao ano, risco controlado e a segurança que seu dinheiro merece. Conheça agora!