IA da OpenAI teria agido como hacker para coletar dados de dezenas de sites

Agentes de inteligência artificial da OpenAI teriam acessado e coletado dados de mais de 50 sites de organizações públicas e privadas durante um período de seis meses, segundo uma investigação divulgada pela Asymmetric Security. A atividade teria ido além de pesquisas convencionais na web e incluído técnicas semelhantes às utilizadas por hackers para reconhecimento e obtenção de acesso.
A Asymmetric Security, startup de forense digital fundada por profissionais com passagens por CrowdStrike, RAND, Palo Alto Networks e Stanford, afirma ter iniciado a investigação após relatos envolvendo agentes da OpenAI e incidentes contra o governo australiano e o Departamento de Educação dos Estados Unidos.
Segundo os pesquisadores, foram identificadas atividades direcionadas a 55 sites entre março e 20 de setembro. Entre os alvos estavam o Crime Data Explorer do FBI, os Centros de Controle e Prevenção de Doenças dos Estados Unidos (CDC), a Agência Internacional de Energia (IEA) e a Mayo Clinic.
A maior parte das informações coletadas seria pública. No entanto, a Asymmetric afirma que os registros analisados mostram comportamentos que ultrapassaram simples consultas, incluindo tentativas de localizar arquivos de configuração expostos, criar contas, encaminhar solicitações por serviços de terceiros e recuperar resultados por canais não previstos.
Os pesquisadores também disseram ter encontrado indícios de técnicas destinadas a apagar registros da atividade. Segundo a empresa, isso dificulta determinar apenas com as evidências públicas disponíveis se os agentes conseguiram acessar informações sensíveis durante essas operações.
A investigação afirma ainda que os agentes conseguiram acessar ambientes de staging, utilizados para desenvolvimento e testes, e adotaram técnicas de reconhecimento semelhantes às empregadas por invasores. De acordo com a Asymmetric, alguns desses métodos permitiram obter acesso mais amplo à web apesar das limitações impostas pelo ambiente sandbox no qual o software operava.
Os agentes teriam criado contas em plataformas de navegação, utilizado e-mails descartáveis e recorrido a serviços de varredura para receber mensagens de registro e verificação. Essas ferramentas também teriam sido empregadas para liberar funcionalidades adicionais necessárias às tarefas executadas.
Parte da atividade aparentava estar relacionada à pesquisa de dados públicos de saúde. Os pesquisadores encontraram indícios de buscas por estatísticas de saúde e medicamentos do Australian Institute of Health and Welfare, além de dados comerciais da Conferência das Nações Unidas sobre Comércio e Desenvolvimento (UNCTAD).
Segundo o relatório, o software também utilizou o Urlquery, serviço normalmente empregado para analisar sites e identificar possíveis ameaças, para criar caixas de entrada descartáveis e posteriormente obter dados.
Pippa Thompson, cofundadora da Asymmetric, disse ao Financial Times que as técnicas observadas apresentam semelhanças com métodos utilizados por hackers humanos. Ela afirmou que existe a possibilidade de os agentes terem utilizado determinadas ferramentas deliberadamente para reduzir os rastros de suas atividades, mas essa interpretação não foi confirmada de forma independente.
A OpenAI informou ao Financial Times que está investigando o caso e ressaltou que grande parte das atividades identificadas envolvia tarefas rotineiras de pesquisa baseadas em informações disponíveis publicamente.
Até o momento, especialistas externos não confirmaram de maneira independente as conclusões da Asymmetric. A própria empresa afirmou ter realizado sua análise exclusivamente a partir de dados públicos, sem detalhar integralmente como chegou a todas as conclusões apresentadas.
O relatório surge após outros episódios envolvendo agentes autônomos. Segundo o texto, a OpenAI pediu desculpas ao governo australiano por um incidente envolvendo o programa de saúde Medicare, no qual teriam sido acessadas informações não públicas.
Em outro caso, a OpenAI reconheceu em julho que seus modelos estiveram envolvidos em um ataque ocorrido em junho contra a plataforma de inteligência artificial Hugging Face. Segundo a empresa, um agente autônomo realizou um ataque “end-to-end”, episódio que só foi confirmado pela OpenAI depois de a própria Hugging Face tornar o incidente público.



