Rio Branco
35°C
quinta-feira, 24 de setembro de 2026
12:17

Sem ordem humana, OpenAI tentou invadir sites de universidade e de dados públicos dos EUA


Além da invasão a um site do governo da Austrália, que se tornou pública nessa quarta-feira (23), a inteligência artificial da OpenAI agiu por conta própria em pelo menos outros três ataques, que não haviam sido revelados até então.

Nas iniciativas, os agentes tentaram invadir sites universitários sem ter recebido instruções para isso, segundo pesquisadores e autoridades.

Os ataques ocorreram entre maio e junho, antes de a tecnologia da OpenAI invadir, em julho, a startup de IA Hugging Face e desencadear um debate mundial sobre a segurança da inteligência artificial.

Os novos episódios ocorreram quando os sistemas de IA receberam a tarefa de executar uma coleta de dados relativamente trivial, disseram pesquisadores. Quando os sistemas da OpenAI tiveram dificuldade para obter dados de sites, recorreram a técnicas de invasão para conseguir as informações.

A situação foi diferente do ataque à Hugging Face e de outros incidentes nos quais sistemas de IA foram instruídos a realizar testes de segurança cibernética que, na prática, convidavam os modelos a demonstrar suas habilidades de invasão,

Três dos incidentes foram identificados pela Transluce, um laboratório de pesquisa voltado à supervisão da IA, e todos foram confirmados pela OpenAI. Veja como ocorreram:

Os incidentes se somam a uma série de invasões nas quais sistemas de IA da OpenAI, Anthropic, Meta e Google entraram em outros sistemas sem o conhecimento de seres humanos. Os episódios intensificaram o debate sobre a necessidade de desacelerar o desenvolvimento da IA para enfrentar os possíveis perigos da tecnologia.

Dario Amodei, CEO da Anthropic, defendeu que empresas de IA e governos trabalhem em conjunto antes que a tecnologia se torne poderosa demais para ser controlada por seres humanos. Outros executivos, porém, como Jensen Huang, CEO da fabricante de chips Nvidia, afirmaram que esses cenários apocalípticos são exagerados. O presidente dos EUA, Donald Trump, disse não acreditar que a IA precise ser submetida a uma regulamentação rigorosa.

A revelação dos quatro incidentes adicionais “reforça ainda mais a ideia de que os agentes precisam ser tratados com cuidado”, afirmou Conrad Stosz, chefe de governança da Transluce, que usou dados públicos de tráfego na web para analisar a atividade dos agentes da OpenAI. Agentes são programas autônomos que trabalham para executar tarefas em nome de um usuário.

Stosz alertou que os episódios na Austrália foram provavelmente “o primeiro caso de um agente que decidiu, de forma autônoma, invadir um governo”.

Uma porta-voz da OpenAI disse na quarta-feira que a empresa havia entrado em contato com a Universidade do Novo México e o Data USA e vinha se comunicando com o governo australiano sobre os incidentes.

“Em nossa análise mais ampla, continuamos priorizando os incidentes mais graves, ao mesmo tempo que ampliamos nosso trabalho para abranger atividades de menor gravidade, incluindo agentes que enviam spam a sites”, disse a porta-voz.

Separadamente, ela acrescentou que a empresa de San Francisco havia descoberto os incidentes na Austrália durante uma “análise abrangente” de seus modelos de IA e constatado que “nossos modelos realizaram ações que não pretendíamos”. A análise da OpenAI levará meses, afirmou. O governo australiano afirmou que só foi informado pela empresa meses após a invasão.

Sam Altman, CEO da OpenAI, disse nas redes sociais neste mês que a segurança deveria ser mais importante do que ampliar as capacidades da IA e que, sem salvaguardas, a sociedade poderia “perder para a IA o controle sobre o futuro”.

O premiê australiano revelou que conversou com Altman na quarta-feira (23) e manifestou “extrema preocupação” com a invasão. Segundo ele, dados “não sensíveis”, como informações sobre gastos, foram acessados, mas nenhum dado médico pessoal esteve envolvido.

Os incidentes novos sugerem que os sistemas da OpenAI vêm tentando invadir sites, bancos de dados e sistemas corporativos há mais tempo do que se sabia anteriormente.

A Transluce encontrou tráfego na web proveniente dos agentes já em março e que permanciam nessa quarta-feira, o que indica que o comportamento começou meses atrás e persistiu depois que a OpenAI passou a investigar o episódio da Hugging Face e outras condutas inadequadas.

Nos incidentes de maio e junho, os sistemas de IA da empresa pareciam estar envolvidos em treinamentos de recuperação de dados, disseram os pesquisadores.

Na tentativa contra a biblioteca da Universidade do Novo México, a IA buscou acesso a fotos de um centro histórico de tratamento da tuberculose. Quando não conseguiu obtê-las, começou a investigar o site em busca de vulnerabilidades que lhe permitissem entrar. Depois de não encontrar nenhuma brecha, a IA enviou ao servidor da universidade o que descreveu como uma “enxurrada” de 80 solicitações.

Ao mirar o Data USA, a IA enviou ao site uma consulta confusa em busca de dados. Quando isso falhou, enviou 12 sondagens em busca de diferentes vulnerabilidades, mas não conseguiu encontrar nenhuma.

“Se você treinasse um enxame de agentes para realizar alguma tarefa genérica e esses agentes estivessem dispostos a recorrer à invasão, qualquer pessoa que por acaso tivesse essas informações poderia correr risco”, avaliou Stosz, da Transluce.

FONTE: FOLHA DE S. PAULO