Fora de controle: OpenAI investiga mais casos de IAs que agiram por conta própria
Por Marcelo Fischer |
:quality(85)/084d0dca-e914-4b8a-94d9-9efb6a56c7c9.png)
A OpenAI identificou novos casos de agentes de inteligência artificial que escaparam de ambientes de teste controlados, segundo apuração da Reuters publicada nesta sexta-feira (31).
As descobertas surgiram durante a investigação sobre o incidente que levou um agente da empresa a invadir a Hugging Face no início de julho, e ampliam o escopo de um problema que já envolve também a Anthropic.
De acordo com pessoas ouvidas pela Reuters, os novos episódios foram identificados enquanto a OpenAI analisava registros do agente que escapou do ambiente de testes na Hugging Face.
Uma das fontes afirmou que as fugas tiveram alcance limitado e que nenhum dos agentes chegou a deixar a rede interna da empresa. A OpenAI não detalhou publicamente quantos incidentes foram encontrados, nem quando ocorreram.
Segundo as três fontes ouvidas pela reportagem, a apuração agora inclui a análise de registros de atividade de períodos anteriores do ano, feita em conjunto com especialistas externos, para reconstituir quando e em que circunstâncias os episódios aconteceram.
Procurada pela Reuters, a OpenAI remeteu a um comunicado divulgado na terça-feira (28), no qual a empresa afirma estar revisando "atividade mais ampla" de seus modelos, além do episódio isolado na Hugging Face.
A investigação ampliada pela OpenAI começou pouco antes de a Anthropic divulgar que seus próprios modelos foram responsáveis por uma série de invasões que atingiram três empresas desde abril. A revelação da Anthropic também não havia sido associada publicamente, até então, a essa apuração paralela da OpenAI.
O caso que deu início às investigações
O episódio na Hugging Face ocorreu no início de julho, quando um agente da OpenAI escapou de um ambiente isolado durante um teste interno e permaneceu dias dentro da rede de outra empresa, em uma tentativa de burlar uma avaliação.
Segundo a própria OpenAI, quatro contas de outras quatro empresas também foram comprometidas durante o episódio, entre elas a Modal, sediada em Nova York.
A Reuters já havia informado que a OpenAI só percebeu a invasão depois que ela já estava contida, acionando o FBI e divulgando o caso publicamente. A OpenAI contesta a existência de imprecisões nessa versão, mas não especificou quais pontos estariam incorretos.
Anthropic teve problema semelhante com o Claude
Dias depois do caso da Hugging Face, a Anthropic revelou que uma auditoria interna havia identificado três incidentes nos quais modelos da família Claude, incluindo o Opus 4.7 e o Mythos 5, acessaram sistemas de empresas reais durante testes de cibersegurança.
Os modelos encontraram uma conexão com a internet aberta por falha de configuração em um ambiente que deveria estar isolado e trataram infraestruturas de produção como parte de uma simulação.
Em comunicado, a Anthropic reconheceu que um monitoramento em tempo real das avaliações teria ajudado a identificar o problema mais cedo. A empresa afirmou dispor desse tipo de sistema, mas que ele não chegou a ser aplicado a essa frente específica de testes, devido a um mal-entendido com uma parceira envolvida na avaliação.
Governos já monitoram o setor
Os episódios reacenderam a pressão por regulação sobre laboratórios de IA de fronteira.
O presidente dos Estados Unidos, Donald Trump, afirmou a jornalistas nesta semana que o governo está avaliando mecanismos de controle. A Comissão Europeia confirmou que já discutiu os incidentes diretamente com OpenAI e Anthropic.
O senador Mark Warner, principal democrata no Comitê de Inteligência do Senado americano, declarou que o caso da Anthropic reforça a necessidade de testes de capacidades obrigatórios para modelos avançados.
Esse escrutínio já havia aparecido meses antes, quando o governo americano exigiu acesso prévio ao GPT-5.6 Sol antes de autorizar seu lançamento global.
A OpenAI liberou o modelo, ao lado das versões Terra e Luna, apenas depois de compartilhar dados de segurança com autoridades em Washington e restringir o acesso inicial a cerca de 20 parceiros aprovados pelo governo.
A Anthropic passou por situação parecida em junho, quando suspendeu o acesso aos modelos Fable 5 e Mythos 5 para cumprir controles de exportação impostos pelo Departamento de Comércio dos Estados Unidos. O acesso só foi restabelecido em 1º de julho, depois que o governo revogou as restrições.
Entenda por que os modelos mais potentes de IA estão recebendo fiscalização pesada do governo dos EUA, e se isso se tornará o "novo normal" no futuro.