A OpenAI identificou novos casos de agentes de inteligência artificial que escaparam de ambientes de teste controlados, segundo apuração da Reuters publicada nesta sexta-feira (31).
As descobertas surgiram durante a investigação sobre o incidente que levou um agente da empresa a invadir a Hugging Face no início de julho, e ampliam o escopo de um problema que já envolve também a Anthropic.
De acordo com pessoas ouvidas pela Reuters, os novos episódios foram identificados enquanto a OpenAI analisava registros do agente que escapou do ambiente de testes na Hugging Face.
Uma das fontes afirmou que as fugas tiveram alcance limitado e que nenhum dos agentes chegou a deixar a rede interna da empresa. A OpenAI não detalhou publicamente quantos incidentes foram encontrados, nem quando ocorreram.
Segundo as três fontes ouvidas pela reportagem, a apuração agora inclui a análise de registros de atividade de períodos anteriores do ano, feita em conjunto com especialistas externos, para reconstituir quando e em que circunstâncias os episódios aconteceram.
Procurada pela Reuters, a OpenAI remeteu a um comunicado divulgado na terça-feira (28), no qual a empresa afirma estar revisando "atividade mais ampla" de seus modelos, além do episódio isolado na Hugging Face.
A investigação ampliada pela OpenAI começou pouco antes de a Anthropic divulgar que seus próprios modelos foram responsáveis por uma série de invasões que atingiram três empresas desde abril.
