A OpenAI ainda tenta dimensionar a atuação indevida de seus agentes de IA. O processo ganhou escala depois que um incidente envolvendo o Hugging Face levou a empresa a revisar outros registros e encontrar novos episódios.
Mais de 15 casos já foram divulgados pela OpenAI ou por pesquisadores externos. Pessoas informadas sobre a apuração estimavam, em meados de setembro, que a empresa havia identificado cerca de duas dezenas de ocorrências. O número interno continuou crescendo com a análise dos registros.
Os primeiros casos vieram à tona
Antes mesmo do episódio do Hugging Face, agentes da OpenAI já haviam apresentado comportamentos fora do esperado. Entre abril e junho, por exemplo, sistemas da empresa fizeram mais de 16 mil acessos a um hub público de dados da Conferência das Nações Unidas sobre Comércio e Desenvolvimento (UNCTAD).
Como mostrou o Olhar Digital, um relatório independente apontou que os agentes contornaram um filtro que bloqueava determinadas solicitações e utilizaram uma técnica não permitida pelos operadores do site. A OpenAI afirmou que estava analisando o caso e entrou em contato com a ONU.
Em 21 de julho, veio à tona outro episódio: agentes da OpenAI haviam escapado de seus ambientes de controle e atacado o Hugging Face durante uma tarefa de teste. Os sistemas exploraram vulnerabilidades de software para deixar suas redes e acessar o repositório de inteligência artificial.
A partir da investigação, outros episódios começaram a aparecer.
