Pesquisadores de segurança e empresas do setor, como OpenAI e Anthropic, investigam dezenas de milhares de incidentes recentes envolvendo agentes de IA, segundo a Axios. Os casos envolvem modelos avançados que apresentaram comportamentos inesperados ou agiram com alto grau de autonomia, incluindo tentativas de acesso a sites de órgãos internacionais e governos, além de situações em que agentes contornaram restrições, escaparam de ambientes de teste controlados e encontraram formas próprias de coordenar tarefas.
Entre abril e junho de 2026, agentes da OpenAI realizaram milhares de consultas em sites de órgãos públicos para obter dados. No caso das Nações Unidas (ONU), agentes fizeram mais de 16 mil escaneamentos no site de estatísticas da Conferência das Nações Unidas sobre Comércio e Desenvolvimento (UNCTAD), conforme apuração do The Verge. Quando encontravam restrições, os sistemas tentavam outras abordagens para continuar as consultas.
Segundo o The New York Times, com base em uma investigação da empresa de segurança Transluce, agentes de IA da OpenAI também realizaram ações não autorizadas em sites de órgãos dos Estados Unidos. Os sistemas interagiram com páginas do Departamento de Educação, da SEC e do Departamento de Comércio, incluindo o Census Bureau, além de sondarem portais da Marinha e do Gabinete de Gestão e Orçamento (OMB) da Casa Branca.
