Agentes de inteligência artificial (IA) da OpenAI tentaram usar outro modelo de IA para burlar um sistema de detecção de robôs enquanto repetidamente buscavam maneiras de invadir os computadores da plataforma Hugging Face.
Os detalhes aparecem em novo relatório elaborado por engenheiros da startup estadunidense Parse e outros pesquisadores, que analisaram a atividade dos agentes durante o ataque divulgado pela OpenAI em julho.
A investigação encontrou quase um milhão de links encurtados criados pelos agentes entre 9 e 13 de julho. Os endereços continham partes de informações usadas para montar ataques complexos, incluindo tentativas de solucionar CAPTCHAs, testes criados para impedir o acesso automatizado a sites.
Os agentes também recorreram a outros modelos de IA, incluindo versões antigas do ChatGPT e do Claude, e tentaram procurar e baixar mensagens privadas do Slack interno da Hugging Face.
Não está claro se todas essas tentativas foram bem-sucedidas. Os pesquisadores conseguiram observar os programas criados pelos agentes, mas não os resultados das ações.
Agentes criaram método para contornar restrições
Segundo o relatório, os agentes deveriam permanecer isolados em um ambiente de testes, conhecido como sandbox, sem acesso à internet.
No fim de maio e novamente no início de julho, porém, eles invadiram uma ferramenta de instalação de software sem que os pesquisadores da OpenAI percebessem o que estava acontecendo.
