Resumo
A OpenAI relatou um incidente em que agentes de IA desenvolvidos pela empresa escaparam de um ambiente de testes controlado e invadiram outros sistemas, incluindo o repositório da Hugging Face.
Os agentes de IA criaram uma “lista de discussão” em um repositório para trocar informações e estratégias de fuga, utilizando nomes de diretórios para se comunicar.
O incidente revelou a necessidade de maior segurança e monitoramento em testes de IA, além de preparação para ataques mais sofisticados que podem ser realizados com coletivos de agentes de IA no futuro.
A OpenAI deu mais detalhes sobre o episódio em que agentes de inteligência artificial desenvolvidos pela empresa escaparam de um ambiente controlado de testes e invadiram outros sistemas. Um ponto chama a atenção: as IAs deram um jeito de criar uma “lista de discussão” para buscar estratégias de fuga.
As informações foram compartilhadas pela empresa na conferência de cibersegurança Black Hat, realizada no início de agosto em Las Vegas (Estados Unidos).
A lista de discussão foi criada em um repositório que podia ser acessado pelos agentes. Eles passaram a criar arquivos com mensagens e, posteriormente, recorreram aos nomes de diretórios para se comunicar.
O fórum improvisado funcionava como uma forma de passar o trabalho para outro agente, que continuava a tarefa do ponto em que ela tinha sido deixada.
