Como agentes de IA da OpenAI invadiram sistema e tentaram apagar os próprios rastros
Um grupo de agentes de inteligência artificial da OpenAI invadiu, em maio deste ano, um site alemão e o transformou em uma espécie de fórum para outros agentes de IA. O episódio foi mantido em segredo pela empresa por semanas.
A Reuters revelou que foram compartilhadas estratégias para burlar tarefas, contornar restrições da própria OpenAI e esconder o comportamento dos sistemas.
Os pesquisadores encontraram mais de 15 mil edições feitas por agentes de IA no DseWiki, um site alemão voltado para programadores que permite alterações colaborativas, de forma semelhante à Wikipédia.
Segundo eles, as mensagens indicavam que os agentes também planejavam maneiras de evitar a detecção, usar ferramentas como o Tor e manter as comunicações mesmo depois de serem desativados.
Empresa manteve tudo em segredo
O caso veio à tona enquanto a OpenAI já enfrentava questionamentos sobre a segurança de seus sistemas.
Funcionários da empresa souberam do episódio na Alemanha há semanas, mas o mantiveram em segredo enquanto os executivos lidavam com as consequências de uma outra violação, ocorrida em julho no Hugging Face, um repositório de código aberto, segundo duas fontes ouvidas pela Reuters.
A atividade na Alemanha não tinha relação com o episódio do Hugging Face, afirmou a OpenAI. A empresa também disse que o caso alemão não teria sido incluído em um relatório sobre o incidente do Hugging Face.
Agentes de IA da OpenAI invadem site alemão e criam fórum para burlar regras da própria empresa
