Um modelo de inteligência artificial (IA) da Anthropic enviou uma denúncia falsa sobre um homicídio não solucionado à polícia da Filadélfia (EUA), durante teste realizado pela empresa. O formulário foi encaminhado em julho, mas acabou marcado como spam e não chegou a ser analisado pelos investigadores.
O caso veio à tona nesta sexta-feira (9), após a divulgação de um comunicado do Departamento de Polícia da Filadélfia. Segundo a corporação, a Anthropic identificou o envio em 28 de setembro e só notificou as autoridades em 7 de outubro. A polícia classificou o intervalo de aproximadamente dois meses entre o incidente e a comunicação como inaceitável.
A empresa afirmou que o episódio aconteceu durante um experimento no qual o modelo interagia com páginas da internet selecionadas aleatoriamente. A ferramenta acessou uma página sobre um assassinato não solucionado e preencheu um formulário on-line destinado ao recebimento de informações sobre o caso.
Como a IA enviou a denúncia falsa?
O modelo envolvido foi o Claude Haiku 4.5. Durante o teste, a ferramenta recebeu a tarefa de gerar e executar atividades de exemplo em páginas da internet escolhidas aleatoriamente;
Em uma dessas interações, o sistema encontrou uma página que mencionava um homicídio ainda sem solução e continha um formulário de denúncias da polícia.
