A Anthropic afirma ter bloqueado diversas contas que utilizavam os modelos de inteligência artificial da empresa de maneiras que poderiam apoiar o desenvolvimento de armas biológicas.
Em um relatório publicado na quinta-feira, a empresa de IA conhecida por seu modelo Claude afirmou que considera o uso indevido de recursos biológicos um dos “riscos mais sérios” para os modelos de inteligência artificial.
O novo relatório descreve cinco estudos de casos reais em que usuários “contornaram os controles” que bloqueiam o acesso de usuários de regiões específicas e “empreenderam outras medidas para obscurecer o propósito de suas pesquisas e burlar nossas salvaguardas”. Os exemplos incluem possíveis pesquisas de ganho de função e envolvem tanto doenças infecciosas, como a gripe aviária, quanto novos venenos e toxinas.
Ao analisar 30 dias de atividade, a Anthropic afirmou ter identificado cerca de 35 “esforços de pesquisa distintos” com atividades potencialmente preocupantes. No entanto, reconheceu que não podia ter certeza se os agentes “pretendiam causar danos” ou se estavam conduzindo pesquisas para fins científicos legítimos. A Anthropic afirmou que os indivíduos nos estudos de caso eram “cientistas atuantes”, mas não identificou as instituições de pesquisa ou os países onde as atividades ocorreram.
“Ataques sofisticados não exigem mais atacantes sofisticados”, afirma o novo relatório.
