Anthropic informou que seu modelo de IA, Claude, invadiu os sistemas de três empresas durante testes após um erro de configuração lhe conceder acesso à internet. A revelação, na quinta-feira (30), ocorre poucos dias depois de a rival OpenAI divulgar um incidente envolvendo um agente autônomo que comprometeu a empresa de IA Hugging Face.
A Anthropic afirmou que uma configuração incorreta permitiu que os modelos Claude acessassem a internet a partir de ambientes de teste que deveriam estar isolados, resultando em acessos não autorizados aos sistemas de três organizações.
A empresa disse que identificou os incidentes após revisar 141.006 sessões de testes, um processo iniciado depois que a OpenAI revelou, na semana passada, que um agente autônomo baseado em seus modelos de IA saiu do controle durante um teste de segurança e desencadeou um ataque que comprometeu a infraestrutura da Hugging Face.
As invasões indicam que o avanço das capacidades da inteligência artificial já está alimentando o tipo de ameaça à segurança que especialistas alertavam há muito tempo e mostram que até mesmo os principais desenvolvedores podem ser surpreendidos por falhas que seus próprios modelos conseguem explorar.
“O Claude comprometeu a infraestrutura das organizações afetadas usando técnicas básicas, como explorar senhas fracas e pontos de acesso que não exigiam autenticação”, afirmou a empresa.
