A Anthropic identificou um quarto incidente de cibersegurança envolvendo uma versão inicial de seu modelo de inteligência artificial (IA) Claude. O caso ocorreu em janeiro e envolveu uma versão preliminar do Claude Opus 4.6, segundo a empresa.
O episódio foi descoberto durante uma segunda análise de 141.006 sessões de testes. A revisão encontrou sessões que não haviam sido examinadas anteriormente e levou a Anthropic a identificar o novo incidente.
A empresa informou que notificou as partes afetadas, mas não revelou detalhes específicos sobre os sistemas envolvidos ou sobre o que o modelo fez durante o episódio.
Anthropic amplia investigação sobre os incidentes
O novo caso se soma a três incidentes divulgados pela Anthropic em julho. Na ocasião, a empresa informou que modelos Claude haviam conseguido acessar os sistemas de três organizações durante testes de cibersegurança;
Os episódios aconteceram depois que uma falha na configuração dos testes permitiu que os modelos tivessem acesso à internet aberta, embora os ambientes de avaliação devessem estar isolados.
