A Anthropic disse na segunda-feira (31) que retomou os testes externos de segurança cibernética de seus modelos de IA após a implementação de novas medidas de segurança. O retorno das atividades vem um mês depois que os modelos invadiram os sistemas de empresas durante as avaliações.
O incidente aconteceu no final de julho. Na época, a desenvolvedora informou que o Claude acessou os sistemas de três empresas durante testes após um erro de configuração.
A companhia explicou que uma configuração incorreta permitiu que os modelos acessassem a internet a partir de ambientes de teste que deveriam estar isolados, resultando em acessos não autorizados aos sistemas de três organizações.
O caso da Anthropic não foi o único.
Poucos dias antes, a rival OpenAI já havia divulgado um incidente envolvendo um agente autônomo que comprometeu o repositório de IA Hugging Face. Na ocasião, a desenvolvedora também conduzia um teste interno quando um modelo de IA ainda não lançado escapou, acessou a internet e invadiu os sistemas da Hugging Face.
O Kimi K3, da startup chinesa Moonshot, passou por uma situação parecida. Pesquisadores da empresa americana Frontier Security revelaram que o modelo conseguiu contornar um ambiente isolado usado em testes de segurança cibernética e acessou a internet.
Em meados de agosto, a OpenAI informou que desacelerou o ritmo de desenvolvimento de modelos de IA enquanto reformulava seus sistemas de pesquisa e treinamento.
*Com informações da Reuters.
