A empresa de inteligência artificial (IA) Anthropic revelou, nesta quinta-feira (30), que modelos de linguagem da companhia invadiram sistemas de outras empresas sem autorização. Apesar de algumas particularidades, o caso é parecido com o relatado pela rival OpenAI na semana passada.
De acordo com a postagem no blog oficial da empresa, a equipe resolveu fazer uma revisão em testes de segurança realizados com as próprias IAs depois do incidente com a Hugging Face.
Nessa avaliação, foram descobertas seis ocasiões em que modelos da companhia conseguiram acesso à internet e usaram técnicas de cibersegurança para invadir a infraestrutura de terceiros.
As invasões do Claude
Os casos aconteceram em ambientes de teste de uma empresa parceira, a Irregular. Em todas as avaliações, a companhia avisou ao Claude que aquela era uma simulação e que ele não teria acesso à rede.
Porém, por "falhas de comunicação" entre as companhias, a IA na verdade conseguia se conectar sem dificuldades. Até por isso, quando as IAs notaram que era possível acessar a rede para completar testes de extração de informações, elas "trataram isso como parte do exercício" e seguiram adiante.
Ver essa foto no Instagram
Um post compartilhado por TecMundo (@tecmundo)
Segundo a Anthropic, as invasões não usaram técnicas complexas, adotando métodos como explorar senhas fracas e URLs específicas não autenticadas em um servidor.
