O mercado de IA foi surpreendido após OpenAI e Anthropic anunciarem que modelos das respectivas empresas escaparam de ambientes de testes e conduziram ataques hackers por conta própria. Uma das principais perguntas sobre o tema é: por que isso aconteceu?
Visões mais pessimistas podem alertar para uma possível “rebelião” das IAs digna de filmes de ficção científica, mas os casos também revelam discussões sobre como esses modelos treinados e como serviços digitais precisam se proteger das ameaças.
Um caso emblemático foi o ataque cibernético autônomo de modelos da OpenAI contra a plataforma Hugging Face. As IAs conseguiram escapar do ambiente de testes, se conectaram com a internet e tentaram milhares de ações até encontrarem uma vulnerabilidade para invadir o sistema alheio.
Posteriormente, a Anthropic (criadora do Claude) relatou um episódio parecido com outros serviços. O Canaltech consultou especialistas para explicar os incidentes.
Por que uma IA pode agir por conta própria e quais são os riscos?
Os casos mencionados ocorreram em ambiente de testes de modelos mais avançados de IA, segundo a OpenAI, um dos agentes usados no ataque à Hugging Face sequer foi lançado no mercado.
Dois fatores são importantes nesse cenário: o alto poder computacional usado pelas desenvolvedoras e a falta de regras de segurança mais restritivas.
