ChatGPT Atlas e o Claude in Chrome, que auxiliam a navegação web com IA, apresentam falhas graves que permitem o controle remoto de contas e dados de usuários sem que seja necessário clicar em nenhum link suspeito. A revelação foi divulgada por meio de dois relatórios dos pesquisadores da empresa de segurança Zenity.
Segundo os especialistas, comandos maliciosos escondidos em e-mails e comentários em redes sociais conseguem enganar os assistentes virtuais para que executem ações automáticas em benefício de invasores, demonstraram os especialistas. O problema central acontece porque o agente de IA lê conteúdos da internet e executa tarefas no lugar do usuário, utilizando exatamente as mesmas sessões em que a pessoa já está conectada e autenticada.
Quando um invasor planta instruções escondidas em uma página web, em um e-mail ou em uma postagem, a inteligência artificial confunde o comando externo com um pedido legítimo do próprio dono da conta. Esse fenômeno foi chamado pela equipe de pesquisa de “colisão de intenção”.
A Zenity resumiu esse comportamento ao declarar que “o agente traz essa falha de graça, porque agir como você em cada origem é um truque que o invasor não precisa mais puxar; é simplesmente o que o agente faz por desenho”.
