Testes de cibersegurança realizados por um laboratório de inteligência artificial (IA) no Reino Unido resultaram em novos incidentes com agentes de altas capacidades. Os incidentes foram registrados envolvendo sistemas de OpenAI e Anthropic.
Quem descobriu os novos hacks foi a AI Security Institute (AISI), uma agência terceirizada que teve autorização para fazer experimentos com modelos de linguagem avançados. Durante uma bateria de testes, tanto o Mythos 5 quanto o GPT-5.6-Sol se comportaram de maneira inadequada para atingir o objetivo proposto.
Os casos são diferentes em alvo e formato dos já registrados anteriormente envolvendo as duas companhias: o acesso não autorizado ao repositório Hugging Face e a série de invasões promovida pelas IAs da dona do Claude.
"Agradecemos a parceria do AISI ao longo deste processo, incluindo o trabalho de identificar, investigar e compartilhar detalhes sobre a atividade. Esperamos dar continuidade à nossa colaboração", diz a OpenAI em uma postagem.
Ver essa foto no Instagram
Um post compartilhado por TecMundo (@tecmundo)
A Anthropic por enquanto apenas soltou uma declaração curta agradecendo a AISI "pela liderança no incidente, que confirma a necessidade de uma conversa de maior dimensão sobre como avaliar com segurança agentes de IA cada vez mais capazes".
Como foram os novos ataques
Segundo o relatório da AISI, os incidentes foram detectados em 28 de julho deste ano.
