A startup chinesa de inteligência artificial (IA) Z.ai afirmou nesta sexta-feira, 14, que seu modelo de código aberto GLM-5.3 alcançou desempenho próximo ao Mythos 5, da Anthropic, em testes de cibersegurança. Segundo a empresa, o sistema obteve 84,5% no CyberGym, avaliação que mede a capacidade de analisar códigos, identificar falhas de segurança e confirmar se as vulnerabilidades são reais.
O Mythos 5 marcou 83,8%. Os resultados, porém, ainda não foram verificados por entidades independentes, segundo a Reuters.
O desempenho foi diferente quando o teste avaliou a capacidade de transformar vulnerabilidades encontradas em ataques funcionais. No ExploitBench, o GLM-5.3 alcançou 54,4%, enquanto o Mythos 5 chegou a 78%. Em uma avaliação cronometrada, a Z.ai informou que seu modelo concluiu 105 tarefas de desenvolvimento de ataques em duas horas e 130 em seis horas. O Mythos 5 realizou 181 e 247 tarefas nos mesmos períodos.
Modelo terá acesso restrito em funções sensíveis
A comparação ocorre em meio ao avanço de modelos de inteligência artificial capazes de atuar tanto na defesa quanto na exploração de sistemas digitais. A Anthropic disponibilizou o Mythos, uma versão do Claude Fable 5 com as salvaguardas de cibersegurança removidas, apenas para organizações verificadas. A preocupação é que ferramentas capazes de encontrar e explorar falhas possam ajudar equipes de defesa, mas também reduzir as barreiras para ataques cibernéticos.
