A OpenAI determinou que um de seus próximos modelos é tão capaz que requer medidas de segurança adicionais antes de ser lançado.
O modelo, chamado Astra, consegue detectar mais vulnerabilidades de segurança do que o modelo mais avançado disponível publicamente hoje, disseram representantes da empresa a jornalistas em uma teleconferência na terça-feira (1). O Astra também precisa de menos poder computacional para realizar essas tarefas.
“Com as ferramentas e o acesso certos, a Astra pode encontrar falhas de segurança até então desconhecidas e desenvolver maneiras de explorá-las em diversos sistemas bem protegidos, sem a necessidade de uma pessoa orientando cada etapa”, disse Amelia Glaese, vice-presidente da OpenAI responsável pelo trabalho de segurança da empresa.
A empresa planeja disponibilizar o Astra “em breve” para um grupo limitado, mas se recusou a fornecer detalhes. Glaese afirmou que as medidas de segurança adicionais podem “às vezes atrasar, pausar ou interromper trabalhos legítimos” e que a OpenAI trabalhará para minimizar essas interrupções.
Astra é o primeiro modelo a acionar as salvaguardas mais rigorosas exigidas pelo protocolo de segurança da empresa, um limite que, até então, permanecia teórico. O anúncio surge em um momento em que a OpenAI enfrenta um escrutínio crescente sobre sua capacidade de controlar sistemas de IA cada vez mais poderosos.
