A OpenAI afirmou nesta terça-feira (1º) que o seu mais recente modelo de linguagem em desenvolvimento, chamado de Astra, tem capacidades "críticas" na área de cibersegurança. A empresa de inteligência artificial (IA) detalhou esse diagnóstico em um relatório.
De acordo com a companhia, que agora tem evidências mais robustas sobre o modelo, essa é a primeira plataforma desenvolvida por ela que atinge essa categoria, o que coloca a tecnologia em uma posição tanto de destaque quanto de alto risco na indústria.
O texto alega que ele consegue "encontrar falhas de segurança até então desconhecidas" e desenvolver formas de explorá-las em diversos sistemas bem protegidos, sem a necessidade de um acompanhamento humano para conduzir cada etapa dessa invasão.
Maior proteção contra usos criminosos ou acidentais
A OpenAI até mesmo atrasou de propósito o desenvolvimento do Astra para garantir que todas as proteções fossem implementadas, com o objetivo de impedir usos criminosos do modelo ou até mesmo que ele realize ações acidentais que resultem em acessos não autorizados a sistemas.
A precaução foi tomada após incidentes com modelos da OpenAI que invadiram outras companhias durante testes de avaliação. No caso mais famoso, envolvendo o repositório Hugging Face, uma IA que não é a Astra explorou credenciais vazadas para invadir o sistema em busca de respostas para um desafio.
