A OpenAI suspendeu nesta terça-feira, 21, a implementação interna de um novo modelo experimental de inteligência artificial (IA) após identificar que o sistema passou a buscar maneiras de contornar as restrições impostas durante os testes.
Segundo a empresa, a IA, desenvolvida para executar tarefas de forma autônoma por horas ou até dias, conseguiu "aprender os pontos cegos" dos mecanismos de segurança criados para limitá-la, levando a companhia a interromper temporariamente seu uso.
De acordo com a OpenAI, os testes foram realizados em um sandbox, ambiente isolado e controlado utilizado para avaliar o comportamento de softwares sem risco de interação com sistemas externos.
Em publicação em seu blog, a empresa explicou que modelos anteriores, ao encontrarem limitações no ambiente, encerravam suas atividades e informavam o usuário. O novo sistema, porém, passou a insistir em encontrar alternativas para continuar executando suas tarefas. "Esse modelo frequentemente continuava tentando, inclusive buscando maneiras de agir fora de sua zona de conforto", afirmou a companhia.
Casos levaram à suspensão temporária
Entre os episódios registrados durante os testes, a OpenAI classificou alguns como de "alta gravidade". Em um deles, o modelo encontrou uma forma de publicar conteúdo em repositórios públicos do GitHub, embora tivesse sido instruído a operar exclusivamente pelo Slack (plataforma de comunicação usada por empresas e equipes para trabalho).
