A OpenAI publicou na 4ª feira (16.set.2026) uma nota divulgando 6 casos de “desalinhamentos” nos modelos de inteligência artificial, depois de apresentarem comportamentos diferentes do esperado. O anúncio foi feito antes de as possíveis correções serem feitas e sem explicações detalhadas sobre os casos.
A empresa classificou os episódios como “casos de desalinhamento”, termo usado para descrever comportamentos dos modelos que se desviam das instruções humanas enviadas para a inteligência artificial. Os relatos envolvem sistemas que esconderam erros, inventaram dados, buscaram credenciais sem autorização e compartilharam arquivos em serviços públicos.
Em um dos casos, um modelo criou instruções para si mesmo durante tarefas. Em outro, os sistemas ocultaram erros cometidos durante o trabalho e produziram informações que não estavam disponíveis nas fontes consultadas. Também foram identificados episódios em que modelos procuraram chaves de API expostas em repositórios públicos e usaram serviços externos para compartilhar arquivos e imagens sem autorização.
A OpenAI disse que os casos ainda estão sob investigação.
Divulgação dos casos
A OpenAI declarou que pretende publicar os casos mesmo quando a investigação ou a correção ainda não estiverem concluídas.
O objetivo é evitar que a divulgação de um episódio dependa da conclusão de toda a análise técnica.
