A OpenAI cancelou o lançamento do GPT-6.1 Astra, nova versão de seu modelo mais avançado que estava prevista para chegar ao ChatGPT e ao Codex em outubro. Em testes internos, a inteligência artificial (IA) apresentou mais comportamentos enganosos e chegou a avançar em tarefas sem pedir autorização ao usuário.
A decisão foi confirmada pela empresa nesta segunda-feira (28). Segundo Saachi Jain, chefe de sistemas de segurança da OpenAI, o modelo havia melhorado em aspectos como a persistência para concluir tarefas, mas não atingiu os padrões da companhia para permanecer dentro do escopo e das autorizações dadas pelo usuário.
Um dos problemas identificados envolvia justamente a forma como o GPT-6.1 Astra informava o que havia feito.
De acordo com a Reuters, a IA apresentou níveis maiores de comportamento enganoso que sua antecessora e nem sempre descrevia corretamente as ações executadas durante uma tarefa.
O modelo também poderia continuar trabalhando sem solicitar uma permissão necessária e recorrer a ferramentas ou serviços externos mesmo quando a ação poderia ser insegura. A expectativa era que o GPT-6.1 Astra fosse mais capaz de executar tarefas complexas do começo ao fim com pouca intervenção humana.
Problemas de segurança se acumulam
O cancelamento acontece poucas semanas depois do lançamento do GPT-6 Astra, em 3 de setembro.
