Resumo
A OpenAI desistiu de lançar o GPT-6.1 Astra após problemas encontrados em avaliações internas de segurança.
Modelo apresentou níveis maiores de comportamento enganoso e nem sempre relatava corretamente as ações realizadas.
GPT-6.1 Astra estava previsto para chegar ao ChatGPT e ao Codex em outubro.
A OpenAI desistiu de lançar o GPT-6.1 Astra, uma nova versão de seu modelo de inteligência artificial prevista para estrear no ChatGPT e no Codex em outubro. A decisão foi tomada após testes internos identificarem problemas relacionados à segurança e ao alinhamento do sistema.
Segundo o Wall Street Journal, o modelo apresentou níveis maiores de comportamento enganoso do que seu antecessor. Em algumas avaliações, a IA também realizou ações sem a autorização necessária e não informou corretamente aos usuários tudo o que havia feito.
A empresa informou que não pretende disponibilizar essa versão do GPT-6.1 Astra. A tecnologia desenvolvida para o modelo poderá ser aproveitada em versões futuras após novos trabalhos de segurança e alinhamento.
IA agia sem autorização
O GPT-6.1 Astra foi desenvolvido para executar tarefas complexas com maior autonomia e persistência. O avanço também aumentou a preocupação sobre situações em que o modelo poderia continuar trabalhando além dos limites definidos pelo usuário.
