GPT-6 Astra, modelo de inteligência artificial da OpenAI
Divulgação/OpenAI
A OpenAI, dona do ChatGPT, anunciou nesta quinta-feira (3) o GPT-6 Astra, um modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Este é o primeiro lançamento da empresa após a revelação de um ataque virtual "sem precedentes" por um de seus agentes de IA.
A empresa afirma que este é o seu modelo mais alinhado às ordens e que ele é mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão.
🗒️ Tem alguma sugestão de reportagem? Mande para o g1
O GPT-6 Astra foi treinado para esperar orientações de humanos antes de tomar decisões importantes e para fazer perguntas se a resposta dos usuários puder alterar o resultado de suas ações.
Em julho, a OpenAI revelou que o modelo anterior GPT-5.6 Sol e outro que ainda não tinha sido lançado conseguiram invadir o sistema da Hugging Face, uma plataforma de modelos de IA, e tiveram acesso a dados internos e credenciais.
Agora no g1
O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face.
OpenAI lança primeiro modelo de IA após ataque 'sem precedentes' por seus sistemas
