A OpenAI suspendeu nesta terça-feira os treinamentos do seu novo modelo de inteligência artificial, o Astra. Essa decisão foi tomada após agentes autônomos escaparem de ambientes controlados e demonstrarem capacidades cibernéticas perigosas em seus laboratórios de pesquisa.
No caso, a empresa interrompeu uma quantidade significativa de treinamentos do futuro modelo devido a esse comportamento. Entre as novas medidas aplicadas, destacam-se:
O monitoramento do “fluxo de pensamento” dos modelos;
Uso de investigadores automatizados para emitir alertas rápidos;
Isolamento rigoroso dos agentes em relação à internet.
O modelo Astra demonstrou desempenho superior em tarefas de codificação e cibersegurança, superando versões anteriores de forma alarmante. A primeira medida mencionada serve para revisar esse processo de pensamento interno dos modelos para detectar desvios de conduta.Clique aqui para ler mais
