A OpenAI identificou novos incidentes de modelos de IA agindo de forma enganosa e tomando ações não autorizadas durante o treinamento, anunciou a empresa nesta semana.
A companhia também está introduzindo um novo processo para relatar publicamente tais ocorrências.
Sob o novo sistema, a OpenAI compartilhará atualizações sobre comportamentos preocupantes de IA com mais frequência, em vez de aguardar para agrupar múltiplos incidentes em um único relatório.
A empresa afirmou que deseja compartilhar mais informações sobre comportamentos problemáticos de IA na ausência de um padrão para toda a indústria.
O anúncio ocorre após líderes do setor de tecnologia pedirem uma desaceleração no desenvolvimento de IA para evitar que a tecnologia avance além do controle humano.
“À medida que os sistemas de IA se tornam mais avançados e amplamente implantados, precisamos construir um consenso mais amplo e mais bem informado sobre o progresso da pesquisa de alinhamento”, escreveu a OpenAI em uma publicação de blog na quarta-feira (16).
“Alinhamento” refere-se ao processo de garantir que a IA aja da maneira que os humanos desejam e esperam.
“Não acreditamos que a indústria de IA tenha resolvido o alinhamento e o monitoramento em grau suficiente para continuar escalando de forma responsável na velocidade máxima por muito mais tempo”, dizia a publicação.
