Os pesquisadores do Instituto Avançado de Ciência e Tecnologia da Coreia (KAIST), em parceria com a Microsoft Research Asia, desenvolveram um sistema de inteligência artificial capaz de identificar, a partir de sinais cerebrais, quando interpretou de forma errada a intenção de uma pessoa. A tecnologia usa dados captados por eletroencefalograma (EEG) para detectar respostas associadas a erros e ajustar o comportamento da IA sem depender de novos comandos de voz ou gestos.
Chamado Neural Value Alignment (NVA), o método ainda está em fase de pesquisa e não é um produto comercial. A proposta é usar sinais cerebrais para ajudar sistemas de IA a diferenciar quando o objetivo interpretado está errado e quando o objetivo está correto, mas a estratégia escolhida para alcançá-lo não corresponde ao que a pessoa esperava.
Nos testes de simulação apresentados no estudo, o método conseguiu se adaptar mais rapidamente do que abordagens tradicionais em situações com maior incerteza. Os pesquisadores também avaliaram cenários nos quais os objetivos do usuário mudavam de forma repentina ou os sinais de feedback neural ficavam temporariamente indisponíveis.
A pesquisa não significa que a IA consiga ler pensamentos de forma geral. O sistema trabalha com padrões específicos de atividade cerebral relacionados à percepção de erro durante uma interação. Os sinais são processados para classificar se o problema está no objetivo interpretado ou na estratégia utilizada pela IA.
