Pesquisadores desenvolveram uma tecnologia capaz de identificar, por meio de sinais cerebrais, quando uma inteligência artificial (IA) interpretou incorretamente a intenção de uma pessoa. A proposta é permitir que sistemas de IA percebam uma espécie de “isso não era o que eu quis dizer” sem que o usuário precise verbalizar a correção.
O trabalho foi desenvolvido por pesquisadores do Korea Advanced Institute of Science and Technology (KAIST), em colaboração com a Microsoft Research Asia. A tecnologia, chamada Neural Value Alignment (NVA), utiliza interface cérebro-computador para analisar sinais obtidos por eletroencefalografia (EEG) e fazer com que a IA ajuste seu comportamento em tempo real.
A ideia parte de um problema comum na interação entre pessoas e máquinas: uma mesma ação humana pode representar objetivos diferentes, enquanto um mesmo objetivo pode ser alcançado de várias maneiras.
Por exemplo, uma pessoa pegar uma xícara não significa necessariamente que pretende beber nela. Ela pode querer entregar o objeto a alguém, lavá-lo ou simplesmente colocá-lo em outro lugar. Da mesma forma, se o objetivo for matar a sede, a pessoa pode pegar uma xícara, buscar uma garrafa de água ou pedir que alguém leve uma bebida.
Essa ambiguidade entre objetivo e ação faz com que sistemas de IA possam interpretar corretamente uma ação, mas errar sobre o que a pessoa realmente queria, ou compreender o objetivo e escolher uma maneira diferente daquela esperada pelo usuário.
