Resumo
Anthropic desenvolverá uma marca d’água invisível para textos criados pelo Claude, com base no SynthID-Text do Google DeepMind.
A marca d’água altera o padrão das palavras escolhidas pelo modelo, sem impactar a qualidade do texto, e será detectável por uma API.
Essa detecção pode falhar em casos de edições simples, trechos curtos, dados factuais, operações matemáticas, códigos de programação e textos revisados por humanos.
A Anthropic explicou como funcionará a marca d’água invisível para textos criados pelo Claude. A tecnologia tem como base o SynthID-Text, desenvolvido pelo Google DeepMind, e será inserido durante a geração das respostas.
A proposta é criar uma forma de verificação para textos gerados pela própria plataforma, seguindo as regras da Lei de Inteligência Artificial da União Europeia. O regulamento europeu começou a valer em 2 de agosto, determinando a adoção de soluções para que conteúdos criados em ferramentas de IA sejam detectáveis. Assim, tecnologias semelhantes devem começar a aparecer em outros modelos.
O SynthID já é conhecido como uma tecnologia de marca d’água para vídeo, imagem e áudio, fazendo pequenas alterações imperceptíveis para humanos. Enquanto imagens e vídeos têm mudanças nos pixeis, o SynthID-Text altera o padrão das palavras escolhidas pelo modelo.
Como a marca funciona?
Em comunicado, a Anthropic afirma que a identificação é criada na sequência de palavras geradas pelo assistente.
