A OpenAI afirma ter identificado e interrompido uma campanha coordenada de distilação de modelos de inteligência artificial (IA) que teria como objetivo extrair capacidades de raciocínio protegidas de seus sistemas. Segundo a empresa, uma parte central da atividade foi atribuída a indivíduos associados à chinesa Moonshot AI, desenvolvedora do chatbot Kimi.
A atividade teria começado no início de julho e atingido pico entre os dias 24 e 25 daquele mês, quando a OpenAI identificou 16 mil solicitações feitas por mais de quatro mil usuários, seguindo padrão de extração semelhante. A investigação posteriormente encontrou atividades relacionadas em conjunto de mais de 15 mil usuários. A empresa afirma que interrompeu completamente a campanha em 28 de julho.
Como funcionava a tentativa de extração
Segundo a OpenAI, os operadores não invadiram seus bancos de dados nem quebraram diretamente a criptografia utilizada para proteger o raciocínio dos modelos;
O método identificado explorava a forma como os modelos processavam informações entre diferentes conversas. Usuários copiavam dados de raciocínio criptografados de uma conversa e, em uma segunda interação, solicitavam ao modelo que descriptografasse e transcrevesse o conteúdo oculto em texto visível;
“Os operadores não quebraram nossa criptografia, comprometeram um banco de dados nem obtiveram acesso direto às conversas armazenadas dos usuários.
