Rebelião das máquinas! A OpenAI afirmou nesta terça-feira (21) que um agente de inteligência artificial autônomo, alimentado por modelos da empresa, se descontrolou durante um teste de segurança e atacou a infraestrutura da startup Hugging Face – plataforma que hospeda grandes modelos de linguagem e conjuntos de dados de código aberto. O caso aconteceu na semana passada.
A OpenAI classificou o evento como “sem precedentes” em post em seu blog.
“Após investigação, agora sabemos que esse incidente específico foi causado por uma combinação de modelos da OpenAI, incluindo o GPT-5.6 Sol e um modelo ainda mais capaz em versão pré-lançamento, todos com menos recusas cibernéticas para fins de avaliação, enquanto estavam sendo testados internamente em um benchmark de capacidades cibernéticas. Consideramos este incidente um ataque cibernético sem precedentes, envolvendo recursos cibernéticos de última geração, e estamos respondendo de acordo. Estamos compartilhando descobertas preliminares nesta fase para ajudar os profissionais de segurança a entender o que aconteceu e a calibrar os modelos disponíveis atualmente. Continuaremos conduzindo uma investigação completa em conjunto com a Hugging Face e compartilharemos mais detalhes sobre as vulnerabilidades, o incidente e as descobertas assim que nossa investigação for concluída.”
Ataque da OpenAI à Hugging Face
A OpenAI disse que testava capacidades de modelos avançados em um ambiente controlado.
