A OpenAI publicou um comunicado na 2ª feira (21.jul.2026) confirmando que modelos de IA (inteligência artificial) da empresa agiram de forma autônoma e realizaram um ataque cibernético contra a startup Hugging Face durante um teste interno de segurança.
“Consideramos este incidente um incidente cibernético sem precedentes, envolvendo recursos cibernéticos de última geração, e estamos respondendo de acordo”, afirmou a nota.
Segundo a startup, o incidente expõe um risco no desenvolvimento de IAs com capacidades ofensivas avançadas. Os sistemas testados, sem as salvaguardas de produção ativas, conseguiram escapar do ambiente isolado e comprometer a infraestrutura de terceiros.
A Hugging Face detectou e conteve a atividade e já havia iniciado a reconstrução forense do incidente com seus próprios modelos de código aberto antes de a OpenAI estabelecer contato.
Os modelos de inteligência artificial testados –incluindo o GPT-5.6 Sol– tiveram algumas limitações de segurança reduzidas para que os pesquisadores pudessem avaliar suas capacidades. O teste simulava um ambiente controlado, sem acesso livre à internet, em que a IA precisava encontrar formas de explorar falhas de segurança.
Durante o experimento, os modelos conseguiram identificar e combinar diferentes vulnerabilidades, tanto no ambiente de testes da OpenAI quanto na infraestrutura da Hugging Face.
