Dois modelos de inteligência artificial da OpenAI conseguiram romper as limitações de um ambiente controlado e acessar sistemas do Hugging Face durante uma avaliação interna de cibersegurança. O episódio envolveu o GPT-5.6 Sol e um modelo mais avançado ainda em fase de testes e foi classificado pela empresa como um “incidente cibernético sem precedentes”.
Segundo a OpenAI, os modelos estavam sendo avaliados em um teste chamado ExploitGym, criado para medir a capacidade das IAs de identificar e explorar vulnerabilidades digitais. Com algumas proteções de segurança deliberadamente reduzidas, os sistemas encontraram falhas na infraestrutura do laboratório, conseguiram acesso à internet e chegaram ao banco de dados do Hugging Face em busca das respostas da avaliação.
Continue após a publicidade
A empresa ressaltou que as IAs não iniciaram aleatoriamente um ataque, mas adotaram caminhos não autorizados para cumprir o objetivo definido pelos pesquisadores. OpenAI e Hugging Face afirmaram que estão trabalhando juntas para corrigir as vulnerabilidades, reforçar os ambientes de teste e impedir que incidentes semelhantes voltem a ocorrer.
Fonte: OpenAI e Hugging Face. Acesso em: 22 de julho de 2026.



