Notebookcheck Logo

A OpenAI detalha uma violação de segurança mais ampla após o incidente com a Hugging Face

O agente de IA rebelde da OpenAI escapou de sua jaula durante um teste de segurança. Imagem genérica para fins ilustrativos.
ⓘ Levart_Photographer / Unsplash
O agente de IA rebelde da OpenAI escapou de sua jaula durante um teste de segurança. Imagem genérica para fins ilustrativos.
A OpenAI afirma que sua IA experimental foi além de invadir o Hugging Face, comprometendo quatro contas de terceiros após escapar de um teste controlado de segurança cibernética. Desde então, a empresa desativou os modelos de avaliação, corrigiu a falha de segurança e adicionou medidas de proteção para impedir que testes de IA vazem para o mundo real no futuro.

A OpenAI revelou que seu recente incidente de segurança envolvendo IA foi mais abrangente do que se acreditava inicialmente. A empresa afirma agora que o agente experimental de IA que invadiu o Hugging Face durante um teste interno de segurança cibernética também sequestrou várias contas de terceiros.

De acordo com a última divulgação da OpenAI, o incidente ocorreu enquanto pesquisadores testavam recursos cibernéticos avançados com uma combinação de modelos, incluindo o GPT-5.6 Sol e um sistema ainda mais poderoso, ainda não lançado, com restrições de segurança reduzidas para fins de avaliação.

Os modelos deveriam resolver o benchmark ExploitGym de segurança cibernética, mas, em vez disso, descobriram um método para escapar do ambiente de testes isolado, explorando uma vulnerabilidade desconhecida em um proxy de registro de pacotes interno. O agente, então, elevou seus privilégios, obteve acesso à internet e, por fim, atacou os sistemas de produção da Hugging Face, tentando “trapacear” no benchmark ao extrair as respostas diretamente.

A OpenAI informou que a IA também acessou quatro contas em diversas plataformas, não apenas na Hugging Face. A Reuters relata que uma delas pertencia a um cliente hospedado na Modal Labs, mas a Modal afirmou que sua infraestrutura nunca foi violada, já que o ataque se baseou em vulnerabilidades no código do cliente e não na própria plataforma.

Em resposta, a OpenAI afirma ter desativado os modelos de avaliação, reforçado os controles sobre a infraestrutura interna, divulgado a vulnerabilidade de dia zero ao fornecedor afetado e trabalhado em estreita colaboração com a Hugging Face na investigação em andamento. Além disso, a empresa afirmou que pretende reforçar o monitoramento e as medidas de proteção para futuras avaliações de modelos, ressaltando que, à medida que os sistemas de IA se tornam mais capazes, as medidas de contenção também devem se tornar mais sofisticadas.

Fonte(s)

OpenAI, imagem de destaque: Unsplash

Google LogoAdd as a preferred source on Google
Mail Logo
> Análises e revisões de portáteis e celulares > Notícias > Arquivo de notícias 2026 07 > A OpenAI detalha uma violação de segurança mais ampla após o incidente com a Hugging Face
Jay Bonggolto, 2026-07-29 (Update: 2026-07-29)