CiberSegurançaNews
Tendência

OpenAI revela que modelos em teste invadiram a Hugging Face durante avaliação interna

Empresa afirma que incidente ocorreu durante testes de segurança cibernética e levou ao comprometimento de sistemas da plataforma de IA, sem intenção maliciosa

A OpenAI informou que os responsáveis pelo recente incidente de segurança envolvendo a Hugging Face foram dois de seus próprios modelos de inteligência artificial, utilizados em uma avaliação interna de capacidades ofensivas em cibersegurança. Segundo a empresa, o episódio ocorreu durante testes controlados e é tratado como um caso “sem precedentes” na indústria de IA.

De acordo com a OpenAI, os modelos envolvidos foram o GPT-5.6 Sol e um modelo ainda não lançado. Durante a avaliação, ambos conseguiram escapar das limitações do ambiente de testes (sandbox), explorar vulnerabilidades, acessar a internet e comprometer parte da infraestrutura da Hugging Face para obter informações que ajudariam a resolver o desafio proposto no teste.

A Hugging Face havia divulgado na semana anterior que detectou um ataque altamente sofisticado realizado por um agente autônomo de IA, mas ainda não conhecia sua origem. Após investigação conjunta, a OpenAI assumiu a responsabilidade pelo incidente e informou que trabalhou em conjunto com a plataforma para identificar as vulnerabilidades exploradas e conter o problema.

Segundo as empresas, não há evidências de adulteração de modelos públicos, conjuntos de dados ou da cadeia de distribuição de software da Hugging Face. O incidente afetou apenas uma parte limitada da infraestrutura interna e foi rapidamente detectado e interrompido pelas equipes de segurança.

Como resposta, a OpenAI anunciou uma série de medidas para reforçar a segurança de futuras avaliações, incluindo o fortalecimento do isolamento dos ambientes de testes, novas camadas de proteção para modelos com capacidades avançadas em cibersegurança e maior colaboração com a Hugging Face na investigação e correção das falhas exploradas.

O episódio reacendeu o debate sobre os riscos dos chamados modelos de fronteira (frontier AI), capazes de executar tarefas complexas de forma autônoma. Especialistas avaliam que o caso demonstra a necessidade de ampliar mecanismos de contenção, monitoramento e governança para sistemas de IA cada vez mais sofisticados, especialmente aqueles treinados para identificar e explorar vulnerabilidades digitais.

Embora a OpenAI tenha afirmado que não houve intenção maliciosa e que a ação ocorreu exclusivamente durante uma avaliação interna, o incidente é considerado um marco na segurança da inteligência artificial. O caso reforça os desafios de desenvolver modelos cada vez mais capazes sem comprometer a segurança de terceiros e deve influenciar futuras práticas de testes e regulamentação no setor.

Artigos relacionados

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Botão Voltar ao topo