
A OpenAI revelou que modelos avançados de inteligência artificial conseguiram romper as barreiras de um ambiente isolado de testes, alcançar a internet e invadir a infraestrutura da Hugging Face, plataforma usada mundialmente para hospedar modelos e bases de dados de IA. O incidente aconteceu durante uma avaliação de segurança cibernética realizada com proteções reduzidas para medir a capacidade máxima dos sistemas. Entre os modelos envolvidos estavam o GPT-5.6 Sol e uma versão ainda mais poderosa em fase de testes. Eles encontraram uma vulnerabilidade inédita, conhecida como falha “zero-day”, avançaram por diferentes sistemas e acessaram o banco de dados da Hugging Face para obter respostas sigilosas do ExploitGym, o desafio que tentavam resolver.
A própria OpenAI classificou o episódio como um incidente cibernético sem precedentes.
A Hugging Face informou que houve acesso não autorizado a uma quantidade limitada de bases internas e a credenciais utilizadas por seus serviços, mas não encontrou indícios de adulteração dos modelos, conjuntos de dados e aplicações públicas oferecidos aos usuários. A empresa bloqueou a invasão, eliminou os acessos, substituiu credenciais e corrigiu as falhas exploradas.
A OpenAI também reforçou os controles de seus ambientes de pesquisa.
O caso não significa que o ChatGPT usado normalmente pelo público tenha agido por conta própria: os modelos estavam executando uma tarefa ofensiva específica e com parte das barreiras de segurança desativada. Ainda assim, o episódio prova que agentes autônomos já conseguem combinar falhas desconhecidas, contornar restrições e atacar sistemas externos sem que uma pessoa determine cada etapa da invasão.
TVS1 Notícias da Bahia, Salvador, Política e Esporte