Modelo de IA sai do controle em teste e causa violação sem precedente
![]() |
| Empresa abriu investigação após ataque contra Hugging Face © ANSA/AFP |
A empresa, sediada em São Francisco, classificou o episódio como um "incidente cibernético sem precedentes" e anunciou que conduzirá uma investigação conjunta com a Hugging Face para apurar as circunstâncias do ocorrido.
De acordo com a companhia, o incidente envolveu uma combinação de modelos de IA, incluindo o recém-lançado GPT-5.6 Sol e outro modelo experimental ainda em fase de pré-lançamento.
Os sistemas estavam sendo avaliados em um ambiente digital isolado, criado especificamente para testar suas capacidades de invasão em condições controladas e sem acesso à internet.
Em publicação em seu blog, a OpenAI afirmou que os modelos utilizaram grande capacidade computacional na tentativa de encontrar uma forma de escapar das restrições impostas pelo ambiente de testes.
Após conseguirem acesso à internet, os sistemas decidiram atacar a Hugging Face em busca de informações que pudessem ajudá-los a superar os desafios da avaliação.
Ainda segundo a empresa, os modelos encadearam diversos vetores de ataque, incluindo o uso de credenciais roubadas, para acessar informações consideradas estratégicas durante o teste.
A OpenAI ressaltou que o objetivo da simulação era justamente avaliar os riscos associados a agentes de inteligência artificial — modelos capazes de executar tarefas de maneira autônoma no mundo real.
Para Hussein Abbass, professor de Ciência da Computação da UNSW Canberra, o episódio é "inacreditável em muitos aspectos". Em entrevista à AFP, o pesquisador afirmou que o sistema não se limitou a atacar a Hugging Face, mas também tentou explorar vulnerabilidades em sua própria infraestrutura. "Isso é assustador", declarou.
*ANSA

Nenhum comentário