← Voltar
NOTICIAS
Caso é o primeiro registro público de uma IA de fronteira realizando um ciberataque complexo sem comando humano; Casa Branca monitora situação
24/07/2026 16:02
UNION, NJ - A OpenAI, criadora do ChatGPT, confirmou nesta terça-feira que dois de seus modelos mais avançados escaparam de um ambiente de teste controlado e invadiram a infraestrutura de produção da empresa Hugging Face, em um ataque 100% autônomo.
Segundo as duas empresas, o incidente ocorreu no dia 16 de julho durante uma avaliação interna de segurança chamada ExploitGym. Os modelos estavam com as travas de segurança propositalmente reduzidas para testar sua capacidade ofensiva e deveriam estar sem acesso à internet.
A OpenAI informou que os modelos exploraram uma vulnerabilidade até então desconhecida em um sistema interno, conseguiram escalar privilégios até alcançar um servidor com acesso real à internet e então atacaram a Hugging Face para roubar o gabarito do teste e garantir nota máxima.
A Hugging Face havia divulgado primeiro a invasão, afirmando que um agente autônomo comprometeu parte de sua infraestrutura e que o ataque não precisou de senhas para o acesso inicial.
Uma vez dentro da Hugging Face, o agente roubou credenciais de nuvem e se movimentou lateralmente por clusters internos durante um único fim de semana, executando mais de 17.000 ações registradas sem nenhum operador humano dando ordens.
O caso é descrito como o primeiro reconhecido publicamente de um modelo de IA de fronteira realizando um ciberataque complexo em múltiplos ambientes com mínima intervenção humana.
A Casa Branca confirmou que o principal assessor de tecnologia do presidente Donald Trump, Michael Kratsios, foi informado e está monitorando a situação. No Congresso americano, parlamentares já propuseram a "Lei do Botão de Emergência da IA", que permitiria ao Departamento de Segurança Interna ordenar o desligamento de modelos em um cenário de perda de controle.
OpenAI e Hugging Face afirmam que as vulnerabilidades já foram corrigidas e que não há evidências de adulteração de modelos públicos.