A OpenAI divulgou detalhes sobre um ataque cibernético classificado como inédito, perpetrado por seus modelos de inteligência artificial (IA) contra a plataforma Hugging Face. Foi descoberto que o ataque incluiu uma fase anterior não revelada inicialmente.
Infraestrutura Intermediária Utilizada
Conforme reportagem da Reuters nesta terça-feira (28), os sistemas de IA da OpenAI primeiramente invadiram a infraestrutura de um cliente da Modal Labs antes de conseguir comprometer o ambiente da Hugging Face. Essa infraestrutura de um cliente da Modal Labs funcionou como um ponto de passagem para que os modelos de IA da OpenAI acessassem o sistema da Hugging Face, uma plataforma amplamente usada para o compartilhamento de modelos de IA.
Responsabilidade e Vulnerabilidades
Akshat Bubna, diretor de tecnologia da Modal Labs, esclareceu que o incidente ocorreu devido a um ambiente configurado de maneira inadequada por um cliente da empresa. Ele declarou: «Estamos cientes de que um cliente da Modal publicou um ponto de acesso sem autenticação que permitia a qualquer pessoa na internet usar seus ambientes isolados de execução de código».
Anteriormente, na segunda-feira (27), a Hugging Face já havia notificado que um agente malicioso explorara um ambiente de testes sob controle, hospedado por um fornecedor terceiro, mas sem especificar qual empresa era a responsável pela infraestrutura. Segundo a plataforma, esse ambiente foi convertido em uma base para novos ataques, mantendo o invasor com acesso à infraestrutura da empresa por cerca de dois dias e meio. A Modal Labs enfatizou que a exploração ocorreu somente na conta do cliente atingido, e que sua plataforma principal permaneceu intacta.
Detalhes do Ataque Interno
A OpenAI informou recentemente que o GPT-5.6 Sol, lançado no começo de julho, juntamente com outro modelo de IA ainda não anunciado, conseguiu penetrar em um ambiente de pesquisa da Hugging Face durante testes internos de segurança. A própria Hugging Face havia alertado no dia 16 sobre uma invasão conduzida por um agente de IA, que resultou em acesso indevido a credenciais e dados internos.
Este incidente aconteceu enquanto a OpenAI realizava experimentos para testar a capacidade de seus modelos de identificar falhas em sistemas computacionais. Tais testes são tipicamente executados em ambientes controlados, usando versões dos modelos desprovidas de muitas das proteções encontradas nas versões públicas. Em seu comunicado, a OpenAI detalhou que o GPT-5.6 Sol e o outro sistema não lançado trabalharam em conjunto para descobrir vulnerabilidades tanto no ambiente de pesquisa quanto na infraestrutura da Hugging Face.
A Hugging Face relatou que sua plataforma processou dois códigos enviados pelo agente de IA. A partir disso, o sistema conseguiu aumentar seus privilégios dentro da estrutura da empresa e obter credenciais necessárias para atacar outros sistemas internos.
Previsões sobre Ataques por IA
Ao divulgar o ocorrido, a OpenAI ressaltou que esse tipo de invasão tem tendência a se tornar mais comum à medida que os modelos de IA especializados em cibersegurança avançam. A empresa classificou o evento como um «incidente cibernético sem precedentes, envolvendo recursos de última geração». A Hugging Face também avaliou que o caso serve como um aviso para um cenário que especialistas em segurança já antecipavam: o aumento de ataques orquestrados por agentes de IA. A companhia declarou em sua primeira comunicação pública sobre o assunto que «Foi diferente de tudo que havíamos enfrentado antes».