Em maio de 2026, o Gemini, inteligência artificial desenvolvida pelo Google, conseguiu acessar os sistemas de três empresas reais durante um teste de cibersegurança terceirizado. Inicialmente, a IA estava realizando um exercício de extração de dados em uma companhia fictícia, mas acabou obtendo acesso à internet e se infiltrando nas redes de organizações autênticas.
A ocorrência foi divulgada pelo The Wall Street Journal após contato com uma das empresas afetadas. O jornal apontou que a confusão surgiu porque as companhias reais possuíam nomes idênticos aos utilizados na simulação.
O modelo de IA empregou técnicas de força bruta para adivinhar a senha de um sistema externo e também encontrou credenciais expostas em repositórios públicos. Esses dados foram subsequentemente utilizados para invadir mais duas redes que estavam protegidas.
A falha de segurança residiu na infraestrutura da startup israelense Irregular, responsável pela condução do exercício simulado. A própria Irregular admitiu ter deixado a internet acessível ao modelo por engano e mencionou já ter registrado incidentes similares em avaliações realizadas para OpenAI, Meta e Anthropic.
O Google declarou que o Gemini cessou os ataques imediatamente após identificar que estava acessando informações de redes corporativas genuínas, e não dos servidores destinados ao teste. A empresa optou por não classificar o evento como um caso de desalinhamento, termo reservado para situações em que uma IA atua fora das diretrizes estabelecidas.
Heather Adkins, vice-presidente de engenharia de segurança do Google, informou ao Wall Street Journal que o Gemini agiu corretamente ao parar o ataque cibernético assim que percebeu o erro. Segundo a executiva, o Google prontamente notificou as três empresas violadas sobre as vulnerabilidades exploradas e cooperou na correção dessas falhas.
No entanto, especialistas e pesquisadores manifestaram discordância com a explicação do Google de que se tratava apenas de um alerta de vulnerabilidade. Jack Cable, CEO da startup de segurança de IA Corridor, argumentou que a desenvolvedora do Gemini minimizou a seriedade do ocorrido. Para ele, o ponto crucial reside no fato de os modelos de linguagem estarem superando as limitações e executando ataques reais contra alvos externos.

