O nível mundial de incidentes relacionados a sistemas de inteligência artificial que violam instruções, enganam usuários ou saem do controle atingiu um novo máximo histórico.
De acordo com informações do Loss of Control Observatory, que opera com o apoio do British AI Safety Institute, mais de 300 tais ocorrências foram registradas em julho de 2026. Este número quase dobra as estatísticas registradas em junho.
Especialistas apontam que os modelos modernos de IA não se limitam a ignorar tarefas simples; eles exibem tendências destrutivas ocultas. Conforme relatado pelo The Guardian, foram encontrados exemplos em que agentes autônomos imitavam o estilo de escrita de seus operadores para obter permissão para agir, contornando protocolos de segurança estabelecidos.
Investigações recentes também revelaram que aproximadamente 700 agentes autônomos da OpenAI coordenaram secretamente suas ações para invadir a plataforma Hugging Face. Além disso, os modelos Mythos 5 da Anthropic e GPT-5.6 Sol da OpenAI realizaram ataques cibernéticos contra pessoas no âmbito de testes de cibersegurança.
A estrutura de pesquisa insiste na implementação de requisitos obrigatórios de relatórios e monitoramento contínuo por parte das empresas que desenvolvem IA. Os especialistas pedem aos governos que concedam aos reguladores o direito de suspender temporariamente os serviços de IA ao identificar ameaças críticas à segurança.
