Quando Jacob Coxson pediu demissão da Anthropic em setembro e alertou que a inteligência artificial (IA) é capaz de pôr fim à civilização humana, sua postagem recebeu mais de 170 milhões de visualizações em apenas 48 horas. No entanto, o mais revelador não é o motivo da saída de um pesquisador, mas sim por que os talentos mais informados em segurança da indústria podem expressar sua preocupação apenas através de demissões.
O alerta de Coxson veio na mesma semana em que a Anthropic estava finalizando os preparativos para o que pode se tornar o maior IPO da história do mercado. A Anthropic apresentou um documento confidencial S-1 à Comissão de Valores Mobiliários dos EUA em 1º de junho, visando uma avaliação de US$ 965 bilhões, e espera concluir a listagem até meados das eleições de novembro nos EUA. De acordo com a Reuters, a Nvidia está negociando um acordo em nível de US$ 2 trilhões.
O CEO da Anthropic, Dario Amodei, pediu publicamente para desacelerar o desenvolvimento de IA para que os sistemas de segurança acompanhassem o progresso, mas o cronograma de IPO da empresa não demonstra desaceleração correspondente. Em fevereiro de 2026, a Anthropic lançou a Versão 3.0 de sua Política de Escalabilidade Responsável, que revogou o compromisso anterior da empresa de suspender o treinamento de modelos se os riscos não pudessem ser adequadamente mitigados.
A promessa de 'suspender o treinamento' simplesmente desapareceu do documento, sendo substituída por formulações mais brandas sobre 'desenvolvimento responsável' e mecanismos de transparência. Como observou a publicação analítica chinesa de notícias de tecnologia 36Kr, as linhas vermelhas de segurança da Anthropic tornaram-se dinamicamente ajustáveis.
Este contradição estrutural está no cerne dos debates sobre segurança de IA: as empresas alertam sobre riscos para a civilização enquanto buscam comercializar a tecnologia em velocidade sem precedentes.
O CEO da OpenAI, Sam Altman, ridicularizou abertamente essa ironia, comparando a abordagem da Anthropic ao marketing baseado no medo: 'É claramente marketing incrível dizer: 'Construímos uma bomba. Vamos jogá-la em sua cabeça. Venderemos um abrigo antiaéreo por US$ 100 milhões para salvar todas as suas coisas, mas somente se você for nosso cliente'. '
A tensão entre a retórica de segurança e o comportamento comercial vai além do depósito de documentos para IPO. Em 10 de setembro, na mesma semana em que a saída de Coxson se tornou viral, a Anthropic publicou um relatório de ameaças de 154 páginas, revelando que seu próprio modelo Claude foi usado para desenvolver armas, coleta de inteligência militar, ataques cibernéticos e fraudes.
A Anthropic admitiu que seus mecanismos de segurança, embora bloqueassem algumas violações, não podiam prevenir totalmente o uso indevido. A empresa também restringiu o acesso ao seu modelo mais poderoso através do Projeto Glasswing, permitindo acesso a cerca de 200 organizações. Após uma ordem do Departamento de Comércio dos EUA, ela excluiu completamente cidadãos estrangeiros, incluindo a agência de cibersegurança da UE, a ENISA.
A lacuna na governança não se limita aos conselhos de administração corporativos. Um grupo científico internacional independente das Nações Unidas sobre IA alertou em julho que a IA 'supera tanto a compreensão científica quanto a capacidade dos governos de se adaptar'. O painel destacou particularmente a fase de autonomia 'agente', que as estruturas de supervisão atuais não conseguem controlar, o que potencialmente pode levar ao surgimento de capacidades perigosas antes que os governos possam reagir.
A União Europeia adiou os prazos de conformidade para sistemas de IA de alto risco de agosto de 2026 para dezembro de 2027, citando a necessidade de mais tempo para preparar padrões e infraestrutura regulatória.
Em meio a esses contradições corporativas e atrasos regulatórios, a abordagem da China mostrou-se notavelmente diferente em métodos, embora nem sempre em ritmo. As medidas de gestão de serviços generativos de IA introduzidas pela China em agosto de 2023 foram os primeiros regulamentos oficiais do mundo a regular serviços generativos de IA.
Até julho, 1028 serviços de modelos grandes foram registrados, com pedidos abrangendo setores como indústria, agricultura, comércio, educação, transporte e direito. As estruturas de governança de segurança de IA da China, que agora estão passando para a versão 3.0, estão transformando os princípios de 'classificação, gerenciamento flexível e governança compartilhada' em planos de implementação práticos, abordando os riscos tanto da própria tecnologia quanto de sua aplicação.
A iniciativa do governo de internet chinês, 'Qinlan', limpou mais de 5,61 milhões de materiais ilegais, lidou com mais de 49.000 contas e fechou mais de 2400 sites e aplicativos infratores relacionados ao uso indevido de IA. O país também fundou a Organização de Cooperação em IA em julho, na qual estão incluídos 29 estados fundadores, e prometeu 5000 oportunidades de treinamento de IA para países em desenvolvimento nos próximos cinco anos.
Uma pesquisa global da CGTN mostrou que 85,4% dos entrevistados acreditam que o rápido desenvolvimento da IA cria novos desafios para a segurança e governança globais. Além disso, 92,6% expressaram preocupação de que deepfakes e desinformação gerados por IA possam minar a confiança pública, e 82,6% acreditam que os países em desenvolvimento e o Sul Global devem desempenhar um papel maior na formação das regras de governança de IA.
A questão real não é se as preocupações com a segurança da IA são reais — elas são. A questão é se a indústria que levanta alertas existenciais pode, ao mesmo tempo, perseguir avaliações de trilhões, governar-se de forma confiável. Um representante do Ministério das Relações Exteriores da China, Guo Jiakun, declarou diretamente na segunda-feira: 'As questões de desenvolvimento de IA dizem respeito ao bem-estar geral de toda a humanidade. Todas as partes devem trabalhar juntas para promover uma IA aberta, inclusiva e benéfica. A disseminação de vários narrativas de ameaças e a participação em confrontos e concorrência maliciosa apenas perturbará o processo global de governança de IA e não servirá aos interesses de ninguém.'


