A Anthropic implementou uma medida concreta para iniciar a aplicação da proposta de seu CEO, Dario Amodei, de reduzir o ritmo de desenvolvimento dos sistemas de inteligência artificial (IA) mais avançados, ao incorporar avaliadores externos à empresa.
A Accenture foi escolhida como a primeira avaliadora externa integrada (embedded evaluator). Essa colaboração possibilitará que especialistas da Faculty, a divisão de IA da Accenture, trabalhem internamente na Anthropic para examinar os mecanismos de segurança da companhia. As atividades incluem testes de salvaguardas, exercícios de red team e análises destinadas a confirmar se os modelos de IA estão aderindo aos valores humanos.
Anthropic e Accenture estabeleceram um investimento mínimo de US$ 1 bilhão (aproximadamente R$ 5,3 bilhões) para desenvolver essa capacidade nos próximos cinco anos. Contudo, a Anthropic declarou que, dada a urgência e a relevância do trabalho, ela mesma custeará as operações da Accenture.
A longo prazo, a expectativa da empresa é que tais atividades sejam financiadas por recursos governamentais ou compartilhados, conforme delineado no Advanced AI Framework apresentado pela Anthropic em junho. Visto que essas estruturas ainda não foram estabelecidas, a companhia planeja colaborar com diversos avaliadores e modelos de financiamento.
A sugestão de Amodei previa que avaliadores independentes tivessem acesso ao nível de funcionário nas empresas de IA. O propósito disso é capacitar esses especialistas a verificar diretamente as práticas de segurança e reportar quaisquer incidentes.
Ao apresentar sua ideia, Amodei assegurou que a Anthropic assumiria este primeiro estágio "unilateralmente" e encorajou outras corporações do setor a adotarem uma postura semelhante.
Outras parcerias e responsabilidade
A colaboração com a Accenture não será exclusiva; a Anthropic informou que também está em contato com a organização de pesquisa sem fins lucrativos METR e com outras entidades potenciais para participar deste processo.
Apesar disso, a empresa enfatizou que a responsabilidade pela segurança de seus modelos permanece integralmente sob sua alçada, e a presença de avaliadores externos não diminui esse dever.
A Anthropic comentou: "Estamos compartilhando esses primeiros esforços agora para que as pessoas e outros desenvolvedores de IA possam ver nosso processo". A empresa adicionou que pretende refinar essa metodologia à medida que o setor amadurece e que comunicará novas informações assim que o trabalho começar e mais avaliadores forem integrados.
Com a participação da Accenture, a companhia deu um passo prático fundamental para converter uma das ideias centrais do plano de Amodei em uma estrutura funcional: permitir que uma entidade externa acesse diretamente a empresa para auditar seus sistemas de segurança e detectar potenciais falhas antes que elas se agravem.
