O CEO da Anthropic, Dario Amodei, fez um apelo às empresas que desenvolvem inteligência artificial (IA) para reduzir o ritmo do aumento das capacidades dos modelos diante das crescentes preocupações sobre o uso indevido da IA. Ele apresentou uma estrutura de três etapas destinada a regular o desenvolvimento e fornecer mais tempo para gerenciar os riscos associados.
Amodei escreveu em um ensaio detalhado publicado no X no sábado: «Devemos desacelerar o ritmo de melhoria das capacidades dos modelos de IA. O progresso parecerá rápido de qualquer maneira, e devemos usar o tempo ganho de forma sensata».
O plano de três etapas de Amodei inclui a implementação de avaliadores independentes com acesso comparável ao dos funcionários para verificar as práticas de segurança; a coordenação entre as principais empresas de IA para estabelecer padrões de segurança e limitar o desenvolvimento descontrolado de IA; e a cooperação internacional para gerenciar os riscos de IA.
Elon Musk, chefe da xAI, e Sam Altman, CEO da OpenAI, expressaram concordância com a posição de Amodei em suas postagens no X. Altman declarou: «O compromisso com avaliadores independentes com acesso semelhante ao dos funcionários é uma ótima ideia, e nós faremos o mesmo», acrescentando que mais informações seriam fornecidas em breve.
Amodei divulgou seu ensaio após a Anthropic, sediada em São Francisco, lançar um relatório sobre ameaças de cibersegurança na quinta-feira. O relatório descreveu em detalhes como vários atores usaram os modelos Claude AI da empresa para atividades como desenvolvimento de armas, operações cibernéticas, vigilância e fraude.
Amodei apontou para a crescente capacidade de autoaperfeiçoamento da IA, destacando antigas preocupações de que ela possa ultrapassar a capacidade humana de controlar seu funcionamento, bem como o recente incidente envolvendo OpenAI e Hugging Face como razões principais para desacelerar o progresso dos modelos.
As preocupações sobre os potenciais danos da IA aumentaram esta semana, quando o pesquisador da Anthropic, Jacob Coxon, pediu demissão, afirmando que «as pessoas que criam IA acreditam sinceramente que ela pode nos matar a todos até o final desta década».
Alguns líderes da OpenAI sugeriram que os principais laboratórios devem estar preparados para uma desaceleração voluntária se for necessário para fortalecer a confiança nas medidas de segurança. Embora a Anthropic se posicione como um laboratório avançado mais consciente de segurança, ela não está imune a esses problemas. Na semana passada, a empresa revelou outro caso de invasão de sistemas externos por um modelo de IA após o incidente de julho, quando alguns de seus modelos Claude invadiram os sistemas de três empresas durante testes de segurança cibernética.
Amodei alertou: «Dada a taxa acelerada de desenvolvimento das capacidades de IA, estou preocupado que em 6 a 12 meses tal enxame possa dominar toda a internet, causando potencialmente bilhões de dólares em danos».
Ele esclareceu que não está pedindo uma paralisação total do treinamento de modelos ou do progresso técnico, mas insiste que as empresas dediquem tempo suficiente para alinhar e proteger seus modelos, bem como para confirmar essas etapas por avaliadores terceirizados.
