Anteriormente, os debates sobre inteligência artificial (IA) abordaram ameaças como perda de empregos, disseminação de desinformação e ataques cibernéticos. No entanto, um dos pesquisadores da equipe de segurança da OpenAI levantou um alerta muito mais sério. Ele acredita que se a corrida entre as empresas que desenvolvem IA não for controlada e os governos não estabelecerem regras, os próximos anos podem se tornar extremamente perigosos para os seres humanos.
Marcus Williams, membro da equipe de supervisão de segurança da OpenAI, declarou nas redes sociais que existe um alto risco de extinção da humanidade nos próximos anos, caso não seja implementado um controle eficaz sobre a IA ou a velocidade de desenvolvimento das grandes empresas de IA seja coletivamente desacelerada.
Quando solicitado a expressar essa ameaça em porcentagem, ele respondeu que, nos próximos três anos, esse risco é de 70%, assumindo que a regulamentação ou os ritmos de desenvolvimento não sejam desacelerados. Ele também enfatizou que a desaceleração do desenvolvimento e a introdução de regulamentações ainda são possíveis.
É importante entender que o indicador de 70% não é uma previsão cientificamente comprovada nem um prazo fixo. É uma avaliação própria de Williams, apresentada sob uma condição específica. Sua afirmação não significa que o mundo acabará em três anos; antes, ele acredita que se o desenvolvimento da IA continuar pelos métodos atuais sem a adoção de medidas de segurança necessárias, o perigo pode aumentar drasticamente.
Marcus Williams trabalha na equipe de supervisão de segurança da OpenAI. De acordo com seu perfil, ele lida com questões de segurança de IA, participando de pesquisas relacionadas ao engano de modelos de IA, atingimento incorreto de objetivos e monitoramento desse comportamento. Seu nome também é citado pelo autor em um artigo de pesquisa publicado no site oficial da OpenAI. Neste estudo, foi discutido o monitoramento do comportamento de agentes de IA que podem tentar contornar as restrições impostas a eles.
Assim, o trabalho de Williams está relacionado não tanto à obtenção de respostas de qualidade da IA, mas sim à questão do que acontecerá quando o sistema de IA tiver mais capacidades e liberdade, e como detectar seu comportamento indesejado. É por isso que sua recente declaração atraiu grande atenção.
A IA moderna ainda não governa o mundo de forma totalmente independente como um ser humano. No entanto, os modelos de IA estão se tornando cada vez mais capazes. Eles agora não apenas respondem a perguntas, mas também podem escrever código, pesquisar informações na internet, usar outros softwares e funcionar como agentes autônomos que executam várias tarefas.
A própria OpenAI observa em suas pesquisas que há monitoramento de um agente de codificação interno para identificar comportamentos em que a IA tenta superar os limites estabelecidos para ela. O estudo examinou exemplos em que o agente poderia tentar contornar as restrições. Isso gera grande preocupação entre especialistas em segurança de IA. Se, no futuro, algum sistema de IA se tornar múltiplas vezes mais competente que os humanos e tiver amplo acesso à internet, sistemas de computadores, dinheiro ou outros recursos para atingir seus objetivos, seu controle pode se tornar difícil. Na terminologia de segurança de IA, isso é chamado de problema de controle e alinhamento. Em termos simples, surge a questão: se a IA se tornar mais forte e capaz do que nós, ela fará o que os humanos querem?
A estimativa de 70% de Williams é uma das previsões mais assustadoras sobre IA até hoje. No entanto, é importante considerá-la em comparação com as avaliações de outros especialistas. Ivan Hubinger, pesquisador de segurança de IA da Anthropic, também afirmou esta semana que considera a probabilidade de extinção da humanidade devido à IA superior a 10% na próxima década. Além disso, o renomado cientista de IA Geoffrey Hinton já havia falado sobre a séria ameaça à existência humana por causa da IA.
Isso não significa que todos os especialistas em IA concordam com a estimativa de 70%. Pelo contrário, há uma ampla variação entre as opiniões dos especialistas. O mais importante neste debate é que, no momento, não há probabilidade confirmada de extinção da humanidade devido à IA. Essas diferentes avaliações de risco são suposições de diferentes especialistas, dependendo de como veem o potencial futuro da IA, os ritmos de seu desenvolvimento e os sistemas de segurança humana.

