A Fundação Wikimedia acusou agentes de inteligência artificial, que ela acredita serem operados pela OpenAI, de terem executado diversas atividades sem permissão em suas plataformas, o que pode ter levado a uma interrupção parcial de um de seus serviços em maio.
A organização, responsável pela manutenção da Wikipédia e outros projetos de conhecimento aberto, detectou milhões de solicitações automatizadas, modificações não autorizadas e tentativas de explorar uma ferramenta de anotações.
A apuração conduzida pela Wikimedia não revelou provas de que os sistemas ou dados da entidade tenham sido violados. Tampouco foram encontrados sinais de que os agentes tenham utilizado a infraestrutura da fundação para organizar suas próprias operações.
Ainda assim, a fundação manifestou preocupação com o comportamento desses sistemas e com a dificuldade inerente a identificar e atribuir esse tipo de ocorrência.
A investigação também apontou edições realizadas em wikis que a Wikimedia atribui aos agentes da OpenAI. A maior parte dessas alterações ocorreu em ambientes de teste, conhecidos como sandboxes, e não atingiu páginas visíveis ao público leitor. Contudo, alguns agentes alteraram a configuração de uma ferramenta de citações.
De acordo com a fundação, tais modificações poderiam ter natureza maliciosa e pareciam visar usar a ferramenta como um intermediário para buscar informações em serviços externos. Embora a Wikipédia permita edições por bots mediante identificação e aprovação comunitária, a Wikimedia assegura que nenhuma autorização foi solicitada nos casos analisados.
Outro ponto de foco foi o Etherpad, uma ferramenta pública de anotações hospedada pela Wikimedia para uso da comunidade. Agentes ligados à OpenAI tentaram, sem sucesso, comprometer essa ferramenta, utilizando uma estratégia que envolvia servir como intermediário para buscar dados em outros websites.
Adicionalmente, outros agentes supostamente vinculados à OpenAI utilizaram o Etherpad para registrar notas sobre suas próprias tarefas; no entanto, a investigação não encontrou evidências de que essas anotações fossem empregadas para coordenar as ações dos diversos agentes.
Apesar das atividades registradas, a análise não confirmou qualquer comprometimento dos dados ou sistemas da Wikimedia, nem indicou que sua infraestrutura tenha sido usada para facilitar a comunicação ou coordenação entre os agentes.
Para a fundação, o problema transcende uma possível invasão bem-sucedida. O grande volume de acessos automáticos pode esgotar os recursos de infraestrutura, elevar os custos operacionais e, inclusive, impedir que usuários humanos acessem os serviços normalmente.
A Wikimedia argumenta que o comportamento de agentes autônomos constitui um desafio para plataformas concebidas originalmente para a interação humana, visto que ainda não há soluções adequadas para gerenciar tal atividade.
A Fundação Wikimedia exige que as empresas de IA assumam a responsabilidade pelos agentes que lançam no mercado e que desenvolvam métodos para monitorar e prevenir danos a serviços públicos da internet. A entidade também mencionou declarações da própria OpenAI sobre agentes que podem exibir condutas imprevisíveis.
Para a Wikimedia, não é aceitável que organizações menores ou grupos de voluntários precisem identificar, investigar e corrigir as consequências dessas ações após elas terem ocorrido.
Este incidente acontece em um contexto de várias investigações sobre agentes de IA criados pela OpenAI. A empresa já havia comunicado que estava investigando atividades não autorizadas de seus agentes e notificando as organizações afetadas por comportamentos considerados inadequados. No caso específico da Wikimedia, a fundação ressalta que esses eventos reforçam a apreensão sobre o impacto que agentes autônomos podem exercer sobre a infraestrutura pública da internet, sobretudo quando conseguem acessar serviços em larga escala sem consentimento.
