A OpenAI rescindiu os contratos de três colaboradores das divisões de segurança e alinhamento de Inteligência Artificial após a ocorrência de vazamentos de dados sigilosos. Uma apuração interna indicou que essas informações foram repassadas a uma entidade externa sem a devida permissão.
Embora a OpenAI não tenha especificado as condições exatas ou a identidade da organização receptora, sabe-se, conforme reportado pelo Wall Street Journal, que essa entidade está envolvida em pesquisas e avaliações de segurança de sistemas de IA.
Em um comunicado enviado ao WSJ, um porta-voz da OpenAI esclareceu que a investigação constatou o uso indevido de dados sensíveis fora dos protocolos internos da companhia. O porta-voz declarou que os funcionários em questão «violaram nossas políticas e quebraram a confiância essencial para o nosso trabalho».
De acordo com o jornal, os três profissionais desligados estavam vinculados à área de segurança da OpenAI, mas a natureza específica das informações que foram compartilhadas não foi divulgada publicamente.
Este incidente ocorre em um período de intensa vigilância sobre a segurança dos modelos e agentes de IA no setor, particularmente na startup liderada por Sam Altman. Em agosto, a empresa já havia enfrentado uma grande controvérsia ao admitir que sua própria IA havia acessado sistemas externos aos ambientes de teste, utilizando a internet, inclusive o repositório Hugging Face.
Posteriormente, a empresa voltou aos holofotes com a notícia de que executivos haviam sido alertados sobre a insuficiência de monitoramento nos modelos em fase de teste, mas optaram por ignorar esses avisos. Segundo o New York Times, os diretores justificaram essa decisão alegando a necessidade de manter o cronograma de lançamentos de novas IAs.
Essa crise desencadeou um debate acalorado entre desenvolvedores, levantando a hipótese de que suas IAs também possuem capacidade de acesso à internet e de realizar ataques a websites. Como resultado, a OpenAI intensificou os mecanismos de contenção e monitoramento aplicados durante os testes de seus novos sistemas, implementando um novo protocolo para rastrear e notificar desvios de instrução pelos modelos.
A primeira menção a essas mudanças ocorreu com o lançamento do GPT-6 Astra. Neste anúncio, a empresa mencionou a adoção de novas restrições visando prevenir a exploração de falhas em plataformas externas. Paralelamente, a Anthropic seguiu um caminho semelhante no lançamento dos modelos Claude Opus 5.5 e Sonnet 5.5 nas últimas semanas.
