Modelo GPT-6 Astra passou no teste CAPTCHA e recebeu um 'certificado' humano
Leia mais
Tecnoblog
tecnoblog.net

Modelo GPT-6 Astra passou no teste CAPTCHA e recebeu um 'certificado' humano

O modelo GPT-6 Astra, recentemente apresentado pela OpenAI, demonstrou a capacidade de passar em testes CAPTCHA, que são uma das principais barreiras utilizadas por plataformas online contra bots e IAs agentes.

Durante o teste, o modelo conseguiu completar todas as 48 etapas do jogo 'I am not a Robot', desenvolvido por Neil Agarwal. Esta demonstração foi publicada pelo programador Sharif Shamim, que mostrou como a IA utilizou um navegador web para resolver as tarefas até o fim, momento em que a própria página emitiu um certificado digital de 'humano verificado'.

O resultado chama a atenção porque as tarefas exigiram mais do que apenas responder a perguntas; para passar em todas as etapas, o modelo teve que interpretar elementos visuais, clicar em pontos específicos e mover objetos. Em alguns momentos, o modelo até indicou ações que Shamim deveria realizar para passar nos testes de câmera.

CAPTCHA é uma abreviatura em inglês que significa 'Completely Automated Public Turing test to tell Computers and Humans Apart', amplamente conhecida pelo aparecimento ao confirmar o acesso a uma conta ou site.

Serviços existentes podem combinar tarefas visuais com outros indicadores para identificar automação, além da análise do comportamento de acesso. No entanto, o jogo de Agarwal foi criado como uma experiência interativa e não significa que os sistemas de segurança das plataformas sejam automaticamente contornáveis por um agente. O que chama a atenção é justamente a interatividade da IA com o navegador e sua capacidade de interpretar as tarefas.

Este resultado já levou figuras como Jensen Huang, CEO da Nvidia, a declarar que a OpenAI alcançou a AGI. A capacidade demonstrada no jogo é uma das características chave apresentadas pela OpenAI no anúncio do Astra. O modelo obteve um alto desempenho no benchmark OSWorld 2.0, que mede essa interatividade, atingindo uma média de precisão de 72,6%, enquanto o GPT 5.6-Sol registrou 65,7%.

Neste sentido, a OpenAI dedicou parte da apresentação do sistema a demonstrações do Astra em software real como agente. Entre essas tarefas estavam operações no Blender, no aplicativo Notas da Apple e no Canva. Além disso, o Astra possui uma janela de contexto de cerca de 1,05 milhão de tokens, o que permite manter um histórico extenso durante sessões de uso prolongadas.

Popular