A OpenAI anunciou nesta terça-feira, dia 22, a expansão de sua nova linha de modelos de inteligência artificial (IA) com o lançamento do GPT-6 Sol e do GPT-6 Luna. Estes modelos seguem o GPT-6 Astra, que foi apresentado pela companhia no começo de setembro, e foram criados para disponibilizar parte dos avanços da versão mais robusta, mas com custos mais baixos.
De acordo com a OpenAI, tanto Sol quanto Luna foram treinados utilizando metodologias similares às empregadas no Astra, integrando progressos em diversas áreas, tais como atividades profissionais, desenvolvimento de software, interação com computadores, precisão factual e alinhamento.
A distinção fundamental reside na proporção entre capacidade e preço. A empresa informou que otimizações realizadas no armazenamento em cache e na inferência possibilitaram uma redução de 50% nos valores de acesso via API quando comparados aos preços promocionais dos modelos GPT-5.6 equivalentes.
Desempenho em Tarefas Profissionais e de Programação
O GPT-6 Sol recebeu foco especial para aplicações profissionais e de programação. A OpenAI alega que este modelo demonstra melhorias notáveis em relação ao GPT-5.6 Sol em testes focados em agentes capazes de operar em repositórios de código reais.
No benchmark FrontierCode 1.1 Main, que avalia não só a funcionalidade do código, mas também critérios como a qualidade dos testes, a organização e a conformidade com os padrões do projeto, a empresa reportou uma evolução significativa do Sol em relação ao seu antecessor.
Em outro teste, o DeepSWE v1.1, dedicado a desafios complexos de engenharia de software em projetos práticos, o GPT-6 Sol alcançou 68,8% com esforço máximo. A OpenAI ressaltou que este resultado ficou a apenas 1,1 ponto percentual da pontuação máxima do Claude Fable 5, que foi de 69,9%, mas com um custo por tarefa aproximadamente 80% inferior.
O GPT-6 Luna também obteve um desempenho de 66,6% neste mesmo teste, conforme divulgado pela companhia. Tais funcionalidades também foram implementadas no Codex, a plataforma da OpenAI voltada para tarefas de codificação, permitindo que desenvolvedores realizem mais tarefas de codificação e utilizem agentes de IA devido aos custos reduzidos.
A OpenAI também evidenciou os resultados do GPT-6 Sol em tarefas profissionais que envolvem a utilização de múltiplas ferramentas e aplicativos. No AutomationBench, que avalia agentes em fluxos de trabalho abrangendo vendas, marketing, operações, suporte, finanças e recursos humanos, o Sol atingiu 33,2% com esforço máximo. Este índice superou o Claude Opus 5, que registrou 26,9% no teste, segundo a empresa, e o custo estimado por tarefa também foi consideravelmente menor para o Sol.
Adicionalmente, no teste denominado Agents’ Last Exam, o GPT-6 Sol alcançou 56,4% com esforço máximo. A OpenAI afirmou que este resultado ultrapassou a maior pontuação registrada pelo Claude Opus 5 na avaliação, que foi de 60%, mas com um custo 60% menor por operação.
Uso de Computadores
O manuseio de computadores é outra área onde a OpenAI destacou avanços. No teste OSWorld 2.0 offline, o GPT-6 Sol, utilizando esforço adicional, obteve 60,5%, contrastando com os 60,3% do Claude Opus 5 sob esforço médio. A OpenAI declarou que este feito foi alcançado com um custo por tarefa cerca de 80% menor.
Por sua vez, o GPT-6 Luna demonstrou superar o GPT-5.6 Sol em esforço médio no mesmo tipo de avaliação, custando aproximadamente um décimo do valor por tarefa.
Apesar das melhorias apresentadas, a OpenAI manteve o GPT-6 Astra como seu modelo de referência para tarefas relacionadas ao uso de computadores.
Além dos ganhos técnicos, Sol e Luna incorporaram alterações no estilo de comunicação estabelecido no GPT-6 Astra. A OpenAI prevê que os novos modelos fornecerão respostas mais nítidas, com diminuição de jargões, construções incomuns e detalhes considerados de baixo valor. A expectativa também inclui respostas ligeiramente mais concisas, sem prejuízo do conteúdo.
Essa alteração deve ser particularmente notável em diálogos técnicos e aqueles relacionados à programação. O lançamento de Sol e Luna acelera a expansão da família GPT-6. O primeiro modelo desta geração, o GPT-6 Astra, foi lançado no início de setembro, concentrando-se em funções como programação, pesquisa científica, uso de computadores, segurança cibernética e trabalho profissional.
Com estes modelos, a OpenAI passa a oferecer opções com distintas combinações de capacidade e custo. Enquanto o Astra permanece na linha de ponta, Sol e Luna visam democratizar parte dos recursos da nova geração para tarefas que demandam maior volume de processamento.
A introdução destes dois modelos também fortalece a estratégia da empresa de diminuir os custos operacionais de agentes e aplicações de IA, especialmente em cenários onde os sistemas necessitam executar inúmeras operações sequenciais. Sol e Luna já estão disponíveis através da OpenAI em seus produtos e na API, ampliando o acesso à nova geração de modelos.

