Laboratórios de inteligência artificial chineses agora ocupam as quatro primeiras posições na tabela global de uso de tokens de modelos. De acordo com os dados mais recentes do OpenRouter, no período de 3 a 9 de agosto, o uso mundial total de modelos atingiu 69 trilhões de tokens, um aumento de 21,48% em comparação com a semana anterior. Os modelos chineses forneceram 34,25 trilhões desse volume total, enquanto os modelos americanos somaram 9,17 trilhões. Esta é a décima quinta semana consecutiva em que os modelos chineses lideram o ranking mundial.
Uma análise mais detalhada da tabela mostra um quadro mais complexo. A versão oficial do DeepSeek-V4-Flash-0731 assumiu o primeiro lugar com 8,83 trilhões de tokens, representando um aumento de 570% em relação à semana passada. A Tencent Hy3 ficou em segundo lugar com 8,05 trilhões de tokens, demonstrando um crescimento de 67%. A versão de pré-visualização do DeepSeek-V4-Flash-0423 caiu para a terceira posição com 5,88 trilhões de tokens, e a Xiaomi MiMo-V2.5 ocupou o quarto lugar com 5,39 trilhões de tokens. Assim, os quatro principais lugares mundiais são agora ocupados por laboratórios chineses.
O lançamento oficial do DeepSeek ocorreu em 31 de julho. A estrutura do modelo e o número de parâmetros permaneceram inalterados em comparação com a versão preliminar, mas a receita de pós-treinamento foi reiniciada do zero. O resultado foi uma melhoria significativa nos indicadores de testes matemáticos e de código, o que explica a rápida migração de tráfego de desenvolvedores. De acordo com a Artificial Analysis, o V4-Flash oficial agora executa o teste de tarefa única com um custo médio de US$ 0,03, o que é aproximadamente cem vezes mais barato que o Claude Fable 5 de ponta da Anthropic, tornando-o o modelo grande mais barato do mundo.
Observa-se também uma mudança de posições. O modelo MiniMax M3, que estava em sétimo lugar na semana passada, bem como o Stepfun Step 3.7 Flash, que estava em nono, deixaram o top dez no ranking atual. O GPT-5.6 Luna da OpenAI entrou no top cinco com 4,43 trilhões de tokens, mostrando um aumento de 128% após a empresa reduzir o preço das cargas de trabalho corporativas em 80%. O Gemini 3.6 Flash do Google entrou pela primeira vez no top dez com 2,33 trilhões de tokens, aumentando 446% em comparação com a semana passada.
A conclusão estrutural é que os modelos abertos chineses passaram de vantagem de preço para vantagem de uso. Quinze semanas de liderança mundial sustentada, posse de quatro dos quatro melhores lugares e um modelo de ponta com um custo de uma centésima parte — tudo isso aponta para a mesma conclusão: o stack chinês de código aberto não compete mais apenas pelo preço. Ele compete em uma combinação de preço, largura de banda e qualidade de benchmarks, e vence em todos os três parâmetros.

