A versão oficial do DeepSeek-V4-Flash, um modelo leve com 304 bilhões de parâmetros, foi lançada pela DeepSeek em 2 de agosto. Esta versão demonstra uma superioridade significativa sobre a versão preliminar V4-Pro após um ajuste fino mínimo e atinge um nível de desempenho comparável ao Claude Opus-4.8.
Os pesos do modelo foram abertos para a comunidade e imediatamente ocuparam o segundo lugar nas tendências do HuggingFace, ficando atrás apenas de Kimi K3. De acordo com os benchmarks da comunidade, o modelo apresentou um desempenho de 82,7 com um custo de apenas US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída, oferecendo uma relação custo-benefício significativamente melhor do que os principais modelos fechados.
Testes independentes na plataforma VulcanBench colocaram o DeepSeek-V4-Flash em primeiro lugar, superando o Claude Fable 5. Este lançamento foi amplamente reconhecido na indústria como o 'terceiro momento DeepSeek', seguindo o DeepSeek-R1, que desencadeou uma primeira revisão global dos preços de IA em janeiro de 2025, e o ciclo de lançamento do K3, que mudou o cenário dos pesos abertos.
A versão oficial do V4-Flash foi analisada usando a nova estrutura DeepSeek Harness — um conjunto de ferramentas desenvolvido para avaliação estruturada de tarefas de engenharia de agentes de software. O framework Harness fornece interfaces padronizadas para verificar a conformidade do contrato da ferramenta, vincular evidências a conclusões e fluxos de trabalho de verificação, indicando a expansão das atividades da DeepSeek além do simples lançamento de modelos para a infraestrutura de codificação de IA.
A metodologia de teste usada para confirmar o desempenho do V4-Flash também se baseou no DeepSeek Harness, sugerindo que a empresa desenvolveu uma camada de orquestração e avaliação de agentes que poderia servir de base para o futuro produto DeepSeek Code. O mercado de codificação de IA pode sofrer mudanças fundamentais se a DeepSeek combinar as capacidades do modelo de classe V4 com um framework de avaliação aberto e precificação agressiva.
Além disso, o lançamento confirmou que a versão oficial do DeepSeek-V4-Pro está em desenvolvimento. Dado que a versão leve Flash já se aproxima do desempenho de sistemas fechados avançados, espera-se que o modelo completo Pro aumente significativamente os indicadores de capacidade. A DeepSeek ainda não anunciou prazos para o lançamento oficial do V4-Pro. A empresa continua sua estratégia de abertura de pesos com manutenção de preços competitivos, tornando a DeepSeek um ponto de referência para o ecossistema chinês de IA de código aberto e um ponto de preço no mercado global de API.
Este terceiro momento DeepSeek reflete o ritmo acelerado de lançamento de modelos chineses de pesos abertos. O Kimi K3, com 2,8 trilhões de parâmetros, estabelece o teto de escala para código aberto; o MiniMax H3 introduziu geração com funcionalidade modal completa por um terço do preço dos concorrentes, e agora o DeepSeek-V4-Flash demonstra que um modelo de 304 bilhões de parâmetros, submetido a treinamento disciplinado, pode se aproximar do desempenho de ponta. A convergência de pesos abertos, ferramentas Harness e precificação agressiva intensifica a pressão competitiva sobre fornecedores de soluções fechadas e muda a abordagem dos desenvolvedores na escolha de provedores de modelos. A versão oficial do DeepSeek-V4-Flash com pesos abertos e o framework Harness pode marcar a transição da DeepSeek de laboratório de pesquisa para um jogador completo na área de infraestrutura de IA, com a codificação de IA posicionada como o próximo campo de batalha onde convergem as capacidades do modelo, a infraestrutura de avaliação e a experiência do usuário do desenvolvedor.