A DeepSeek iniciou uma transição operacional da API que é mais importante para questões de faturamento e continuidade de identificadores de modelos do que para o lançamento de um novo produto. A partir das 04:00 UTC de 14 de setembro de 2026 (meio-dia no horário de Pequim), cada solicitação enviada ao identificador de modelo obsoleto deepseek-v4-pro será redirecionada para DeepSeek-V4.1-Flash e tarifada pelas taxas V4.1-Flash.
A empresa informa que este redirecionamento permanecerá em vigor até o lançamento do DeepSeek-V4.1-Pro. Assim, as integrações que utilizam o rótulo Pro continuarão a funcionar sem necessidade de alterações no código, embora o modelo base e a tabela de preços mudem por baixo deles.
Este passo difere do lançamento geral do V4.1-Flash, que ocorreu em 10 de setembro. Este lançamento apresentou o membro menor da nova família arquitetônica DeepSeek — um design tipo mixture-of-experts com 552 bilhões de parâmetros, com cerca de 8 bilhões de parâmetros ativos na entrada e 16 bilhões na saída. Ele também inclui suporte nativo multimodal e composição Causal Encoder–Decoder. As notas oficiais também anunciaram a retirada dos modelos V4-Flash e V4-Flash-Vision-Exp como produtos separados; para garantir a compatibilidade, os identificadores deepseek-v4-flash e deepseek-v4-flash-vision-exp agora apontam para V4.1-Flash. Para novas integrações, recomenda-se usar o identificador deepseek-flash no endpoint de API DeepSeek inalterado.
A segunda parte da transição diz respeito à precificação. A DeepSeek afirma que testes realizados por várias partes mostraram que o V4.1-Flash supera o V4-Pro em desempenho, custo, velocidade e tempo total de execução, portanto, a empresa está desativando gradualmente o V4-Pro como um modelo servido separadamente. Após a mudança em 14 de setembro, o tráfego com o rótulo Pro herdará as tabelas de preços Flash (tanto de pico quanto fora de pico), com as taxas fora de pico permanecendo metade das taxas de pico, em vez dos cronogramas Pro mais altos que estavam em vigor antes do redirecionamento. As equipes que mantêm o deepseek-v4-pro em funcionamento recebem automaticamente a economia Flash, mas perdem a suposição de que o identificador Pro ainda corresponde aos pesos ou perfil de latência Pro anteriores. Todas as entradas com acerto e falha no cache, bem como os tokens de saída, seguem o cronograma Flash após a mudança de roteamento.
A DeepSeek ainda não publicou uma data de lançamento agendada para o V4.1-Pro. Até esse momento, o alias Pro serve como uma ponte temporária, e não como um serviço de manutenção congelado. Parceiros oficiais da WorkBuddy, incluindo CodeBuddy, e OpenCode já suportam o V4.1-Flash. Para os operadores, a lista prática de tarefas é limitada: é necessário realizar testes de regressão privados contra deepseek-flash antes ou imediatamente após a mudança UTC, atualizar o monitoramento para que os logs e painéis de custos reflitam o modelo servido, e considerar deepseek-v4-pro como um roteamento obsoleto até o lançamento do V4.1-Pro. O tema principal hoje é a infraestrutura da API — quem responde ao identificador Pro, a qual taxa e por quanto tempo — e não a segunda passagem narrativa sobre o GA Flash.


