A DeepSeek aposentou o V4 Flash no dia em que lançou o V4.1-Flash. Tudo o que chama deepseek-v4-flash já roda no modelo novo

DeepSeek logoDeepSeekImportante18 de setembro de 2026Modelos
O que aconteceu
DeepSeek released V4.1 Flash (552B MoE, open weights) on 10 September and retired V4 Flash, routing the deepseek-v4-flash id to the new model at $0.15/$0.60 per 1M off-peak.
Porque é importante
Anyone calling deepseek-v4-flash is silently running a different model: V4 Flash's recommended rating does not transfer, and we rate V4.1 Flash conditional.
O que fazer
Set your model to deepseek-flash, re-run evals on anything that called the old id since 10 September, and leave V4 Pro workloads where they are.

Se o seu código chama deepseek-v4-flash, você já não está rodando o modelo que avaliamos. A DeepSeek aposentou o DeepSeek V4 Flash em 10 de setembro e apontou o id antigo para o DeepSeek V4.1 Flash, um modelo diferente e maior. Troque o nome do modelo para deepseek-flash e rode suas avaliações de novo. O status de recomendado do V4 Flash não passa para o novo modelo: classificamos o V4.1 Flash como condicional. O DeepSeek V4 Pro mantém sua ficha e sua classificação.

O que aconteceu

O post de lançamento da DeepSeek, datado de 2026/09/10, é explícito:

O V4-Flash e o V4-Flash-Vision-Exp foram aposentados. Por compatibilidade, deepseek-v4-flash e deepseek-v4-flash-vision-exp são roteados temporariamente para o V4.1-Flash.

A página de preços diz o mesmo sobre a cobrança: os nomes antigos continuam sendo aceitos, e suas requisições são atendidas pelo DeepSeek-V4.1-Flash e cobradas pelo preço do Flash.

"Temporariamente" não vem com data de término. Trate o alias como algo que vai deixar de funcionar.

O que o post de lançamento da DeepSeek diz sobre o novo modelo:

  • Tamanho. Um "MoE de 552B de parâmetros" sobre uma "nova arquitetura Causal Encoder–Decoder: apenas 8B de parâmetros ativos na entrada e 16B na saída". O V4 Flash tinha 284B de parâmetros, com 13B ativos, segundo nossa ficha do V4 Flash.
  • Memória. O cache KV precisa de "1/4 da HBM" e de "1/8 do armazenamento em SSD" da geração anterior.
  • Modalidade. Suporte multimodal nativo (compreensão visual) na API.
  • Pesos. Publicados em huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash(abre num novo separador). O post de lançamento não cita nenhuma licença, então leia o model card antes de supor que os termos MIT do V4 Flash continuam valendo.
  • Nome. Configure seu modelo como deepseek-flash.

Por que isso importa

Mesmo id, outro modelo. Toda chamada a deepseek-v4-flash desde 10 de setembro foi respondida pelo V4.1 Flash. Avaliações, prompts e orçamentos de saída ajustados no V4 Flash descrevem um modelo que já não atende tráfego.

O alias ficou mais barato. Por 1M de tokens, fora do pico / no pico, segundo a página de preços da DeepSeek, comparado às tarifas do V4 Flash que reverificamos em 9 de setembro:

V4.1 Flash (deepseek-flash)V4 Flash, aposentado
Entrada, cache missUS$ 0,15 / US$ 0,30US$ 0,22 / US$ 0,44
SaídaUS$ 0,60 / US$ 1,20US$ 0,66 / US$ 1,32

Isso dá cerca de 32% a menos na entrada e cerca de 9% a menos na saída. Os acertos de cache custam US$ 0,003 fora do pico e US$ 0,006 no pico. O contexto é de 1M de tokens, a saída máxima é de 384K e a concorrência é de 2.500. A janela de pico não mudou: das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta.

Mais barato não quer dizer comprovado. A DeepSeek afirma que "testes de várias partes colocam o V4.1-Flash à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução". O post de lançamento não diz quais são essas partes nem publica números, e nós mesmos ainda não rodamos o V4.1 Flash. É por isso que nossa ficha do V4.1 Flash o classifica como condicional: os resultados de destaque como agente de programação vêm da própria DeepSeek, e o horário de pico dobra a tarifa.

V4 Pro: não estamos noticiando uma aposentadoria. As duas páginas da DeepSeek continuam se contradizendo. O post de lançamento diz que, a partir das 04:00 UTC de 14 de setembro, todas as requisições a deepseek-v4-pro passam a ser roteadas para o V4.1-Flash pelas tarifas do V4.1-Flash, "até o lançamento do V4.1-Pro". A página de preços diz o contrário: "Decidimos continuar oferecendo os serviços de API do DeepSeek V4 Pro após 14 de setembro de 2026, com o método de cobrança inalterado", e ainda lista deepseek-v4-pro a US$ 0,66 / US$ 1,98 fora do pico. Seguimos a página de preços até que a DeepSeek concilie a própria documentação.

O que muda para você

  • Renomeie o modelo. Troque deepseek-v4-flash por deepseek-flash agora, antes que o alias temporário deixe de funcionar sem aviso.
  • Rode suas avaliações de novo em qualquer pipeline que tenha chamado deepseek-v4-flash ou deepseek-v4-flash-vision-exp desde 10 de setembro.
  • Recalcule os orçamentos de lote a US$ 0,15 de entrada e US$ 0,60 de saída por 1M fora do pico, valores que dobram na janela de pico dos dias úteis.
  • Hospeda o modelo por conta própria? Leia o model card do V4.1 Flash para conferir a licença e os requisitos de hardware; um modelo de 552B não se dimensiona como um de 284B.
  • Deixe as cargas de trabalho do V4 Pro onde estão. A página de preços diz que o serviço de API dele continua após 14 de setembro.

Nossa ficha do V4 Flash mantém o status de recomendado como registro do modelo aposentado; os preços listados nela agora mostram as tarifas do V4.1 Flash, que é como o id antigo é cobrado.

FAQ

O deepseek-v4-flash ainda funciona? Sim, por enquanto. A DeepSeek o roteia para o V4.1 Flash e o cobra pelo preço do Flash, mas diz que esse roteamento é temporário e não dá data de término.

O status de recomendado do V4 Flash vale para o V4.1 Flash? Não. Classificamos o V4.1 Flash como condicional, separadamente do V4 Flash aposentado.

O V4 Pro vai ser aposentado? Não segundo a página de preços da DeepSeek, que diz que o serviço de API do V4 Pro continua após 14 de setembro de 2026 com a cobrança inalterada. O post de lançamento diz o contrário, então fique de olho em uma correção.

O que fazer

  1. 1 Change the model name from deepseek-v4-flash to deepseek-flash; DeepSeek calls the old-id routing temporary and gives no end date.
  2. 2 Re-run your evals on any pipeline that called deepseek-v4-flash or deepseek-v4-flash-vision-exp since 10 September: the outputs came from a different model.
  3. 3 Re-price batch budgets at $0.15 input and $0.60 output per 1M off-peak, doubling 01:00-04:00 and 06:00-10:00 UTC on weekdays.
  4. 4 If you self-host, read the V4.1 Flash model card for the licence and hardware needs before assuming V4 Flash's terms or sizing carry over.
  5. 5 Do not migrate V4 Pro workloads on the strength of the launch post: DeepSeek's pricing page says V4 Pro API service continues after 14 September.

Ferramentas e modelos afetados

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.