A DeepSeek aposentou o V4 Flash no dia em que lançou o V4.1-Flash. Tudo o que chama deepseek-v4-flash já roda no modelo novo
- O que aconteceu
- DeepSeek released V4.1 Flash (552B MoE, open weights) on 10 September and retired V4 Flash, routing the deepseek-v4-flash id to the new model at $0.15/$0.60 per 1M off-peak.
- Porque é importante
- Anyone calling deepseek-v4-flash is silently running a different model: V4 Flash's recommended rating does not transfer, and we rate V4.1 Flash conditional.
- O que fazer
- Set your model to deepseek-flash, re-run evals on anything that called the old id since 10 September, and leave V4 Pro workloads where they are.
Se o seu código chama deepseek-v4-flash, você já não está rodando o modelo que avaliamos. A DeepSeek aposentou o DeepSeek V4 Flash em 10 de setembro e apontou o id antigo para o DeepSeek V4.1 Flash, um modelo diferente e maior. Troque o nome do modelo para deepseek-flash e rode suas avaliações de novo. O status de recomendado do V4 Flash não passa para o novo modelo: classificamos o V4.1 Flash como condicional. O DeepSeek V4 Pro mantém sua ficha e sua classificação.
O que aconteceu
O post de lançamento da DeepSeek, datado de 2026/09/10, é explícito:
O V4-Flash e o V4-Flash-Vision-Exp foram aposentados. Por compatibilidade,
deepseek-v4-flashedeepseek-v4-flash-vision-expsão roteados temporariamente para o V4.1-Flash.
A página de preços diz o mesmo sobre a cobrança: os nomes antigos continuam sendo aceitos, e suas requisições são atendidas pelo DeepSeek-V4.1-Flash e cobradas pelo preço do Flash.
"Temporariamente" não vem com data de término. Trate o alias como algo que vai deixar de funcionar.
O que o post de lançamento da DeepSeek diz sobre o novo modelo:
- Tamanho. Um "MoE de 552B de parâmetros" sobre uma "nova arquitetura Causal Encoder–Decoder: apenas 8B de parâmetros ativos na entrada e 16B na saída". O V4 Flash tinha 284B de parâmetros, com 13B ativos, segundo nossa ficha do V4 Flash.
- Memória. O cache KV precisa de "1/4 da HBM" e de "1/8 do armazenamento em SSD" da geração anterior.
- Modalidade. Suporte multimodal nativo (compreensão visual) na API.
- Pesos. Publicados em huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash(abre num novo separador). O post de lançamento não cita nenhuma licença, então leia o model card antes de supor que os termos MIT do V4 Flash continuam valendo.
- Nome. Configure seu modelo como
deepseek-flash.
Por que isso importa
Mesmo id, outro modelo. Toda chamada a deepseek-v4-flash desde 10 de setembro foi respondida pelo V4.1 Flash. Avaliações, prompts e orçamentos de saída ajustados no V4 Flash descrevem um modelo que já não atende tráfego.
O alias ficou mais barato. Por 1M de tokens, fora do pico / no pico, segundo a página de preços da DeepSeek, comparado às tarifas do V4 Flash que reverificamos em 9 de setembro:
V4.1 Flash (deepseek-flash) | V4 Flash, aposentado | |
|---|---|---|
| Entrada, cache miss | US$ 0,15 / US$ 0,30 | US$ 0,22 / US$ 0,44 |
| Saída | US$ 0,60 / US$ 1,20 | US$ 0,66 / US$ 1,32 |
Isso dá cerca de 32% a menos na entrada e cerca de 9% a menos na saída. Os acertos de cache custam US$ 0,003 fora do pico e US$ 0,006 no pico. O contexto é de 1M de tokens, a saída máxima é de 384K e a concorrência é de 2.500. A janela de pico não mudou: das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta.
Mais barato não quer dizer comprovado. A DeepSeek afirma que "testes de várias partes colocam o V4.1-Flash à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução". O post de lançamento não diz quais são essas partes nem publica números, e nós mesmos ainda não rodamos o V4.1 Flash. É por isso que nossa ficha do V4.1 Flash o classifica como condicional: os resultados de destaque como agente de programação vêm da própria DeepSeek, e o horário de pico dobra a tarifa.
V4 Pro: não estamos noticiando uma aposentadoria. As duas páginas da DeepSeek continuam se contradizendo. O post de lançamento diz que, a partir das 04:00 UTC de 14 de setembro, todas as requisições a deepseek-v4-pro passam a ser roteadas para o V4.1-Flash pelas tarifas do V4.1-Flash, "até o lançamento do V4.1-Pro". A página de preços diz o contrário: "Decidimos continuar oferecendo os serviços de API do DeepSeek V4 Pro após 14 de setembro de 2026, com o método de cobrança inalterado", e ainda lista deepseek-v4-pro a US$ 0,66 / US$ 1,98 fora do pico. Seguimos a página de preços até que a DeepSeek concilie a própria documentação.
O que muda para você
- Renomeie o modelo. Troque
deepseek-v4-flashpordeepseek-flashagora, antes que o alias temporário deixe de funcionar sem aviso. - Rode suas avaliações de novo em qualquer pipeline que tenha chamado
deepseek-v4-flashoudeepseek-v4-flash-vision-expdesde 10 de setembro. - Recalcule os orçamentos de lote a US$ 0,15 de entrada e US$ 0,60 de saída por 1M fora do pico, valores que dobram na janela de pico dos dias úteis.
- Hospeda o modelo por conta própria? Leia o model card do V4.1 Flash para conferir a licença e os requisitos de hardware; um modelo de 552B não se dimensiona como um de 284B.
- Deixe as cargas de trabalho do V4 Pro onde estão. A página de preços diz que o serviço de API dele continua após 14 de setembro.
Nossa ficha do V4 Flash mantém o status de recomendado como registro do modelo aposentado; os preços listados nela agora mostram as tarifas do V4.1 Flash, que é como o id antigo é cobrado.
FAQ
O deepseek-v4-flash ainda funciona?
Sim, por enquanto. A DeepSeek o roteia para o V4.1 Flash e o cobra pelo preço do Flash, mas diz que esse roteamento é temporário e não dá data de término.
O status de recomendado do V4 Flash vale para o V4.1 Flash? Não. Classificamos o V4.1 Flash como condicional, separadamente do V4 Flash aposentado.
O V4 Pro vai ser aposentado? Não segundo a página de preços da DeepSeek, que diz que o serviço de API do V4 Pro continua após 14 de setembro de 2026 com a cobrança inalterada. O post de lançamento diz o contrário, então fique de olho em uma correção.
O que fazer
- 1 Change the model name from deepseek-v4-flash to deepseek-flash; DeepSeek calls the old-id routing temporary and gives no end date.
- 2 Re-run your evals on any pipeline that called deepseek-v4-flash or deepseek-v4-flash-vision-exp since 10 September: the outputs came from a different model.
- 3 Re-price batch budgets at $0.15 input and $0.60 output per 1M off-peak, doubling 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- 4 If you self-host, read the V4.1 Flash model card for the licence and hardware needs before assuming V4 Flash's terms or sizing carry over.
- 5 Do not migrate V4 Pro workloads on the strength of the launch post: DeepSeek's pricing page says V4 Pro API service continues after 14 September.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.