DeepSeek retiró V4 Flash el mismo día en que lanzó V4.1-Flash. Todo lo que llama a deepseek-v4-flash ya usa el modelo nuevo
- Qué pasó
- DeepSeek released V4.1 Flash (552B MoE, open weights) on 10 September and retired V4 Flash, routing the deepseek-v4-flash id to the new model at $0.15/$0.60 per 1M off-peak.
- Por qué importa
- Anyone calling deepseek-v4-flash is silently running a different model: V4 Flash's recommended rating does not transfer, and we rate V4.1 Flash conditional.
- Qué hacer
- Set your model to deepseek-flash, re-run evals on anything that called the old id since 10 September, and leave V4 Pro workloads where they are.
Si tu código llama a deepseek-v4-flash, ya no estás usando el modelo que calificamos. DeepSeek retiró DeepSeek V4 Flash el 10 de septiembre y apuntó el antiguo id a DeepSeek V4.1 Flash, un modelo distinto y más grande. Cambia el nombre del modelo a deepseek-flash y vuelve a ejecutar tus evaluaciones. La calificación «recomendado» de V4 Flash no se traslada: a V4.1 Flash le damos condicional. DeepSeek V4 Pro conserva su ficha y su calificación.
Qué pasó
El anuncio de lanzamiento de DeepSeek, fechado el 2026/09/10, es explícito:
V4-Flash y V4-Flash-Vision-Exp quedan retirados. Por compatibilidad,
deepseek-v4-flashydeepseek-v4-flash-vision-expse redirigen temporalmente a V4.1-Flash.
La página de precios dice lo mismo sobre la facturación: los nombres antiguos se siguen aceptando, sus solicitudes las atiende DeepSeek-V4.1-Flash y se facturan al precio de Flash.
DeepSeek no pone fecha de fin a ese «temporalmente». Trata el alias como algo que dejará de funcionar.
Lo que dice el anuncio de lanzamiento de DeepSeek sobre el nuevo modelo:
- Tamaño. Un «MoE de 552 mil millones de parámetros» sobre una «nueva arquitectura Causal Encoder–Decoder: solo 8 mil millones de parámetros activos para la entrada y 16 mil millones para la salida». V4 Flash tenía 284 mil millones de parámetros, con 13 mil millones activos, según nuestra ficha de V4 Flash.
- Memoria. La caché KV necesita «1/4 de la HBM» y «1/8 del almacenamiento SSD» de la generación anterior.
- Modalidad. Soporte multimodal nativo (comprensión visual) en la API.
- Pesos. Publicados en huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash(se abre en una pestaña nueva). El anuncio no menciona ninguna licencia, así que lee la tarjeta del modelo antes de dar por hecho que se mantienen los términos MIT de V4 Flash.
- Nombre. Configura tu modelo como
deepseek-flash.
Por qué importa
Mismo id, otro modelo. Desde el 10 de septiembre, todas las llamadas a deepseek-v4-flash las ha respondido V4.1 Flash. Las evaluaciones, los prompts y los presupuestos de salida ajustados con V4 Flash describen un modelo que ya no atiende tráfico.
El alias se ha abaratado. Por 1M de tokens, en horario valle / horario punta, según la página de precios de DeepSeek, frente a las tarifas de V4 Flash que volvimos a verificar el 9 de septiembre:
V4.1 Flash (deepseek-flash) | V4 Flash, retirado | |
|---|---|---|
| Entrada, sin acierto de caché | $0.15 / $0.30 | $0.22 / $0.44 |
| Salida | $0.60 / $1.20 | $0.66 / $1.32 |
Eso supone cerca de un 32% menos en la entrada y cerca de un 9% menos en la salida. Los aciertos de caché se facturan a $0.003 en horario valle y a $0.006 en horario punta. El contexto es de 1M de tokens, la salida máxima de 384K y la concurrencia de 2500. La franja punta no cambia: de 01:00 a 04:00 y de 06:00 a 10:00 UTC, de lunes a viernes.
Más barato no es lo mismo que probado. DeepSeek afirma que «pruebas de varios evaluadores sitúan a V4.1-Flash por delante de V4-Pro en rendimiento, coste, velocidad y tiempo total de ejecución». No dice quiénes son esos evaluadores ni publica cifras en el anuncio, y nosotros no hemos probado V4.1 Flash. Por eso nuestra ficha de V4.1 Flash le da condicional: sus resultados más llamativos como agente de programación los publica la propia DeepSeek, y en horario punta la tarifa se duplica.
V4 Pro: no informamos de ninguna retirada. Las dos páginas de DeepSeek siguen contradiciéndose. El anuncio de lanzamiento dice que, desde las 04:00 UTC del 14 de septiembre, todas las solicitudes a deepseek-v4-pro se redirigen a V4.1-Flash con las tarifas de V4.1-Flash, «hasta que se lance V4.1-Pro». La página de precios dice lo contrario: «Hemos decidido seguir ofreciendo servicios de API para DeepSeek V4 Pro después del 14 de septiembre de 2026, sin cambios en el método de facturación», y sigue mostrando deepseek-v4-pro a $0.66 / $1.98 en horario valle. Nos atenemos a la página de precios hasta que DeepSeek concilie su propia documentación.
Qué cambia para ti
- Cambia el nombre del modelo. Sustituye
deepseek-v4-flashpordeepseek-flashya, antes de que el alias temporal deje de funcionar sin aviso. - Vuelve a ejecutar tus evaluaciones en cualquier pipeline que haya llamado a
deepseek-v4-flashodeepseek-v4-flash-vision-expdesde el 10 de septiembre. - Recalcula los presupuestos de procesamiento por lotes a $0.15 de entrada y $0.60 de salida por 1M en horario valle, el doble en la franja punta de los días laborables.
- ¿Lo alojas tú mismo? Lee la tarjeta del modelo de V4.1 Flash para conocer la licencia y los requisitos de hardware; un modelo de 552 mil millones de parámetros no se dimensiona como uno de 284 mil millones.
- Deja las cargas de trabajo de V4 Pro donde están. La página de precios dice que su servicio de API continúa después del 14 de septiembre.
Nuestra ficha de V4 Flash conserva su calificación «recomendado» como registro del modelo retirado; sus precios publicados muestran ahora las tarifas de V4.1 Flash con las que se factura el antiguo id.
FAQ
¿deepseek-v4-flash sigue funcionando?
Sí, por ahora. DeepSeek lo redirige a V4.1 Flash y lo factura al precio de Flash, pero califica la redirección de temporal y no da fecha de fin.
¿La calificación «recomendado» de V4 Flash se aplica a V4.1 Flash? No. A V4.1 Flash le damos condicional, de forma independiente del V4 Flash retirado.
¿Se va a retirar V4 Pro? No, según la página de precios de DeepSeek, que dice que el servicio de API de V4 Pro continúa después del 14 de septiembre de 2026 sin cambios en la facturación. El anuncio de lanzamiento dice lo contrario, así que conviene estar atento a una posible corrección.
Qué hacer
- 1 Change the model name from deepseek-v4-flash to deepseek-flash; DeepSeek calls the old-id routing temporary and gives no end date.
- 2 Re-run your evals on any pipeline that called deepseek-v4-flash or deepseek-v4-flash-vision-exp since 10 September: the outputs came from a different model.
- 3 Re-price batch budgets at $0.15 input and $0.60 output per 1M off-peak, doubling 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- 4 If you self-host, read the V4.1 Flash model card for the licence and hardware needs before assuming V4 Flash's terms or sizing carry over.
- 5 Do not migrate V4 Pro workloads on the strength of the launch post: DeepSeek's pricing page says V4 Pro API service continues after 14 September.
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.