DeepSeek a retiré V4 Flash le jour du lancement de V4.1-Flash. Tout appel à deepseek-v4-flash est déjà servi par le nouveau modèle
- Ce qui s’est passé
- DeepSeek released V4.1 Flash (552B MoE, open weights) on 10 September and retired V4 Flash, routing the deepseek-v4-flash id to the new model at $0.15/$0.60 per 1M off-peak.
- Pourquoi c’est important
- Anyone calling deepseek-v4-flash is silently running a different model: V4 Flash's recommended rating does not transfer, and we rate V4.1 Flash conditional.
- Que faire
- Set your model to deepseek-flash, re-run evals on anything that called the old id since 10 September, and leave V4 Pro workloads where they are.
Si votre code appelle deepseek-v4-flash, vous n'utilisez plus le modèle que nous avons évalué. DeepSeek a retiré DeepSeek V4 Flash le 10 septembre et a redirigé l'ancien identifiant vers DeepSeek V4.1 Flash, un modèle différent et plus gros. Remplacez le nom du modèle par deepseek-flash et relancez vos évaluations. Le verdict "recommandé" de V4 Flash ne vaut pas pour V4.1 Flash : nous lui attribuons le verdict conditionnel. DeepSeek V4 Pro conserve sa fiche et son verdict.
Ce qui s'est passé
Le billet de lancement de DeepSeek, daté du 2026/09/10, est explicite :
V4-Flash et V4-Flash-Vision-Exp sont retirés. Par souci de compatibilité,
deepseek-v4-flashetdeepseek-v4-flash-vision-expsont temporairement redirigés vers V4.1-Flash.
La page de tarifs dit la même chose côté facturation : les anciens noms restent acceptés, leurs requêtes sont traitées par DeepSeek-V4.1-Flash et facturées au tarif Flash.
"Temporairement", mais sans date de fin. Partez du principe que l'alias cessera de fonctionner.
Ce que le billet de lancement de DeepSeek dit du nouveau modèle :
- Taille. Un "MoE de 552 milliards de paramètres" reposant sur une "nouvelle architecture Causal Encoder–Decoder : seulement 8B paramètres actifs en entrée, 16B en sortie." V4 Flash comptait 284B paramètres dont 13B actifs, d'après notre fiche V4 Flash.
- Mémoire. Le cache KV nécessite "1/4 de la HBM" et "1/8 du stockage SSD" de la génération précédente.
- Modalité. Prise en charge multimodale native (compréhension visuelle) sur l'API.
- Poids. Publiés sur huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash(s’ouvre dans un nouvel onglet). Le billet de lancement ne mentionne aucune licence : lisez la fiche du modèle (model card) avant de supposer que les conditions MIT de V4 Flash s'appliquent toujours.
- Nom. Utilisez le nom de modèle
deepseek-flash.
Pourquoi c'est important
Même identifiant, modèle différent. Depuis le 10 septembre, chaque appel à deepseek-v4-flash a reçu sa réponse de V4.1 Flash. Les évaluations, prompts et budgets de sortie calibrés sur V4 Flash décrivent un modèle qui ne sert plus aucun trafic.
L'alias coûte moins cher. Par 1M de tokens, heures creuses / heures pleines, d'après la page de tarifs de DeepSeek, face aux tarifs de V4 Flash que nous avons revérifiés le 9 septembre :
V4.1 Flash (deepseek-flash) | V4 Flash, retiré | |
|---|---|---|
| Entrée, hors cache | $0.15 / $0.30 | $0.22 / $0.44 |
| Sortie | $0.60 / $1.20 | $0.66 / $1.32 |
Soit environ 32 % de moins en entrée et environ 9 % de moins en sortie. Les lectures en cache (cache hits) sont facturées $0.003 en heures creuses et $0.006 en heures pleines. Contexte de 1M de tokens, sortie maximale de 384K, jusqu'à 2 500 requêtes simultanées. La plage des heures pleines ne change pas : de 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi.
Moins cher ne veut pas dire éprouvé. DeepSeek affirme que "des tests menés par plusieurs parties placent V4.1-Flash devant V4-Pro en performance, coût, vitesse et durée d'exécution totale." Le billet de lancement ne nomme aucune de ces parties et ne publie aucun chiffre, et nous n'avons pas testé V4.1 Flash nous-mêmes. C'est pourquoi notre fiche V4.1 Flash lui attribue le verdict conditionnel : ses résultats remarquables en tant qu'agent de code proviennent de DeepSeek lui-même, et les heures pleines doublent le tarif.
V4 Pro : nous n'annonçons pas de retrait. Les deux pages de DeepSeek se contredisent toujours. Le billet de lancement indique qu'à partir de 04:00 UTC le 14 septembre, toutes les requêtes deepseek-v4-pro sont redirigées vers V4.1-Flash aux tarifs de V4.1-Flash, "jusqu'au lancement de V4.1-Pro". La page de tarifs affirme l'inverse : "Nous avons décidé de continuer à fournir les services API de DeepSeek V4 Pro après le 14 septembre 2026, avec un mode de facturation inchangé", et affiche toujours deepseek-v4-pro à $0.66 / $1.98 en heures creuses. Nous nous fions à la page de tarifs jusqu'à ce que DeepSeek mette sa propre documentation en cohérence.
Ce qui change pour vous
- Renommez le modèle. Remplacez
deepseek-v4-flashpardeepseek-flashdès maintenant, avant que l'alias temporaire ne disparaisse sans préavis. - Relancez vos évaluations sur tout pipeline ayant appelé
deepseek-v4-flashoudeepseek-v4-flash-vision-expdepuis le 10 septembre. - Recalculez vos budgets batch à $0.15 en entrée et $0.60 en sortie par 1M de tokens en heures creuses, le double pendant les heures pleines en semaine.
- Vous auto-hébergez ? Lisez la model card de V4.1 Flash pour la licence et les besoins matériels : un modèle de 552B ne se dimensionne pas comme un modèle de 284B.
- Laissez vos charges de travail V4 Pro en place. La page de tarifs indique que son service API continue après le 14 septembre.
Notre fiche V4 Flash conserve son verdict recommandé, en tant qu'archive du modèle retiré ; les prix qu'elle affiche correspondent désormais aux tarifs V4.1 Flash auxquels l'ancien identifiant est facturé.
FAQ
deepseek-v4-flash fonctionne-t-il encore ?
Oui, pour l'instant. DeepSeek le redirige vers V4.1 Flash et le facture au tarif Flash, mais qualifie cette redirection de temporaire et ne donne aucune date de fin.
Le verdict recommandé de V4 Flash s'applique-t-il à V4.1 Flash ? Non. Nous attribuons à V4.1 Flash le verdict conditionnel, indépendamment du V4 Flash retiré.
V4 Pro va-t-il être retiré ? Pas selon la page de tarifs de DeepSeek, qui indique que le service API de V4 Pro continue après le 14 septembre 2026 avec une facturation inchangée. Le billet de lancement dit le contraire : surveillez une éventuelle correction.
Que faire
- 1 Change the model name from deepseek-v4-flash to deepseek-flash; DeepSeek calls the old-id routing temporary and gives no end date.
- 2 Re-run your evals on any pipeline that called deepseek-v4-flash or deepseek-v4-flash-vision-exp since 10 September: the outputs came from a different model.
- 3 Re-price batch budgets at $0.15 input and $0.60 output per 1M off-peak, doubling 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- 4 If you self-host, read the V4.1 Flash model card for the licence and hardware needs before assuming V4 Flash's terms or sizing carry over.
- 5 Do not migrate V4 Pro workloads on the strength of the launch post: DeepSeek's pricing page says V4 Pro API service continues after 14 September.
Outils et modèles concernés
Ne ratez plus jamais une mise à jour
Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.