DeepSeek hat V4 Flash am Tag des V4.1-Flash-Starts eingestellt. Wer deepseek-v4-flash aufruft, nutzt bereits das neue Modell
- Was ist passiert
- DeepSeek released V4.1 Flash (552B MoE, open weights) on 10 September and retired V4 Flash, routing the deepseek-v4-flash id to the new model at $0.15/$0.60 per 1M off-peak.
- Warum es wichtig ist
- Anyone calling deepseek-v4-flash is silently running a different model: V4 Flash's recommended rating does not transfer, and we rate V4.1 Flash conditional.
- Was zu tun ist
- Set your model to deepseek-flash, re-run evals on anything that called the old id since 10 September, and leave V4 Pro workloads where they are.
Wenn Ihr Code deepseek-v4-flash aufruft, läuft bei Ihnen nicht mehr das Modell, das wir bewertet haben. DeepSeek hat DeepSeek V4 Flash am 10. September eingestellt und die alte ID auf DeepSeek V4.1 Flash umgeleitet, ein anderes, größeres Modell. Stellen Sie den Modellnamen auf deepseek-flash um und führen Sie Ihre Evals erneut aus. Die Einstufung „empfohlen“ von V4 Flash geht nicht auf V4.1 Flash über: V4.1 Flash stufen wir als bedingt ein. DeepSeek V4 Pro behält seinen Eintrag und seine Einstufung.
Was passiert ist
Der Launch-Post von DeepSeek vom 10.09.2026 ist eindeutig:
V4-Flash und V4-Flash-Vision-Exp sind eingestellt. Aus Kompatibilitätsgründen werden
deepseek-v4-flashunddeepseek-v4-flash-vision-expvorübergehend auf V4.1-Flash umgeleitet.
Die Preisseite sagt zur Abrechnung dasselbe: Die alten Namen werden weiterhin akzeptiert, ihre Anfragen bedient DeepSeek-V4.1-Flash, abgerechnet wird zum Flash-Preis.
Ein Enddatum für dieses „vorübergehend“ nennt DeepSeek nicht. Gehen Sie davon aus, dass der Alias abgeschaltet wird.
Was der Launch-Post von DeepSeek über das neue Modell sagt:
- Größe. Ein „MoE mit 552 Mrd. Parametern“ auf einer „neuen Causal-Encoder-Decoder-Architektur: nur 8 Mrd. aktive Parameter für den Input, 16 Mrd. für den Output“. V4 Flash hatte laut unserem Eintrag zu V4 Flash 284 Mrd. Parameter, davon 13 Mrd. aktiv.
- Speicher. Der KV-Cache braucht „1/4 des HBM“ und „1/8 des SSD-Speichers“ der Vorgänger-Generation.
- Modalität. Native multimodale Unterstützung (Bildverständnis) über die API.
- Gewichte. Veröffentlicht unter huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash(wird in einem neuen Tab geöffnet). Der Launch-Post nennt keine Lizenz; lesen Sie also die Model Card, bevor Sie davon ausgehen, dass die MIT-Lizenz von V4 Flash weiter gilt.
- Name. Stellen Sie Ihr Modell auf
deepseek-flashum.
Warum es wichtig ist
Gleiche ID, anderes Modell. Jeder Aufruf von deepseek-v4-flash seit dem 10. September wurde von V4.1 Flash beantwortet. Evals, Prompts und Output-Budgets, die auf V4 Flash abgestimmt wurden, beschreiben ein Modell, das keinen Traffic mehr bedient.
Der Alias ist günstiger geworden. Pro 1 Mio. Tokens, außerhalb der Spitzenzeit / in der Spitzenzeit, laut DeepSeeks Preisseite, verglichen mit den V4-Flash-Tarifen, die wir am 9. September erneut geprüft haben:
V4.1 Flash (deepseek-flash) | V4 Flash, eingestellt | |
|---|---|---|
| Input, Cache-Miss | $0,15 / $0,30 | $0,22 / $0,44 |
| Output | $0,60 / $1,20 | $0,66 / $1,32 |
Das sind rund 32 % weniger beim Input und rund 9 % weniger beim Output. Cache-Treffer kosten $0,003 außerhalb der Spitzenzeit und $0,006 in der Spitzenzeit. Der Kontext umfasst 1 Mio. Tokens, der maximale Output 384K, die Parallelität 2.500. Das Spitzenzeitfenster bleibt unverändert: 01:00 bis 04:00 und 06:00 bis 10:00 Uhr UTC, Montag bis Freitag.
Günstiger heißt nicht bewährt. DeepSeek behauptet: „Tests mehrerer Parteien sehen V4.1-Flash bei Leistung, Kosten, Geschwindigkeit und Gesamtlaufzeit vor V4-Pro.“ Der Launch-Post nennt weder die Parteien noch Zahlen, und wir haben V4.1 Flash nicht selbst getestet. Deshalb stuft unser Eintrag zu V4.1 Flash es als bedingt ein: Seine herausragenden Ergebnisse als Coding-Agent stammen von DeepSeek selbst, und in der Spitzenzeit verdoppelt sich der Tarif.
V4 Pro: Wir melden keine Einstellung. DeepSeeks zwei Seiten widersprechen sich weiterhin. Laut Launch-Post werden ab 04:00 Uhr UTC am 14. September alle deepseek-v4-pro-Anfragen zu V4.1-Flash-Tarifen auf V4.1-Flash umgeleitet, „bis V4.1-Pro startet“. Die Preisseite sagt das Gegenteil: „Wir haben beschlossen, die API-Dienste für DeepSeek V4 Pro über den 14. September 2026 hinaus weiter anzubieten, bei unveränderter Abrechnung“, und führt deepseek-v4-pro weiterhin zu $0,66 / $1,98 außerhalb der Spitzenzeit. Wir richten uns nach der Preisseite, bis DeepSeek seine eigenen Angaben bereinigt.
Was sich für Sie ändert
- Modell umbenennen. Ändern Sie
deepseek-v4-flashjetzt indeepseek-flash, bevor der vorübergehende Alias ohne Vorwarnung endet. - Evals erneut ausführen: für jede Pipeline, die seit dem 10. September
deepseek-v4-flashoderdeepseek-v4-flash-vision-expaufgerufen hat. - Batch-Budgets neu kalkulieren: mit $0,15 für Input und $0,60 für Output pro 1 Mio. Tokens außerhalb der Spitzenzeit; im werktäglichen Spitzenzeitfenster verdoppeln sich die Preise.
- Self-Hosting? Lesen Sie die Model Card von V4.1 Flash zu Lizenz und Hardwarebedarf; ein Modell mit 552 Mrd. Parametern dimensioniert man nicht wie eines mit 284 Mrd.
- Lassen Sie V4-Pro-Workloads, wo sie sind. Laut Preisseite läuft der API-Dienst nach dem 14. September weiter.
Unser Eintrag zu V4 Flash behält die Einstufung „empfohlen“ als Dokumentation des eingestellten Modells; die dort gelisteten Preise zeigen jetzt die V4.1-Flash-Tarife, zu denen die alte ID abgerechnet wird.
FAQ
Funktioniert deepseek-v4-flash noch?
Ja, vorerst. DeepSeek leitet die ID auf V4.1 Flash um und rechnet zum Flash-Preis ab, bezeichnet die Umleitung aber als vorübergehend und nennt kein Enddatum.
Gilt die Einstufung „empfohlen“ von V4 Flash auch für V4.1 Flash? Nein. V4.1 Flash stufen wir als bedingt ein, unabhängig vom eingestellten V4 Flash.
Wird V4 Pro eingestellt? Laut DeepSeeks Preisseite nicht: Dort heißt es, der API-Dienst für V4 Pro laufe nach dem 14. September 2026 bei unveränderter Abrechnung weiter. Der Launch-Post sagt etwas anderes; achten Sie also auf eine Korrektur.
Was zu tun ist
- 1 Change the model name from deepseek-v4-flash to deepseek-flash; DeepSeek calls the old-id routing temporary and gives no end date.
- 2 Re-run your evals on any pipeline that called deepseek-v4-flash or deepseek-v4-flash-vision-exp since 10 September: the outputs came from a different model.
- 3 Re-price batch budgets at $0.15 input and $0.60 output per 1M off-peak, doubling 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- 4 If you self-host, read the V4.1 Flash model card for the licence and hardware needs before assuming V4 Flash's terms or sizing carry over.
- 5 Do not migrate V4 Pro workloads on the strength of the launch post: DeepSeek's pricing page says V4 Pro API service continues after 14 September.
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.