D
DeepSeek V4 Flash
DeepSeek · Veröffentlicht Juli 2026
Empfohlen
DeepSeeks Volumen-Open-Weight-Modell mit 284B Parametern (13B aktive MoE) und 1M-Token-Kontextfenster. Liefert SWE-bench Verified 79,0 % zu 0,14 $/0,28 $ pro 1M Token — günstiger als jede westliche frontier-nahe API um Faktor 7–107. MIT-lizenziert für Self-Hosting auf einer einzelnen H100 oder 2× A100s. Das stärkste Wertversprechen in der KI.
Ist es das Richtige für dich?
Gut für
- Hochvolumige Pipelines — Klassifikation, Extraktion, Zusammenfassung und strukturierte Output-Aufgaben zu den niedrigsten Kosten in der Frontier-nahen KI
- Kostensensitives Coding und agentische Workflows — SWE-bench Verified 79,0 % zu $0,14/$0,28 und schlaegt damit Modelle, die 10-100x teurer sind
- Self-Hosting-Deployments auf moderater Hardware — passt auf eine einzelne H100 oder 2x A100 mit INT4-Quantisierung
Nicht geeignet für
- Schwierigste Reasoning- und mehrschrittige agentische Aufgaben — V4 Pro ($0,435/$0,87) oder westliche Flaggschiffe fuehren bei anhaltend komplexem Reasoning
- Vision-/Multimodal-Workloads — reines Textmodell
Preise
Eingabe
$0.14 / 1M tokens
Ausgabe
$0.28 / 1M tokens
Kontext
1M tokens
Benchmarks
Noch keine Urteilsänderungen
Die Uhr läuft ab dem ersten Tag — Änderungen erscheinen hier, sobald sich unser Urteil weiterentwickelt.
Quellen
- AI Pricing Guru — DeepSeek API PricingJuli 2026
- Design for Online — V4 Flash ReviewJuli 2026
- Requesty — DeepSeek V4 Flash Specs & BenchmarksJuli 2026
- BenchLM — DeepSeek API Pricing: V4 Pro & Flash RatesJuli 2026
- Tech Jacks Solutions — Running DeepSeek V4 Cost-EffectivelyJuli 2026
- NVIDIA Build — deepseek-v4-pro Model CardJuli 2026
Prüfprotokoll
- Preise— Keine Änderungen
Automatisierter Agent