D
DeepSeek V4 Flash
DeepSeek · Sorti juil. 2026
Recommandé
Le modèle open-weight de volume de DeepSeek, 284B de paramètres (13B actifs en MoE) avec une fenêtre de contexte de 1M tokens. Offre SWE-bench Verified à 79,0 % pour 0,14 $/0,28 $ par 1M tokens — moins cher que toute API occidentale proche de la frontière par un facteur de 7 à 107×. Sous licence MIT pour auto-hébergement sur un seul H100 ou 2× A100. La proposition de valeur la plus forte en IA.
Est-ce fait pour vous ?
Recommandé pour
- Pipelines à haut débit — classification, extraction, résumé et tâches de sortie structurée au coût le plus bas de l'IA proche de la pointe
- Codage à coût maîtrisé et workflows agentiques — SWE-bench Verified 79,0 % à 0,14 $/0,28 $, battant des modèles 10 à 100x plus chers
- Déploiements auto-hébergés sur matériel modeste — tient sur un seul H100 ou 2x A100 en quantification INT4
Déconseillé pour
- Raisonnement le plus difficile et tâches agentiques multi-étapes — V4 Pro (0,435 $/0,87 $) ou les flagships occidentaux dominent sur le raisonnement complexe soutenu
- Charges vision/multimodales — modèle texte uniquement
Tarifs
Entrée
$0.14 / 1M tokens
Sortie
$0.28 / 1M tokens
Contexte
1M tokens
Tests de performance
Aucun changement de verdict pour l’instant
L’horloge tourne dès le premier jour : les changements apparaîtront ici à mesure que notre verdict évolue.
Sources
- AI Pricing Guru — DeepSeek API Pricingjuil. 2026
- Design for Online — V4 Flash Reviewjuil. 2026
- Requesty — DeepSeek V4 Flash Specs & Benchmarksjuil. 2026
- BenchLM — DeepSeek API Pricing: V4 Pro & Flash Ratesjuil. 2026
- Tech Jacks Solutions — Running DeepSeek V4 Cost-Effectivelyjuil. 2026
- NVIDIA Build — deepseek-v4-pro Model Cardjuil. 2026
Journal de vérification
- Tarifs— Aucun changement
Agent automatisé