DeepSeek V4 Flash
DeepSeek · Lanzado jul 2026
El modelo de pesos abiertos de nivel de volumen de DeepSeek con 284B de parámetros (13B activos MoE) y ventana de contexto de 1M tokens. Alcanza un 79.0% en SWE-bench Verified a $0.14/$0.28 por 1M tokens: más barato que cualquier API occidental cercana a la frontera por un factor de 7 a 107 veces. Licencia MIT para autoalojamiento en una sola H100 o 2x A100. La propuesta de valor más sólida en IA: programación cercana a la frontera a precios de commodity. Úselo como caballo de batalla predeterminado para pipelines agénticos de alto rendimiento; reserve Pro para las tareas de razonamiento más exigentes.
¿Es adecuada para ti?
Bueno para
- Pipelines de alto rendimiento — clasificación, extracción, resumen y tareas de salida estructurada al costo más bajo en IA cercana a la frontera
- Programación y flujos agénticos sensibles al costo — SWE-bench Verified 79.0% a $0.14/$0.28, superando a modelos 10-100x más caros
- Despliegues autoalojados en hardware modesto — cabe en una sola H100 o 2x A100s con cuantización INT4
No recomendado para
- Razonamiento complejo y tareas agénticas de múltiples pasos — V4 Pro ($0.435/$0.87) o los buques insignia occidentales lideran en razonamiento complejo sostenido
- Cargas de trabajo de visión/multimodales — modelo solo texto
Precios
Entrada
$0.14 / 1M tokens
Salida
$0.28 / 1M tokens
Contexto
1M tokens
Pruebas de rendimiento
Aún no hay cambios de veredicto
El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.
Fuentes
- AI Pricing Guru — DeepSeek API Pricingjul 2026
- Design for Online — V4 Flash Reviewjul 2026
- Requesty — DeepSeek V4 Flash Specs & Benchmarksjul 2026
- BenchLM — DeepSeek API Pricing: V4 Pro & Flash Ratesjul 2026
- Tech Jacks Solutions — Running DeepSeek V4 Cost-Effectivelyjul 2026
- NVIDIA Build — deepseek-v4-pro Model Cardjul 2026
Registro de verificación
- Precios— Sin cambios
Agente automatizado