D
DeepSeek V4 Flash
DeepSeek · Lançado 07/2026
Recomendado
O modelo open weight de volume da DeepSeek com 284B de parâmetros (MoE de 13B ativos) e janela de contexto de 1M de tokens. Entrega 79,0% no SWE-bench Verified a US$ 0,14/US$ 0,28 por 1M de tokens — mais barato que qualquer API ocidental próxima da fronteira por 7-107×. Licenciado sob MIT para self-hosting em uma única H100 ou 2× A100s. A proposta de valor mais forte em IA.
É adequada para ti?
Bom para
- Pipelines de alto throughput — classificação, extração, sumarização e tarefas de saída estruturada ao menor custo em IA de fronteira
- Código e fluxos agênticos com sensibilidade a custo — SWE-bench Verified 79,0% a $0,14/$0,28, superando modelos 10-100x mais caros
- Implantações auto-hospedadas em hardware modesto — cabe em uma única H100 ou 2x A100s com quantização INT4
Não recomendado para
- Raciocínio complexo e tarefas agênticas de múltiplos passos — V4 Pro ($0,435/$0,87) ou flagships ocidentais lideram em raciocínio complexo sustentado
- Cargas de trabalho de visão/multimodal — modelo apenas texto
Preços
Entrada
$0.14 / 1M tokens
Saída
$0.28 / 1M tokens
Contexto
1M tokens
Testes de desempenho
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
- AI Pricing Guru — DeepSeek API Pricing07/2026
- Design for Online — V4 Flash Review07/2026
- Requesty — DeepSeek V4 Flash Specs & Benchmarks07/2026
- BenchLM — DeepSeek API Pricing: V4 Pro & Flash Rates07/2026
- Tech Jacks Solutions — Running DeepSeek V4 Cost-Effectively07/2026
- NVIDIA Build — deepseek-v4-pro Model Card07/2026
Registo de verificação
- Preços— Sem alterações
Agente automatizado