D

DeepSeek V4 Flash

DeepSeek · Lançado 07/2026

Recomendado

O modelo open weight de volume da DeepSeek com 284B de parâmetros (MoE de 13B ativos) e janela de contexto de 1M de tokens. Entrega 79,0% no SWE-bench Verified a US$ 0,14/US$ 0,28 por 1M de tokens — mais barato que qualquer API ocidental próxima da fronteira por 7-107×. Licenciado sob MIT para self-hosting em uma única H100 ou 2× A100s. A proposta de valor mais forte em IA.

É adequada para ti?

Bom para

  • Pipelines de alto throughput — classificação, extração, sumarização e tarefas de saída estruturada ao menor custo em IA de fronteira
  • Código e fluxos agênticos com sensibilidade a custo — SWE-bench Verified 79,0% a $0,14/$0,28, superando modelos 10-100x mais caros
  • Implantações auto-hospedadas em hardware modesto — cabe em uma única H100 ou 2x A100s com quantização INT4

Não recomendado para

  • Raciocínio complexo e tarefas agênticas de múltiplos passos — V4 Pro ($0,435/$0,87) ou flagships ocidentais lideram em raciocínio complexo sustentado
  • Cargas de trabalho de visão/multimodal — modelo apenas texto

Preços

Entrada

$0.14 / 1M tokens

Saída

$0.28 / 1M tokens

Contexto

1M tokens

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
SWE-bench Verified79.0% Fonte
SWE Pro (Resolved)52.6% Fonte
GPQA Diamond89.4% Fonte
τ²-Bench95.0% Fonte
Intelligence Index40.3 Fonte
Coding Index56.2 Fonte

Ainda sem alterações de veredicto

O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

Como avaliamos