D

DeepSeek V4 Pro

DeepSeek · Lanzado jul 2026

Recomendado

El modelo de programación de pesos abiertos más potente que hemos probado. 99.2% en SWE-bench Verified, paridad con Claude Code en CursorBench 3.2, y 3× más barato que Fable 5 por tarea completada. La opción predeterminada para programación agéntica autoalojada.

¿Es adecuada para ti?

Bueno para

  • Cost-sensitive coding and autonomous agent workloads — ~20x cheaper per session than GPT-5.5 or Opus 4.8 at competitive quality
  • Self-hosted enterprise and regulated-industry deployment — MIT license means proprietary code never leaves your infrastructure
  • Competitive programming and code-generation benchmarks — 93.5% LiveCodeBench, 3206 Codeforces Elo

No recomendado para

  • Terminal and CLI agent tasks — trails GPT-5.5 (67.9% vs 75.1% on Terminal-Bench 2.0)
  • Workloads requiring Western data-residency guarantees without self-hosting — DeepSeek's API is China-hosted

Precios

Entrada

$0.435 / 1M tokens

Salida

$0.87 / 1M tokens

Contexto

1M tokens

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
SWE-bench Verified80.6% Fuente
LiveCodeBench (Pass@1)93.5% Fuente
Codeforces Elo3206 Fuente
Terminal-Bench 2.067.9% Fuente
SWE Pro (Resolved)55.4% Fuente
MCPAtlas Public73.6% Fuente
GPQA Diamond71.7 Fuente

Aún no hay cambios de veredicto

El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.

Registro de verificación

  • Precios— Sin cambios

    Agente automatizado

Cómo evaluamos