D

DeepSeek V4 Pro

DeepSeek · Sorti juil. 2026

Recommandé

Le modèle de coding open-weight le plus performant que nous ayons testé. 99,2 % sur SWE-bench Verified, parité avec Claude Code sur CursorBench 3.2, et 3× moins cher que Fable 5 par tâche complétée. Le choix par défaut pour le coding agentique auto-hébergé.

Est-ce fait pour vous ?

Recommandé pour

  • Cost-sensitive coding and autonomous agent workloads — ~20x cheaper per session than GPT-5.5 or Opus 4.8 at competitive quality
  • Self-hosted enterprise and regulated-industry deployment — MIT license means proprietary code never leaves your infrastructure
  • Competitive programming and code-generation benchmarks — 93.5% LiveCodeBench, 3206 Codeforces Elo

Déconseillé pour

  • Terminal and CLI agent tasks — trails GPT-5.5 (67.9% vs 75.1% on Terminal-Bench 2.0)
  • Workloads requiring Western data-residency guarantees without self-hosting — DeepSeek's API is China-hosted

Tarifs

Entrée

$0.435 / 1M tokens

Sortie

$0.87 / 1M tokens

Contexte

1M tokens

Voir tous les tarifs

Tests de performance

TestScoreSource
SWE-bench Verified80.6% Source
LiveCodeBench (Pass@1)93.5% Source
Codeforces Elo3206 Source
Terminal-Bench 2.067.9% Source
SWE Pro (Resolved)55.4% Source
MCPAtlas Public73.6% Source
GPQA Diamond71.7 Source

Aucun changement de verdict pour l’instant

L’horloge tourne dès le premier jour : les changements apparaîtront ici à mesure que notre verdict évolue.

Journal de vérification

  • Tarifs— Aucun changement

    Agent automatisé

Comment nous évaluons