DeepSeek logo

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Pro est un modèle d’IA frontalier de premier plan, développé par DeepSeek et publié en avril 2026. En tant que modèle à poids ouverts, ses poids entraînés sont disponibles publiquement — vous pouvez l’héberger vous-même, l’affiner sur des données propriétaires ou l’exécuter sur site sans dépendre d’une API. La fenêtre de contexte de 1 million de tokens est suffisamment grande pour contenir des bases de code entières, de longs documents techniques ou des sessions agentiques étendues sans troncature.

Sur le classement IA FlowHunt, il fait partie des 24 modèles suivis, évalués sur 9 benchmarks. Scores remarquables : 93,5 % sur LiveCodeBench (#1 sur 5) ; 87,5 % sur MMLU-Pro (#2 sur 8) ; 46,0 % sur ARC-AGI-2 (#3 sur 3).

DeepSeek V4-Pro a été publié le 24 avril 2026 en tant que modèle phare de la quatrième génération de la série V de DeepSeek. Il a obtenu 93,5 % sur LiveCodeBench dès son lancement — le score de programmation compétitive le plus élevé de tous les modèles mesurés — et a affiché le score SWE-bench Verified autodéclaré le plus élevé après Claude Fable 5, à 80,6 %. La publication a suscité d’importantes discussions lorsque CAISI a mesuré indépendamment le score SWE-bench de V4-Pro à 74,0 % plutôt que les 80,6 % rapportés par DeepSeek — un écart de 6,6 points que DeepSeek a attribué à des différences d’infrastructure d’évaluation et de budget de tokens dans la configuration. En tant que modèle à poids ouverts avec une fenêtre de contexte de 1M et une architecture MoE de 49B/1,6T, V4-Pro est devenu l’option leader auto-hébergeable pour les équipes privilégiant les performances de codage avec un contrôle total des données.

Remarque : Écart SWE-bench : SR 80,6 % vs CAISI 74 %. LiveCodeBench 93,5 % le plus élevé rapporté.

Date de sortie
Avril 2026
Paramètres
49B/1,6T MoE
Contexte
1M tokens
Poids
Ouverts
Niveau
Frontier
Fournisseur
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek est un laboratoire de recherche en IA chinois fondé en 2023 en tant que filiale de High-Flyer, l'un des plus grands fonds spéculatifs quantitatifs de Chine. Le laboratoire est devenu largement connu au début de l'année 2025 lorsque la publication de DeepSeek V3 et R1 a provoqué la plus forte baisse en un seul jour de la capitalisation boursière de NVIDIA à ce jour, les investisseurs réévaluant l'intensité capitalistique du développement de modèles de pointe à la lumière des coûts d'entraînement inférieurs annoncés par DeepSeek. DeepSeek est inhabituel parmi les laboratoires de pointe par son engagement à publier des modèles à poids ouverts parallèlement à ses recherches propriétaires, et par sa présence active sur les réseaux sociaux critiquant la tarification des modèles fermés. Ses modèles de la série V (V3 à V4-Pro) sont largement utilisés comme modèles de codage et de raisonnement auto-hébergeables en Occident, malgré un examen réglementaire et de sécurité constant des modèles d'IA d'origine chinoise dans plusieurs juridictions.

Cas d'utilisation

À quoi utiliser DeepSeek V4-Pro

Génie logiciel
Raisonnement scientifique et technique
Automatisation CLI agentique
Déploiements auto-hébergés et privés
Analyse de longs documents et de bases de code
Programmation compétitive

Strengths & Limitations

Strengths

  • Génie logiciel solide — 80 % SWE-bench Verified
  • Raisonnement scientifique de niveau graduate — 90 % GPQA Diamond
  • Programmation compétitive — 93 % LiveCodeBench
  • Intelligence composite — 52 pts AA Intelligence Index (indépendant)
  • Déploiements auto-hébergés et données privées (poids ouverts)
  • Documents très longs et grandes bases de code (contexte 1M)

Parcourir le classement complet des modèles d'IA

Questions fréquemment posées

En savoir plus

DeepSeek V4-Flash — Benchmark, capacités et cas d'utilisation
DeepSeek V4-Flash — Benchmark, capacités et cas d'utilisation

DeepSeek V4-Flash — Benchmark, capacités et cas d'utilisation

DeepSeek V4-Flash est un modèle d'IA à poids ouverts de DeepSeek (13B/284B MoE), classé au niveau Avancé avec une fenêtre de contexte de 1 million de tokens. Il...

5 min de lecture
Llama 4 Scout — Benchmarks, capacités et cas d'usage
Llama 4 Scout — Benchmarks, capacités et cas d'usage

Llama 4 Scout — Benchmarks, capacités et cas d'usage

Llama 4 Scout est un modèle d'IA à poids ouverts de Meta (17B/109B MoE (16 experts)), classé dans le niveau Établi avec une fenêtre de contexte de 10M tokens. I...

5 min de lecture
Intégration du serveur MCP DeepSeek
Intégration du serveur MCP DeepSeek

Intégration du serveur MCP DeepSeek

Intégrez FlowHunt avec le serveur MCP DeepSeek pour bénéficier de modèles de langage avancés dans vos flux IA. Proxifiez en toute sécurité les appels à l’API De...

5 min de lecture
AI DeepSeek +5