DeepSeek-Logo

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Pro ist ein erstklassiges Frontier-KI-Modell, entwickelt von DeepSeek und veröffentlicht im April 2026. Als Open-Weight-Modell sind seine trainierten Gewichte öffentlich verfügbar – Sie können es selbst hosten, mit eigenen Daten feintunen oder auf eigener Infrastruktur ohne API-Abhängigkeiten betreiben. Das Kontextfenster von 1 Mio. Token ist groß genug, um ganze Codebasen, umfangreiche technische Dokumente oder ausgedehnte agentische Sitzungen ohne Kürzung zu erfassen.

Im FlowHunt AI Leaderboard ist es eines von 24 erfassten Modellen, bewertet in 9 Benchmarks. Hervorragende Ergebnisse: 93,5 % bei LiveCodeBench (#1 von 5); 87,5 % bei MMLU-Pro (#2 von 8); 46,0 % bei ARC-AGI-2 (#3 von 3).

DeepSeek V4-Pro wurde am 24. April 2026 als Flaggschiff der vierten Generation der V-Serie von DeepSeek veröffentlicht. Es erreichte bei der Veröffentlichung 93,5 % bei LiveCodeBench – die höchste jemals gemessene Punktzahl im Bereich Competitive Programming – und erzielte mit 80,6 % die höchste selbst gemeldete SWE-bench-Verified-Punktzahl außerhalb von Claude Fable 5. Die Veröffentlichung sorgte für erhebliche Diskussionen, als CAISI unabhängig eine SWE-bench-Punktzahl von 74,0 % für V4-Pro maß, statt der von DeepSeek gemeldeten 80,6 % – eine Differenz von 6,6 Punkten, die DeepSeek auf Unterschiede in der Evaluierungsumgebung (Scaffolding und Token-Budget) zurückführte. Als Open-Weight-Modell mit einem 1-Mio.-Token-Kontextfenster und einer 49B/1,6T-MoE-Architektur wurde V4-Pro zur führenden selbst hostbaren Option für Teams, die Programmierleistung mit vollständiger Datenkontrolle priorisieren.

Anmerkung: SWE-bench-Diskrepanz: SR 80,6 % vs. CAISI 74 %. LiveCodeBench 93,5 % der höchste gemeldete Wert.

Veröffentlicht
April 2026
Parameter
49B/1,6T MoE
Kontext
1 Mio. Token
Gewichte
Offen
Stufe
Frontier
Anbieter
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek ist ein chinesisches KI-Forschungslabor, das 2023 als Tochtergesellschaft von High-Flyer, einem der größten quantitativen Hedgefonds Chinas, gegründet wurde. Das Labor wurde Anfang 2025 weithin bekannt, als die Veröffentlichung von DeepSeek V3 und R1 den damals größten eintägigen Kursverlust der NVIDIA-Marktkapitalisierung auslöste, da Investoren die Kapitalintensität der Entwicklung von Spitzenmodellen angesichts der berichteten niedrigeren Trainingskosten von DeepSeek neu bewerteten. DeepSeek ist unter den Spitzenlaboren ungewöhnlich in seinem Engagement, Open-Weight-Modelle neben seiner proprietären Forschung zu veröffentlichen, und in seiner aktiven Präsenz in sozialen Medien, die die Preisgestaltung geschlossener Modelle kritisiert. Die V-Serien-Modelle (V3 bis V4-Pro) werden im Westen trotz anhaltender regulatorischer und sicherheitsbezogener Prüfung von KI-Modellen chinesischen Ursprungs in mehreren Jurisdiktionen weit verbreitet als selbst hostbare Codierungs- und Reasoning-Modelle eingesetzt.

Anwendungsfälle

Wofür Sie DeepSeek V4-Pro nutzen sollten

Softwareentwicklung
Wissenschaftliches & technisches Denken
Agentische CLI-Automatisierung
Selbst gehostete & private Bereitstellungen
Langdokument- & Codebase-Analyse
Competitive Programming

Strengths & Limitations

Strengths

  • Starke Softwareentwicklung – 80 % SWE-bench Verified
  • Wissenschaftliches Denken auf Graduiertenniveau – 90 % GPQA Diamond
  • Competitive Programming – 93 % LiveCodeBench
  • Verbundene Intelligenz – 52 Punkte AA Intelligence Index (unabhängig)
  • Selbst gehostete & datenschutzfreundliche Bereitstellungen (Open-Weight)
  • Sehr lange Dokumente und große Codebasen (1 Mio. Kontext)

Zum vollständigen KI-Modell-Vergleich

Häufig gestellte Fragen

Mehr erfahren

Llama 4 Scout — Benchmarks, Fähigkeiten und Anwendungsfälle
Llama 4 Scout — Benchmarks, Fähigkeiten und Anwendungsfälle

Llama 4 Scout — Benchmarks, Fähigkeiten und Anwendungsfälle

Llama 4 Scout ist ein Open-Weight-KI-Modell von Meta (17B/109B MoE (16 Experten)), eingestuft als Established-Tier mit einem Kontextfenster von 10 Millionen Tok...

4 Min. Lesezeit
DeepSeek MCP Server Integration
DeepSeek MCP Server Integration

DeepSeek MCP Server Integration

Integrieren Sie FlowHunt mit dem DeepSeek MCP Server, um fortschrittliche Sprachmodelle in Ihre KI-Workflows zu bringen. Leiten Sie DeepSeek API-Aufrufe sicher ...

4 Min. Lesezeit
AI DeepSeek +5