DeepSeek logo

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Pro este un model AI de frontieră de top, dezvoltat de DeepSeek și lansat în aprilie 2026. Fiind un model open-weight, greutățile sale antrenate sunt disponibile public — îl poți găzdui singur, îl poți face fine-tuning pe date proprietare sau îl poți rula on-premise fără dependențe API. Fereastra de context de 1 milion de tokeni este suficient de mare pentru a cuprinde baze de cod întregi, documente tehnice lungi sau sesiuni agentice extinse fără trunchiere.

Pe Clasamentul AI FlowHunt este unul dintre cele 24 de modele urmărite, evaluat pe 9 repere. Scoruri remarcabile: 93,5% pe LiveCodeBench (#1 din 5); 87,5% pe MMLU-Pro (#2 din 8); 46,0% pe ARC-AGI-2 (#3 din 3).

DeepSeek V4-Pro a fost lansat pe 24 aprilie 2026 ca model-vedetă al seriei V de generația a patra a DeepSeek. A obținut 93,5% pe LiveCodeBench la lansare — cel mai mare scor de programare competitivă dintre toate modelele măsurate — și a înregistrat cel mai mare scor SWE-bench Verified auto-raportat, în afara lui Claude Fable 5, de 80,6%. Lansarea a generat discuții semnificative când CAISI a măsurat independent scorul SWE-bench al V4-Pro la 74,0%, în loc de 80,6% raportat de DeepSeek — o diferență de 6,6 puncte pe care DeepSeek a atribuit-o diferențelor de schelă și buget de tokeni în configurația de evaluare. Ca model open-weight cu o fereastră de context de 1M și arhitectura MoE de 49B/1.6T, V4-Pro a devenit opțiunea principală auto-găzduibilă pentru echipele care prioritizează performanța de codare cu control complet asupra datelor.

Notă: Discrepanța SWE-bench: SR 80,6% vs CAISI 74%. LiveCodeBench 93,5% cel mai mare raportat.

Lansat
Aprilie 2026
Parametri
49B/1.6T MoE
Context
1M tokeni
Greutăți
Deschise
Nivel
Frontier
Furnizor
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek este un laborator chinez de cercetare AI fondat în 2023 ca subsidiară a High-Flyer, unul dintre cele mai mari fonduri speculative cantitative din China. Laboratorul a devenit cunoscut la începutul anului 2025, când lansarea DeepSeek V3 și R1 a declanșat cea mai mare scădere într-o singură zi a capitalizării de piață a NVIDIA de până la acea dată, pe măsură ce investitorii au reevaluat intensitatea capitalului în dezvoltarea modelelor de frontieră, având în vedere costurile de instruire mai scăzute raportate de DeepSeek. DeepSeek este neobișnuit printre laboratoarele de frontieră prin angajamentul său de a lansa modele cu greutăți deschise alături de cercetarea sa proprietară și prin operarea unei prezențe active pe rețelele sociale care critică prețurile modelelor închise. Seria sa de modele V (V3 până la V4-Pro) este utilizată pe scară largă ca modele de codare și raționament auto-găzduite în Occident, în ciuda examinării continue de reglementare și securitate a modelelor AI de origine chineză în mai multe jurisdicții.

Cazuri de Utilizare

Pentru Ce să Folosești DeepSeek V4-Pro

Inginerie Software
Raționament Științific și Tehnic
Automatizare CLI Agentică
Implementări Auto-Găzduite și Private
Analiză de Documente Lungi și Baze de Cod
Programare Competitivă

Strengths & Limitations

Strengths

  • Inginerie software solidă — 80% SWE-bench Verified
  • Raționament științific de nivel universitar — 90% GPQA Diamond
  • Programare competitivă — 93% LiveCodeBench
  • Inteligență compozită — 52 pts AA Intelligence Index (independent)
  • Implementări auto-găzduite și private asupra datelor (open-weight)
  • Documente foarte lungi și baze de cod mari (context 1M)

Vezi Clasamentul Complet al Modelelor AI

Întrebări frecvente

Află mai multe

Integrarea Serverului DeepSeek MCP
Integrarea Serverului DeepSeek MCP

Integrarea Serverului DeepSeek MCP

Integrează FlowHunt cu DeepSeek MCP Server pentru a aduce modele lingvistice avansate în fluxurile tale de lucru AI. Proxează în siguranță apelurile API DeepSee...

4 min citire
AI DeepSeek +5