DeepSeek logo

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Pro on huipputason Frontier-tekoälymalli, jonka on kehittänyt DeepSeek ja joka julkaistiin huhtikuussa 2026. Avoimen painoarvon mallina sen koulutetut painoarvot ovat julkisesti saatavilla — voit isännöidä sen itse, hienosäätää sitä omalla datallasi tai ajaa sitä omassa ympäristössäsi ilman API-riippuvuuksia. 1 miljoonan tokenin konteksti-ikkuna on riittävän suuri käsittelemään kokonaisia koodikantoja, pitkiä teknisiä dokumentteja tai laajoja agenttisessioita ilman katkaisua.

FlowHunt AI Leaderboardissa se on yksi 24 seuratusta mallista, arvioituna 9 vertailuarvossa. Huomionarvoiset pisteet: 93,5 % LiveCodeBenchissa (#1/5); 87,5 % MMLU-Prossa (#2/8); 46,0 % ARC-AGI-2:ssa (#3/3).

DeepSeek V4-Pro julkaistiin 24. huhtikuuta 2026 DeepSeekin neljännen sukupolven V-sarjan lippulaivamallina. Se saavutti 93,5 % LiveCodeBenchissa julkaisuhetkellä — korkein kilpailevan ohjelmoinnin pistemäärä kaikista mitatuista malleista — ja sai korkeimman itse ilmoitetun SWE-bench Verified -pistemäärän Claude Fable 5:n jälkeen, 80,6 %. Julkaisu herätti merkittävää keskustelua, kun CAISI mittasi V4-Pro:n SWE-bench-pistemääräksi 74,0 % eikä 80,6 %, jonka DeepSeek oli ilmoittanut — 6,6 pisteen ero, jonka DeepSeek selitti scaffoldointi- ja token-budjettieroista arviointiasetelmissa. Avoimen painoarvon mallina, jossa on 1M konteksti-ikkuna ja 49B/1,6T MoE-arkkitehtuuri, V4-Pro:sta tuli johtava itse isännöitävä vaihtoehto tiimeille, jotka priorisoivat koodauskyvykkyyttä täydellä datan hallinnalla.

Huomautus: SWE-bench-ero: SR 80,6 % vs. CAISI 74,0 %. LiveCodeBench 93,5 % korkein raportoitu.

Julkaistu
Huhtikuu 2026
Parametrit
49B/1,6T MoE
Konteksti
1M tokenia
Painoarvot
Avoin
Taso
Frontier
Tarjoaja
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek on kiinalainen tekoälytutkimuslaboratorio, joka perustettiin vuonna 2023 High-Flyerin, yhden Kiinan suurimmista kvantitatiivisista hedge-rahastoista, tytäryhtiönä. Laboratorio tuli laajalti tunnetuksi alkuvuodesta 2025, kun DeepSeek V3:n ja R1:n julkaisu aiheutti NVIDIA-markkina-arvon suurimman yksittäisen päivän laskun siihen asti, kun sijoittajat arvioivat uudelleen huippumallien kehityksen pääomaintensiteettiä DeepSeekin raportoitujen alhaisempien koulutuskustannusten valossa. DeepSeek on epätavallinen huippulaboratorioiden joukossa sitoutumisessaan avoimen painon malleihin oman tutkimuksensa rinnalla sekä aktiivisen sosiaalisen median läsnäolon ylläpitämisessä, jossa se kritisoi suljettujen mallien hinnoittelua. Sen V-sarjan malleja (V3–V4-Pro) käytetään laajalti itse isännöitävinä koodaus- ja päättelymalleina länsimaissa huolimatta kiinalaisalkuperää oleviin tekoälymalleihin kohdistuvasta jatkuvasta sääntely- ja turvallisuustarkastelusta useilla lainkäyttöalueilla.

Käyttötapaukset

Mihin DeepSeek V4-Pro:a Kannattaa Käyttää

Ohjelmistokehitys
Tieteellinen ja Tekninen Päättely
Agentti CLI-automaatio
Itse Isännöidyt ja Yksityiset Käyttöönotot
Pitkien Dokumenttien ja Koodikantojen Analyysi
Kilpaileva Ohjelmointi

Strengths & Limitations

Strengths

  • Vahva ohjelmistokehitys — 80 % SWE-bench Verified
  • Tutkijatason tieteellinen päättely — 90 % GPQA Diamond
  • Kilpaileva ohjelmointi — 93 % LiveCodeBench
  • Yhdistetty älykkyys — 52 pistettä AA Intelligence Index (riippumaton)
  • Itse isännöidyt ja tietosuojatut käyttöönotot (avoin painoarvo)
  • Erittäin pitkät dokumentit ja suuret koodikannat (1M konteksti)

Tutustu Koko tekoälymalli-listaan

Usein kysytyt kysymykset

Lue lisää

DeepSeek MCP Server -integraatio
DeepSeek MCP Server -integraatio

DeepSeek MCP Server -integraatio

Integroi FlowHunt DeepSeek MCP Serveriin ja tuo edistyneet kielimallit osaksi tekoälytyöprosessejasi. Proxioi DeepSeek API -kutsut turvallisesti, mahdollista an...

3 min lukuaika
AI DeepSeek +5