DeepSeek logo

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Proは、DeepSeekが開発し2026年4月にリリースされたトップクラスのフロンティアAIモデルです。オープンウェイトモデルとして、学習済みの重みが公開されており、セルフホスティング、プロプライエタリデータでのファインチューニング、またはAPI依存なしでのオンプレミス実行が可能です。100万トークンのコンテキストウィンドウは、コードベース全体、長大な技術文書、または長時間のエージェントセッションを切り詰めることなく保持するのに十分な大きさです。

FlowHunt AIリーダーボードでは、9つのベンチマークで評価された24の追跡モデルのうちの1つです。注目スコア:LiveCodeBenchで93.5%(5モデル中1位)、MMLU-Proで87.5%(8モデル中2位)、ARC-AGI-2で46.0%(3モデル中3位)。

DeepSeek V4-Proは、DeepSeekの第4世代Vシリーズのフラッグシップモデルとして2026年4月24日にリリースされました。リリース時にLiveCodeBenchで93.5%を達成 — これは測定された全モデルの中で最高の競技プログラミングスコアであり、Claude Fable 5を除く中で最高の自己報告SWE-bench Verifiedスコア80.6%を記録しました。このリリースは、CAISIがV4-ProのSWE-benchスコアをDeepSeekが報告した80.6%ではなく74.0%と独自に測定した際に大きな議論を引き起こしました — DeepSeekが評価設定のスキャフォールディングとトークンバジェットの違いに起因するとした6.6ポイントの差です。100万トークンのコンテキストウィンドウと49B/1.6T MoEアーキテクチャを備えたオープンウェイトモデルとして、V4-Proは完全なデータ管理を備えたコーディング性能を優先するチームにとって、セルフホスティング可能な主要な選択肢となりました。

※注:SWE-benchの差異:自己報告80.6% vs CAISI 74%。LiveCodeBench 93.5%は報告された中で最高。

リリース日
2026年4月
パラメータ数
49B/1.6T MoE
コンテキスト
100万トークン
重み
オープン
階層
フロンティア
提供元
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeekは、中国最大の量的ヘッジファンドの一つであるHigh-Flyerの子会社として2023年に設立された中国のAI研究所です。同研究所は2025年初頭、DeepSeek V3およびR1のリリースが、DeepSeekの報告された低いトレーニングコストを受けて投資家がフロンティアモデル開発の資本集約性を再評価したことにより、NVIDIAの時価総額にその時点で最大の一日下落をもたらしたことで広く知られるようになりました。DeepSeekは、フロンティア研究所の中でも、独自研究と並行してオープンウェイトモデルを公開する姿勢と、クローズドモデルの価格設定を批判する活発なソーシャルメディアでの活動において異例の存在です。そのVシリーズモデル(V3からV4-Pro)は、中国発のAIモデルに対する複数の法域での規制およびセキュリティ上の監視が続いているにもかかわらず、欧米でセルフホスト可能なコーディングおよび推論モデルとして広く使用されています。

ユースケース

DeepSeek V4-Proの活用方法

ソフトウェアエンジニアリング
科学・技術的推論
エージェント的CLI自動化
セルフホスト&プライベートデプロイメント
長文書・コードベース分析
競技プログラミング

Strengths & Limitations

Strengths

  • 優れたソフトウェアエンジニアリング — SWE-bench Verified 80%
  • 大学院レベルの科学推論 — GPQA Diamond 90%
  • 競技プログラミング — LiveCodeBench 93%
  • 複合的知能 — AA Intelligence Index 52 pts(独立検証)
  • セルフホスト&データプライベート対応のデプロイメント(オープンウェイト)
  • 非常に長い文書と大規模コードベースの処理(100万トークンコンテキスト)

AIモデルリーダーボードの全貌を見る

よくある質問

詳しく見る

DeepSeek V4-Flash — ベンチマーク、性能、ユースケース
DeepSeek V4-Flash — ベンチマーク、性能、ユースケース

DeepSeek V4-Flash — ベンチマーク、性能、ユースケース

DeepSeek V4-Flash は、DeepSeek が開発したオープンウェイトのAIモデル(13B/284B MoE)で、Advanced ティアに分類され、100万トークンのコンテキストウィンドウを備えています。FlowHunt で直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご紹介します。...

2 分で読める
Llama 4 Scout — ベンチマーク、機能、ユースケース
Llama 4 Scout — ベンチマーク、機能、ユースケース

Llama 4 Scout — ベンチマーク、機能、ユースケース

Llama 4 ScoutはMetaによるオープンウェイトAIモデル(17B/109B MoE(16エキスパート))で、Established層に分類され、1000万トークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

2 分で読める
DeepSeek MCPサーバー統合
DeepSeek MCPサーバー統合

DeepSeek MCPサーバー統合

FlowHuntをDeepSeek MCPサーバーと連携し、高度な言語モデルをAIワークフローに導入します。DeepSeek APIコールを安全にプロキシし、匿名利用を可能に。スマートなモデル選択・フォールバック・動的設定・コンテキストを保持したマルチターン会話などの機能も利用できます。...

1 分で読める
AI DeepSeek +5