DeepSeek 로고

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Pro는 DeepSeek이 개발하여 2026년 4월에 출시한 최고 수준의 프론티어 AI 모델입니다. 오픈 웨이트 모델로서 학습된 가중치가 공개적으로 제공되어, 자체 호스팅, 독점 데이터 파인튜닝 또는 API 의존성 없이 온프레미스에서 실행할 수 있습니다. 100만 토큰 컨텍스트 윈도우는 전체 코드베이스, 방대한 기술 문서 또는 확장된 에이전트 세션을 잘림 없이 처리할 수 있을 만큼 큽니다.

FlowHunt AI 리더보드에서 이 모델은 추적되는 24개 모델 중 하나로, 9개 벤치마크에서 평가되었습니다. 두드러진 점수: LiveCodeBench 93.5%(5개 중 1위), MMLU-Pro 87.5%(8개 중 2위), ARC-AGI-2 46.0%(3개 중 3위).

DeepSeek V4-Pro는 2026년 4월 24일 DeepSeek 4세대 V 시리즈의 플래그십 모델로 출시되었습니다. 출시 당시 LiveCodeBench에서 93.5%를 달성하여 측정된 모델 중 가장 높은 경쟁 프로그래밍 점수를 기록했으며, Claude Fable 5 다음으로 가장 높은 자체 보고 SWE-bench Verified 점수인 80.6%를 기록했습니다. 이 출시는 CAISI가 V4-Pro의 SWE-bench 점수를 DeepSeek이 보고한 80.6%가 아닌 74.0%로 독립 측정하면서 큰 논란을 불러일으켰습니다. 이는 6.6포인트 차이로, DeepSeek은 평가 설정의 스캐폴딩 및 토큰 예산 차이 때문이라고 설명했습니다. 오픈 웨이트 모델로서 100만 컨텍스트 윈도우와 49B/1.6T MoE 아키텍처를 갖춘 V4-Pro는 완전한 데이터 제어와 함께 코딩 성능을 우선시하는 팀을 위한 선도적인 자체 호스팅 옵션이 되었습니다.

참고: SWE-bench 불일치: SR 80.6% vs CAISI 74%. LiveCodeBench 93.5% 최고 보고 점수.

출시일
2026년 4월
파라미터
49B/1.6T MoE
컨텍스트
100만 토큰
가중치
공개
등급
Frontier
제공사
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek은 중국 최대 퀀트 헤지펀드 중 하나인 High-Flyer의 자회사로 2023년에 설립된 중국 AI 연구소입니다. 이 연구소는 2025년 초 DeepSeek V3와 R1의 출시로 당시 NVIDIA 시가총액의 사상 최대 일일 하락을 촉발하면서 널리 알려졌는데, 이는 투자자들이 DeepSeek의 낮은 훈련 비용 보고를 계기로 프론티어 모델 개발의 자본 집약도를 재평가했기 때문입니다. DeepSeek은 독점 연구와 함께 오픈웨이트 모델을 공개하겠다는 약속과, 폐쇄형 모델 가격을 비판하는 활발한 소셜 미디어 활동을 한다는 점에서 프론티어 연구소 중 이례적입니다. V 시리즈 모델(V3부터 V4-Pro까지)은 여러 국가에서 중국산 AI 모델에 대한 규제 및 보안 검토가 진행 중임에도 불구하고 서방에서 자체 호스팅 가능한 코딩 및 추론 모델로 널리 사용되고 있습니다.

사용 사례

DeepSeek V4-Pro 활용 분야

소프트웨어 엔지니어링
과학 및 기술 추론
에이전트 CLI 자동화
자체 호스팅 및 프라이빗 배포
장문 문서 및 코드베이스 분석
경쟁 프로그래밍

Strengths & Limitations

Strengths

  • 강력한 소프트웨어 엔지니어링 — SWE-bench Verified 80%
  • 대학원 수준 과학 추론 — GPQA Diamond 90%
  • 경쟁 프로그래밍 — LiveCodeBench 93%
  • 복합 지능 — AA Intelligence Index 52점 (독립 검증)
  • 자체 호스팅 및 데이터 프라이빗 배포 (오픈 웨이트)
  • 매우 긴 문서 및 대규모 코드베이스 처리 (100만 컨텍스트)

전체 AI 모델 리더보드 살펴보기

자주 묻는 질문

더 알아보기

DeepSeek V4-Flash — 벤치마크, 기능 및 사용 사례
DeepSeek V4-Flash — 벤치마크, 기능 및 사용 사례

DeepSeek V4-Flash — 벤치마크, 기능 및 사용 사례

DeepSeek V4-Flash는 DeepSeek(13B/284B MoE)의 오픈 가중치 AI 모델로, Advanced 등급으로 분류되며 100만 토큰 컨텍스트 윈도우를 제공합니다. FlowHunt에서 직접 사용할 수 있습니다. 벤치마크 점수, 강점 및 권장 사용 사례를 살펴보세요....

4 분 읽기
DeepSeek MCP 서버 통합
DeepSeek MCP 서버 통합

DeepSeek MCP 서버 통합

FlowHunt를 DeepSeek MCP 서버와 통합하여 고급 언어 모델을 AI 워크플로우에 도입하세요. DeepSeek API 호출을 안전하게 프록시하고, 익명 사용을 활성화하며, 스마트 모델 선택, 페일오버, 동적 구성, 다중 턴 및 컨텍스트 기반 대화와 같은 기능을 활용할 수 있습...

3 분 읽기
AI DeepSeek +5
Llama 4 Scout — 벤치마크, 성능 및 사용 사례
Llama 4 Scout — 벤치마크, 성능 및 사용 사례

Llama 4 Scout — 벤치마크, 성능 및 사용 사례

Llama 4 Scout는 Meta의 오픈 웨이트 AI 모델(17B/109B MoE(16개 전문가))로, Established 티어에 속하며 1,000만 토큰의 컨텍스트 윈도우를 제공합니다. FlowHunt에서 바로 사용할 수 있습니다. 벤치마크 점수, 강점 및 권장 사용 사례를 알아보...

4 분 읽기