DeepSeek logo

DeepSeek

DeepSeek V4-Pro

FrontierOpen-weightAvailable in FlowHunt

DeepSeek V4-Pro là mô hình AI frontier hàng đầu, được phát triển bởi DeepSeek và phát hành vào tháng 4 năm 2026. Là một mô hình trọng số mở, các trọng số đã huấn luyện của nó được công bố công khai — bạn có thể tự lưu trữ, tinh chỉnh trên dữ liệu độc quyền hoặc chạy tại chỗ mà không phụ thuộc vào API. Cửa sổ ngữ cảnh 1 triệu token đủ lớn để chứa toàn bộ kho mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác tử kéo dài mà không bị cắt bớt.

Trên Bảng xếp hạng AI FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá trên 9 điểm chuẩn. Điểm nổi bật: 93,5% trên LiveCodeBench (#1/5); 87,5% trên MMLU-Pro (#2/8); 46,0% trên ARC-AGI-2 (#3/3).

DeepSeek V4-Pro được phát hành vào ngày 24 tháng 4 năm 2026 với tư cách là mô hình chủ lực của dòng V thế hệ thứ tư của DeepSeek. Mô hình đạt 93,5% trên LiveCodeBench khi ra mắt — điểm lập trình cạnh tranh cao nhất trong số các mô hình được đo — và đạt điểm SWE-bench Verified tự báo cáo cao nhất bên ngoài Claude Fable 5 ở mức 80,6%. Bản phát hành đã tạo ra cuộc thảo luận đáng kể khi CAISI đo độc lập điểm SWE-bench của V4-Pro ở mức 74,0% thay vì 80,6% mà DeepSeek đã báo cáo — khoảng cách 6,6 điểm mà DeepSeek cho là do sự khác biệt về giàn giáo và ngân sách token trong thiết lập đánh giá. Là một mô hình trọng số mở với cửa sổ ngữ cảnh 1 triệu token và kiến trúc MoE 49B/1,6T, V4-Pro đã trở thành lựa chọn tự lưu trữ hàng đầu cho các nhóm ưu tiên hiệu suất lập trình với toàn quyền kiểm soát dữ liệu.

Lưu ý: Chênh lệch SWE-bench: SR 80,6% so với CAISI 74%. LiveCodeBench 93,5% là mức cao nhất được báo cáo.

Phát hành
Tháng 4 năm 2026
Tham số
49B/1,6T MoE
Ngữ cảnh
1 triệu token
Trọng số
Mở
Hạng
Frontier
Nhà cung cấp
DeepSeek

DeepSeek V4-Pro Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.6%6 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro55.4%9 of 9SRMulti-language, standardised scaffold
GPQA Diamond90.1%6 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro87.5%2 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench93.5%1 of 5SRCompetitive programming, continuously updated
Terminal-Bench67.9%4 of 8SRAgentic Linux terminal task completion
ARC-AGI-246.0%3 of 3CNovel visual reasoning, no memorisation
HLE37.7%4 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index52.0 pts6 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.6%
Real GitHub issue resolution (500 verified issues)
Independent: 74.0% (CAISI independent)
SWE-Pro SR
55.4%
Multi-language, standardised scaffold
GPQA ◇ SR
90.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
87.5%
Hard knowledge reasoning, 12K questions
LiveCode SR
93.5%
Competitive programming, continuously updated
Terminal SR
67.9%
Agentic Linux terminal task completion
ARC-2 C
46.0%
Novel visual reasoning, no memorisation
HLE SR
37.7%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
52.0 pts
Artificial Analysis composite score (independent)

DeepSeek V4-Pro vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-ProClaude Opus 4.8Claude Opus 4.7
SWE-V80.6%88.6%87.6%
SWE-Pro55.4%69.2%64.3%
GPQA ◇90.1%93.6%94.2%
MMLU-P87.5%
LiveCode93.5%
Terminal67.9%74.6%66.1%
ARC-246.0%
HLE37.7%
AA Idx52.0 pts61.4 pts57.3 pts

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek là một phòng thí nghiệm nghiên cứu AI của Trung Quốc được thành lập vào năm 2023 với tư cách là công ty con của High-Flyer, một trong những quỹ phòng hộ định lượng lớn nhất Trung Quốc. Phòng thí nghiệm này trở nên nổi tiếng rộng rãi vào đầu năm 2025 khi việc phát hành DeepSeek V3 và R1 gây ra đợt giảm vốn hóa thị trường lớn nhất trong một ngày của NVIDIA tính đến thời điểm đó, khi các nhà đầu tư đánh giá lại cường độ vốn của việc phát triển mô hình tiên tiến dựa trên chi phí huấn luyện thấp hơn được báo cáo của DeepSeek. DeepSeek khác biệt so với các phòng thí nghiệm tiên tiến khác ở cam kết phát hành mô hình trọng số mở (open-weight) cùng với nghiên cứu độc quyền và vận hành một kênh truyền thông xã hội tích cực phê phán định giá mô hình đóng. Các mô hình dòng V (V3 đến V4-Pro) được sử dụng rộng rãi làm mô hình lập trình và suy luận có thể tự lưu trữ ở phương Tây, bất chấp sự giám sát về quy định và an ninh đang diễn ra đối với các mô hình AI có nguồn gốc từ Trung Quốc tại một số khu vực pháp lý.

Trường hợp sử dụng

Nên Dùng DeepSeek V4-Pro Cho Việc Gì

Kỹ thuật Phần mềm
Lập luận Khoa học & Kỹ thuật
Tự động hóa CLI Tác tử
Triển khai Tự lưu trữ & Riêng tư
Phân tích Tài liệu Dài & Kho Mã nguồn
Lập trình Cạnh tranh

Strengths & Limitations

Strengths

  • Kỹ thuật phần mềm mạnh mẽ — 80% SWE-bench Verified
  • Lập luận khoa học cấp sau đại học — 90% GPQA Diamond
  • Lập trình cạnh tranh — 93% LiveCodeBench
  • Trí tuệ tổng hợp — 52 điểm AA Intelligence Index (độc lập)
  • Triển khai tự lưu trữ & riêng tư dữ liệu (trọng số mở)
  • Tài liệu rất dài và kho mã nguồn lớn (ngữ cảnh 1 triệu token)

Xem Toàn bộ Bảng xếp hạng Mô hình AI

Câu hỏi thường gặp

Tìm hiểu thêm