DeepSeek 标志

DeepSeek

DeepSeek V4-Flash

AdvancedOpen-weightAvailable in FlowHunt

DeepSeek V4-Flash 是 DeepSeek 于 2026 年 4 月发布的一款先进 AI 模型,适用于要求严苛的生产工作负载。作为开放权重模型,其训练权重可公开获取——您可以自行托管、使用专有数据微调,或在本地部署运行,无需依赖 API。100 万 token 的上下文窗口足以容纳整个代码库、长篇技术文档或长时间的智能体会话,无需截断。

在 FlowHunt AI 排行榜上,它是 24 个追踪模型之一,在 5 项基准测试中进行了评估。突出得分:MMLU-Pro 86.2%(8 个模型中排名第 3);LiveCodeBench 91.6%(5 个模型中排名第 3);HLE 34.8%(6 个模型中排名第 5)。

DeepSeek V4-Flash 于 2026 年 4 月 24 日与 V4-Pro 一同发布,是第四代 V 系列的轻量级低延迟变体。它使用 13B 活跃参数(来自 284B MoE 总参数池),在 LiveCodeBench 上达到 91.6%——仅比 V4-Pro 低 1.9 个百分点——而每次 token 推理成本显著降低。Flash 与 Pro 在竞技编程上的这种近乎持平的表现,体现了 DeepSeek 标志性的设计理念:通过将 token 路由到专门的专家网络,用较少的活跃参数实现接近旗舰的性能。V4-Flash 瞄准高吞吐量场景,适用于需要接近前沿的编码能力且 API 响应时间以毫秒计量的开发者。

注:接近 Pro 的质量,成本仅为几分之一。支持约 2,500 个并发请求。

发布时间
2026 年 4 月
参数规模
13B/284B MoE
上下文窗口
100 万 token
权重
开放
层级
高级(Advanced)
提供商
DeepSeek

DeepSeek V4-Flash Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.0%9 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond88.1%8 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro86.2%3 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%3 of 5SRCompetitive programming, continuously updated
HLE34.8%5 of 6SRHumanity's Last Exam (50+ STEM disciplines)

Detailed Benchmark Scores

SWE-V SR
79.0%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
88.1%
Graduate-level Google-proof science Q&A
MMLU-P SR
86.2%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
HLE SR
34.8%
Humanity's Last Exam (50+ STEM disciplines)

DeepSeek V4-Flash vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkDeepSeek V4-FlashClaude Sonnet 4.6GPT-4.1
SWE-V79.0%79.6%54.6%
GPQA ◇88.1%
MMLU-P86.2%
LiveCode91.6%
HLE34.8%

About DeepSeek

DeepSeek Founded 2023 · Hangzhou, China
Website →

DeepSeek是一家中国AI研究实验室,成立于2023年,作为中国最大量化对冲基金之一High-Flyer的子公司。该实验室于2025年初因DeepSeek V3和R1的发布而广为人知,当时这些模型的发布引发了NVIDIA市值迄今为止最大的单日跌幅,原因在于投资者在了解到DeepSeek报告的较低训练成本后,重新评估了前沿模型开发的资本密集度。DeepSeek在前沿实验室中独树一帜,承诺在发布专有研究的同时发布开放权重模型,并通过活跃的社交媒体平台批评闭源模型的定价策略。尽管多个司法管辖区对中国来源AI模型的监管和安全审查仍在持续,其V系列模型(V3至V4-Pro)在西方仍被广泛用作可自行部署的编码和推理模型。

用例

DeepSeek V4-Flash 适合做什么

软件工程
科学与技术推理
自托管与私有部署
长文档与代码库分析
竞技编程

Strengths & Limitations

Strengths

  • 强大的软件工程能力——SWE-bench Verified 79%
  • 高级科学问答——GPQA Diamond 88%
  • 竞技编程——LiveCodeBench 91%
  • 自托管与数据私有部署(开放权重)
  • 超长文档与大型代码库(100 万上下文)

浏览完整 AI 模型排行榜

常见问题

了解更多

DeepSeek V4-Pro — 基准测试、能力与使用场景
DeepSeek V4-Pro — 基准测试、能力与使用场景

DeepSeek V4-Pro — 基准测试、能力与使用场景

DeepSeek V4-Pro 是 DeepSeek 推出的开放权重 AI 模型(49B/1.6T MoE),属于前沿级别,拥有 100 万 token 的上下文窗口。该模型可直接在 FlowHunt 中使用。深入了解其基准评分、优势及推荐使用场景。...

3 分钟阅读
DeepSeek MCP 服务器集成
DeepSeek MCP 服务器集成

DeepSeek MCP 服务器集成

将 FlowHunt 与 DeepSeek MCP 服务器集成,将先进的语言模型引入您的 AI 工作流。安全代理 DeepSeek API 调用,支持匿名使用,并解锁智能模型选择、故障切换、动态配置和多轮、富上下文对话等功能。...

1 分钟阅读
AI DeepSeek +5
Llama 4 Scout — 基准测试、能力与用例
Llama 4 Scout — 基准测试、能力与用例

Llama 4 Scout — 基准测试、能力与用例

Llama 4 Scout 是 Meta 推出的开放权重 AI 模型(17B/109B MoE(16个专家)),归类为成熟层级,拥有 1000 万 token 的上下文窗口。可直接在 FlowHunt 中使用。了解其基准测试分数、优势及推荐用例。...

2 分钟阅读