MiniMax 标志

MiniMax

MiniMax M3

FrontierOpen-weightAvailable in FlowHunt

MiniMax M3 是 MiniMax 开发并于 2026 年 6 月发布的一款顶级前沿 AI 模型。作为开放权重模型,其训练好的权重可公开获取——您可以自行托管、在专有数据上进行微调,或在本地运行而无需依赖 API。100 万 token 的上下文窗口足以容纳整个代码库、长篇技术文档或长时间的代理会话,无需截断。

在 FlowHunt AI 排行榜上,它是追踪的 24 个模型之一,在 2 项基准测试上接受了评估。突出成绩:SWE-bench Pro 得分 59.0%(9 个模型中排名第 6);Terminal-Bench 得分 66.0%(8 个模型中排名第 6)。

MiniMax M3 于 2026 年 6 月 1 日发布,本身就是一个有意的宣言:这是首个在上下文长度(100 万 token)上与封闭 API 提供商持平,并包含原生多模态理解能力的开放权重前沿模型。MiniMax 为此花费了三年时间开发上下文扩展技术和多模态训练基础设施。M3 的开放权重发布开创了一个全新的模型类别——前沿级、多模态且完全可自行托管——这在之前从未存在过。AI 研究界对此次发布进行了广泛报道,认为这是开放权重模型弥合与封闭 API 模型之间最后一项重大能力差距的时刻。

注:首个开放权重:前沿编码 + 100 万上下文 + 原生多模态。权重待发布。

发布时间
2026 年 6 月
上下文
100 万 token
权重
开放
层级
前沿
提供商
MiniMax

MiniMax M3 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Pro59.0%6 of 9SRMulti-language, standardised scaffold
Terminal-Bench66.0%6 of 8SRAgentic Linux terminal task completion

Detailed Benchmark Scores

SWE-Pro SR
59.0%
Multi-language, standardised scaffold
Terminal SR
66.0%
Agentic Linux terminal task completion

MiniMax M3 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkMiniMax M3Claude Opus 4.8Claude Opus 4.7
SWE-Pro59.0%69.2%64.3%
Terminal66.0%74.6%66.1%

About MiniMax

MiniMax Founded 2021 · Shanghai, China
Website →

MiniMax是一家中国AI初创公司,成立于2021年,由此前在商汤科技领导计算机视觉研究的闫俊杰创立。该公司得到了包括高瓴资本、云启资本和腾讯在内的多家中国主要投资者的支持。MiniMax最初专注于面向消费者的AI应用——包括海螺AI聊天机器人——随后转型为基础模型开发。2026年6月发布的M3模型标志着该公司进入前沿领域:这是首个在上下文长度(100万token)上匹配封闭API提供商的同时包含原生多模态能力的开放权重模型。MiniMax将自己定位为对开发者最友好的中国AI实验室,以宽松许可协议公开发布模型权重。

使用场景

MiniMax M3 适合做什么

代理式 CLI 自动化
自托管与私有部署
长文档与代码库分析

Strengths & Limitations

Strengths

  • 自托管与数据私有化部署(开放权重)
  • 超长文档与大型代码库(100 万上下文)

浏览完整 AI 模型排行榜

常见问题

了解更多

Mistral Medium 3 — 基准测试、能力与用例
Mistral Medium 3 — 基准测试、能力与用例

Mistral Medium 3 — 基准测试、能力与用例

Mistral Medium 3 是 Mistral 推出的专有 AI 模型,属于高级层级,上下文窗口为 128K tokens。探索其基准测试分数、优势及推荐用例。...

1 分钟阅读
Mistral Large 3 —— 基准测试、能力与应用场景
Mistral Large 3 —— 基准测试、能力与应用场景

Mistral Large 3 —— 基准测试、能力与应用场景

Mistral Large 3 是 Mistral 推出的开放权重 AI 模型(41B/675B MoE),归类为进阶层级,支持 256K token 上下文窗口。现已可直接在 FlowHunt 中使用。了解其基准测试得分、优势及推荐应用场景。...

2 分钟阅读
Nemotron 3 Super — 基准测试、能力与应用场景
Nemotron 3 Super — 基准测试、能力与应用场景

Nemotron 3 Super — 基准测试、能力与应用场景

Nemotron 3 Super 是 NVIDIA 推出的开放权重 AI 模型(12B/120B MoE),属于高级层级,支持 100 万 token 上下文窗口。可直接在 FlowHunt 中使用。探索基准测试分数、优势及推荐使用场景。...

2 分钟阅读