
Qwen 3.7-Max —— 基准测试、能力与使用场景
Qwen 3.7-Max 是阿里巴巴的专有 AI 模型,属于前沿层级,支持 100 万 Token 的上下文窗口。该模型现已直接在 FlowHunt 中使用。探索其基准测试得分、优势及推荐使用场景。...
Qwen 3.7-Plus 是一款适用于高要求生产工作负载的先进AI模型,由阿里巴巴开发,于2026年6月发布。这是一款专有的闭源权重模型,可通过阿里巴巴 API 使用。其100万tokens的上下文窗口足以容纳整个代码库、长篇技术文档或扩展的智能体会话而无需截断。
在 FlowHunt AI 排行榜上,它是24个追踪模型之一,已在1项基准测试上进行了评估。突出得分:AA Intelligence Index 53.0 分(9个模型中排名第5)。
Qwen 3.7-Plus 于2026年6月1日发布,是 Qwen 3.7 系列中的中端型号,旨在以低于 3.7-Max 的成本将 Qwen 思考模式推广到更广泛的用例。Plus 定位在偶发深度推理与日常 API 任务的交汇点上——此类工作负载中,扩展思维链对偶发的难题很有价值,但并非每次查询都需要。该模型通过阿里云 Model Studio API 提供,可访问 Qwen 的思考模式开关,而无需消耗 3.7-Max 的完整资源。
注:多模态兄弟模型。ScreenSpot Pro GUI 定位精度 79.0%。AA Index 53。
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| AA Intelligence Index | 53.0 pts | 5 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Plus | Claude Sonnet 4.6 | GPT-4.1 |
|---|---|---|---|
| AA Idx | 53.0 pts | — | — |
阿里巴巴集团是中国最大、最多元化的科技企业集团之一,由马云于1999年创立,总部位于杭州。通过其达摩院和通义实验室,阿里巴巴凭借Qwen(通义千问)系列成为大语言模型开发的重要力量。2026年中期发布的Qwen 3.7版本标志着阿里巴巴从国内部署转向国际基准竞争,Qwen 3.7-Max在GPQA Diamond上获得92.4%的分数,在LiveCodeBench上获得91.6%的分数。阿里巴巴的AI战略以开放权重发布作为对抗美国仅限API模型的制衡手段,将生成式AI整合到其云和电子商务业务中,并对其阿里云部门的AI基础设施进行大规模投资。
用例
借助100万tokens的上下文窗口,Qwen 3.7-Plus 可在单次提示中处理整个软件仓库、长篇法律合同、图书长度的研究报告或大量对话历史——从而实现深层文档问答、跨文件代码库推理以及全面的摘要功能,无需分块策略或RAG流水线。
More to Compare

Qwen 3.7-Max 是阿里巴巴的专有 AI 模型,属于前沿层级,支持 100 万 Token 的上下文窗口。该模型现已直接在 FlowHunt 中使用。探索其基准测试得分、优势及推荐使用场景。...

GPT-4.1 是 OpenAI 推出的专有 AI 模型,属于高级(Advanced)层级,拥有 100 万 token 的上下文窗口。现可直接在 FlowHunt 中使用。了解其基准测试分数、优势及推荐使用场景。...

MiniMax M3 是 MiniMax 推出的开放权重 AI 模型(MoE,未公开参数),属于前沿层级,拥有 100 万 token 的上下文窗口。该模型已在 FlowHunt 中直接可用。探索其基准测试分数、优势及推荐使用场景。...