Alibaba logo

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max är en toppmodern frontier-AI-modell, utvecklad av Alibaba och lanserad i maj 2026. Det är en proprietär sluten modell, tillgänglig via Alibabas API. Kontextfönstret på 1M token är tillräckligt stort för att rymma hela kodbaser, långa tekniska dokument eller långvariga agentiska sessioner utan trunkering.

På FlowHunt AI Leaderboard är den en av 24 spårade modeller, utvärderade över 8 benchmarks. Utmärkande poäng: 89,6 % på MMLU-Pro (#1 av 8); 91,6 % på LiveCodeBench (#2 av 5); 41,4 % på HLE (#2 av 6).

Qwen 3.7-Max lanserades den 20 maj 2026 som toppmodellen i Alibabas Qwen 3-generation, och introducerade vad Alibaba kallade ett “tankeläge” — en förlängd kedja av tankeresonemang som kan aktiveras per fråga. I tankeläget utför modellen ett internt övervägningssteg innan den producerar sitt slutliga svar, vilket avsevärt förbättrar prestandan på flerstegsresonemang. Vid lanseringen fick Qwen 3.7-Max 92,4 % på GPQA Diamond (trea globalt), 91,6 % på LiveCodeBench och 60,6 % på SWE-bench Pro — den högsta öppna API-poängen på det benchmarket. I kombination med ett 1M kontextfönster och konkurrenskraftiga API-priser etablerade den sig som det främsta Frontier-nivåalternativet för kostnadsmedvetna företagsteam.

Not: GPQA Diamond-ledare (92,4 %). SWE-Pro-ledare (60,6 %). AA Index 56,6.

Released
May 2026
Context
1M tokens
Weights
Closed
Tier
Frontier
Provider
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Alibaba Group är en av Kinas största och mest diversifierade teknikkonglomerat, grundat 1999 av Jack Ma med huvudkontor i Hangzhou. Genom DAMO Academy och Tongyi Lab har Alibaba blivit en betydande kraft inom utvecklingen av stora språkmodeller med Qwen-familjen (Tongyi Qianwen). Generationen Qwen 3.7, som släpptes i mitten av 2026, markerade Alibabas övergång från inhemska utrullningar till internationell konkurrenskraft på riktmärken, med Qwen 3.7-Max som uppnådde 92,4 % på GPQA Diamond och 91,6 % på LiveCodeBench. Alibabas AI-strategi definieras av öppna viktmodeller som en motvikt till enbart API-baserade amerikanska modeller, integration av generativ AI inom dess moln- och e-handelsverksamhet, samt tung investering i AI-infrastruktur inom Alibaba Cloud-divisionen.

Användningsområden

Vad Qwen 3.7-Max Används Till

Mjukvaruutveckling
Vetenskapligt & Tekniskt Resonemang
Agentisk CLI-automation
Analys av Långa Dokument & Kodbaser
Tävlingsprogrammering

Strengths & Limitations

Strengths

  • Stark mjukvaruutveckling — 80 % SWE-bench Verified
  • Vetenskapligt resonemang på forskarnivå — 92 % GPQA Diamond
  • Tävlingsprogrammering — 91 % LiveCodeBench
  • Sammansatt intelligens — 56 p AA Intelligence Index (oberoende)
  • Mycket långa dokument och stora kodbaser (1M kontext)

Limitations

  • Slutna vikter — kan inte egenhostas eller finjusteras på privat data

Bläddra i Hela AI-modelltopplistan

Vanliga frågor

Lär dig mer

Qwen 3.7-Plus — Prestanda, kapacitet och användningsområden
Qwen 3.7-Plus — Prestanda, kapacitet och användningsområden

Qwen 3.7-Plus — Prestanda, kapacitet och användningsområden

Qwen 3.7-Plus är en proprietär AI-modell från Alibaba, klassificerad som Advanced-nivå med ett kontextfönster på 1 miljon tokens. Den finns tillgänglig direkt i...

3 min läsning
Qwen Max
Qwen Max

Qwen Max

Integrera FlowHunt med Qwen Max för att automatisera serverdrift, övervaka systemhälsa och maximera produktiviteten med intelligenta AI-drivna arbetsflöden för ...

3 min läsning
AI Qwen Max +3