
Qwen 3.7-Plus — Prestanda, kapacitet och användningsområden
Qwen 3.7-Plus är en proprietär AI-modell från Alibaba, klassificerad som Advanced-nivå med ett kontextfönster på 1 miljon tokens. Den finns tillgänglig direkt i...
Qwen 3.7-Max är en toppmodern frontier-AI-modell, utvecklad av Alibaba och lanserad i maj 2026. Det är en proprietär sluten modell, tillgänglig via Alibabas API. Kontextfönstret på 1M token är tillräckligt stort för att rymma hela kodbaser, långa tekniska dokument eller långvariga agentiska sessioner utan trunkering.
På FlowHunt AI Leaderboard är den en av 24 spårade modeller, utvärderade över 8 benchmarks. Utmärkande poäng: 89,6 % på MMLU-Pro (#1 av 8); 91,6 % på LiveCodeBench (#2 av 5); 41,4 % på HLE (#2 av 6).
Qwen 3.7-Max lanserades den 20 maj 2026 som toppmodellen i Alibabas Qwen 3-generation, och introducerade vad Alibaba kallade ett “tankeläge” — en förlängd kedja av tankeresonemang som kan aktiveras per fråga. I tankeläget utför modellen ett internt övervägningssteg innan den producerar sitt slutliga svar, vilket avsevärt förbättrar prestandan på flerstegsresonemang. Vid lanseringen fick Qwen 3.7-Max 92,4 % på GPQA Diamond (trea globalt), 91,6 % på LiveCodeBench och 60,6 % på SWE-bench Pro — den högsta öppna API-poängen på det benchmarket. I kombination med ett 1M kontextfönster och konkurrenskraftiga API-priser etablerade den sig som det främsta Frontier-nivåalternativet för kostnadsmedvetna företagsteam.
Not: GPQA Diamond-ledare (92,4 %). SWE-Pro-ledare (60,6 %). AA Index 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Alibaba Group är en av Kinas största och mest diversifierade teknikkonglomerat, grundat 1999 av Jack Ma med huvudkontor i Hangzhou. Genom DAMO Academy och Tongyi Lab har Alibaba blivit en betydande kraft inom utvecklingen av stora språkmodeller med Qwen-familjen (Tongyi Qianwen). Generationen Qwen 3.7, som släpptes i mitten av 2026, markerade Alibabas övergång från inhemska utrullningar till internationell konkurrenskraft på riktmärken, med Qwen 3.7-Max som uppnådde 92,4 % på GPQA Diamond och 91,6 % på LiveCodeBench. Alibabas AI-strategi definieras av öppna viktmodeller som en motvikt till enbart API-baserade amerikanska modeller, integration av generativ AI inom dess moln- och e-handelsverksamhet, samt tung investering i AI-infrastruktur inom Alibaba Cloud-divisionen.
Användningsområden
Qwen 3.7-Max får 80 % på SWE-bench Verified — rankad #7 av 13 modeller som spåras här. Den löser verkliga GitHub-problem, skriver produktionsklar kod på flera språk och hanterar flerstegs agentiska kodningsarbetsflöden — ett starkt val för AI-assisterade mjukvaruutvecklingsteam.
Med 92 % på GPQA Diamond (#4 av 14 modeller) överträffar Qwen 3.7-Max den ungefärliga baslinjen på ~65 % för doktorsexpertis inom biologi, kemi och fysik på forskarnivå. Använd den för syntes av vetenskaplig litteratur, hypotesutvärdering, medicinska och juridiska frågor och svar, samt tvärvetenskapliga forskningsuppgifter där djup domänkunskap är viktig.
Qwen 3.7-Max uppnår 69 % på Terminal-Bench (#3 av 8 modeller), vilket gör den kompetent för vanligt shellskriptande, kommandoradsarbetsflöden och lätta systemadministrationsuppgifter i agentiska pipelines.
Med ett kontextfönster på 1M token kan Qwen 3.7-Max bearbeta hela programvarurepositorier, långa juridiska avtal, boklånga forskningsrapporter eller omfattande samtalshistorik i en enda fråga — vilket möjliggör djupgående dokumentfrågor, kodbasresonemang över flera filer och omfattande sammanfattning utan chunkningsheuristik eller RAG-pipelines.
Qwen 3.7-Max får 91 % på LiveCodeBench (#2 av 5 modeller), ett kontamineringsresistent benchmark som kontinuerligt uppdateras med nya tävlingsprogrammeringsproblem. På denna nivå hanterar den avancerade datastrukturer, grafalgorithmer och intervjunivåutmaningar med hög tillförlitlighet.
Mer att Jämföra
Jämför alla 24 modeller över 11 benchmarks — sorterbara, källbelagda och uppdaterade juni 2026.

Qwen 3.7-Plus är en proprietär AI-modell från Alibaba, klassificerad som Advanced-nivå med ett kontextfönster på 1 miljon tokens. Den finns tillgänglig direkt i...

MiniMax M3 är en AI-modell med öppna vikter från MiniMax (MoE (ej offentliggjord)), klassificerad som Frontier-nivå med ett kontextfönster på 1M token. Den finn...

Integrera FlowHunt med Qwen Max för att automatisera serverdrift, övervaka systemhälsa och maximera produktiviteten med intelligenta AI-drivna arbetsflöden för ...