
Qwen 3.7-Plus — benchmarky, schopnosti a případy použití
Qwen 3.7-Plus je proprietární model umělé inteligence od společnosti Alibaba, klasifikovaný jako pokročilá úroveň s kontextovým oknem 1 milion tokenů. Je dostup...
Qwen 3.7-Max je špičkový frontier AI model vyvinutý společností Alibaba, vydaný v květnu 2026. Jedná se o proprietární model s uzavřenými váhami, dostupný přes API Alibaba. Kontextové okno o velikosti 1M tokenů je dostatečně velké pro celé kódové základny, rozsáhlé technické dokumenty nebo dlouhé agentní relace bez nutnosti zkracování.
Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů, hodnocených napříč 8 benchmarky. Výrazná skóre: 89,6 % na MMLU-Pro (#1 z 8); 91,6 % na LiveCodeBench (#2 z 5); 41,4 % na HLE (#2 ze 6).
Qwen 3.7-Max byl vydán 20. května 2026 jako nejlepší model v generaci Alibaba Qwen 3, přičemž přinesl to, co Alibaba nazvala „režim přemýšlení“ — rozšířenou schopnost řetězového uvažování (chain-of-thought), kterou lze přepínat pro jednotlivé dotazy. V režimu přemýšlení model provede vnitřní rozvahu před tím, než vydá konečnou odpověď, což výrazně zlepšuje výkon u úloh vyžadujících vícestupňové uvažování. Při uvedení dosáhl Qwen 3.7-Max skóre 92,4 % na GPQA Diamond (třetí na světě), 91,6 % na LiveCodeBench a 60,6 % na SWE-bench Pro — nejvyšší skóre mezi modely s otevřeným API na tomto benchmarku. V kombinaci s 1M kontextovým oknem a konkurenceschopnými cenami API se etabloval jako primární alternativa na úrovni Frontier pro nákladově citlivé podnikové týmy.
Poznámka: GPQA Diamond lídr (92,4 %). SWE-Pro lídr (60,6 %). AA Index 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Alibaba Group je jedním z největších a nejrozmanitějších technologických konglomerátů v Číně, založený v roce 1999 Jackem Ma a sídlící v Chang-čou. Prostřednictvím své akademie DAMO a laboratoře Tongyi se Alibaba stala významnou silou ve vývoji velkých jazykových modelů s rodinou Qwen (Tongyi Qianwen). Generace Qwen 3.7, vydaná v polovině roku 2026, znamenala přechod Alibaba z domácího nasazení na mezinárodní benchmarkovou konkurenceschopnost – Qwen 3.7‑Max dosáhl 92,4 % na GPQA Diamond a 91,6 % na LiveCodeBench. AI strategii Alibaba definuje uvolňování modelů s otevřenými váhami jako protiváha k americkým modelům pouze s API, integrace generativní AI napříč jejími cloudovými a e‑commerce službami a masivní investice do AI infrastruktury v rámci divize Alibaba Cloud.
Případy použití
Qwen 3.7-Max dosahuje 80 % na SWE-bench Verified — umístěn #7 ze 13 zde sledovaných modelů. Řeší reálné GitHub problémy, píše produkční kód ve více jazycích a zvládá vícestupňové agentní kódovací workflow — silná volba pro týmy využívající AI asistované vývoje softwaru.
S 92 % na GPQA Diamond (#4 ze 14 modelů) Qwen 3.7-Max překonává přibližně 65% hranici lidských expertů s PhD na otázkách z biologie, chemie a fyziky na úrovni postgraduálního studia. Využijte jej pro syntézu vědecké literatury, hodnocení hypotéz, medicínské a právní dotazy a mezioborové výzkumné úlohy, kde záleží na hlubokých doménových znalostech.
Qwen 3.7-Max dosahuje 69 % na Terminal-Bench (#3 z 8 modelů), což jej činí kompetentním pro běžné skriptování v shellu, příkazové řádkové workflow a lehké úlohy správy systému v rámci agentních pipeline.
S kontextovým oknem 1M tokenů dokáže Qwen 3.7-Max zpracovat celé softwarové repozitáře, dlouhé právní smlouvy, knižní výzkumné zprávy nebo rozsáhlé historie konverzací v jediném promptu — což umožňuje hluboké dotazování nad dokumenty, uvažování napříč soubory kódové základny a komplexní analýzu bez nutnosti chunkování nebo RAG pipeline.
Qwen 3.7-Max dosahuje 91 % na LiveCodeBench (#2 z 5 modelů), benchmarku odolném vůči kontaminaci, který je průběžně obnovován o nové soutěžní programátorské úlohy. Na této úrovni zvládá pokročilé datové struktury, grafové algoritmy a úlohy na úrovni technických pohovorů s vysokou spolehlivostí.
Více k porovnání
Porovnejte všech 24 modelů napříč 11 benchmarky — řaditelné, zdrojované, aktualizováno červen 2026.

Qwen 3.7-Plus je proprietární model umělé inteligence od společnosti Alibaba, klasifikovaný jako pokročilá úroveň s kontextovým oknem 1 milion tokenů. Je dostup...

MiniMax M3 je open-weight model AI od společnosti MiniMax (MoE (nezveřejněno)), klasifikovaný jako Frontier s kontextovým oknem 1M tokenů. Je k dispozici přímo ...

Nemotron 3 Ultra je otevřený model AI od NVIDIA (55B/550B MoE), klasifikovaný jako Frontier s kontextovým oknem 262 000 tokenů. Je k dispozici přímo v FlowHunt....
Souhlas s cookies
Používáme cookies ke zlepšení vašeho prohlížení a analýze naší návštěvnosti. See our privacy policy.