
Qwen 3.7-Plus — Benchmarky, schopnosti a prípady použitia
Qwen 3.7-Plus je proprietárny AI model od spoločnosti Alibaba, klasifikovaný ako Advanced úroveň s kontextovým oknom 1M tokenov. Je dostupný priamo v FlowHunt. ...
Qwen 3.7-Max je špičkový frontiérsky AI model vyvinutý spoločnosťou Alibaba a vydaný v máji 2026. Ide o proprietárny model s uzavretými váhami, dostupný prostredníctvom API spoločnosti Alibaba. Kontextové okno s veľkosťou 1 milión tokenov je dostatočne veľké na to, aby poňalo celé kódové základne, rozsiahle technické dokumenty alebo dlhé agentské relácie bez skracovania.
Na FlowHunt AI Leaderboard je jedným z 24 sledovaných modelov, vyhodnotených na 8 benchmarkoch. Výnimočné skóre: 89,6 % na MMLU-Pro (#1 z 8); 91,6 % na LiveCodeBench (#2 z 5); 41,4 % na HLE (#2 zo 6).
Qwen 3.7-Max bol vydaný 20. mája 2026 ako vlajkový model v generácii Qwen 3 od Alibaba, pričom priniesol to, čo Alibaba nazvala „thinking mode" — rozšírenú schopnosť uvažovania v reťazci myšlienok, ktorú je možné prepínať pre jednotlivé dopyty. V režime uvažovania model vykonáva interný krok rozmyslenia pred vytvorením konečnej odpovede, čo výrazne zlepšuje výkon pri viacstupňových úlohách vyžadujúcich logické uvažovanie. Pri uvedení dosiahol Qwen 3.7-Max skóre 92,4 % na GPQA Diamond (tretí na svete), 91,6 % na LiveCodeBench a 60,6 % na SWE-bench Pro — najvyššie skóre spomedzi modelov s otvoreným API na tomto benchmarku. V kombinácii s 1M kontextovým oknom a konkurencieschopnou cenou API sa etabloval ako primárna alternatíva v kategórii Frontier pre nákladovo orientované podnikové tímy.
Poznámka: GPQA Diamond líder (92,4 %). SWE-Pro líder (60,6 %). AA Index 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Alibaba Group je jedným z najväčších a najrozmanitejších technologických konglomerátov v Číne, založený v roku 1999 Jackom Ma a so sídlom v Chang-čou. Prostredníctvom svojej akadémie DAMO a laboratória Tongyi sa Alibaba stala významnou silou vo vývoji veľkých jazykových modelov s rodinou Qwen (Tongyi Qianwen). Generácia Qwen 3.7, vydaná v polovici roku 2026, znamenala prechod Alibaby z domácich nasadení na medzinárodnú konkurencieschopnosť v benchmarkoch, pričom Qwen 3.7-Max dosiahol 92,4 % na GPQA Diamond a 91,6 % na LiveCodeBench. Stratégia AI spoločnosti Alibaba je definovaná vydávaním otvorených váh ako protiváhy k americkým modelom len s API, integráciou generatívnej AI do svojich cloudových a elektronických obchodných činností a výraznými investíciami do infraštruktúry AI v rámci svojej divízie Alibaba Cloud.
Prípady použitia
Qwen 3.7-Max dosahuje 80 % na SWE-bench Verified — umiestnený na #7 z 13 modelov sledovaných tu. Rieši reálne GitHub problémy, píše produkčný kód vo viacerých jazykoch a zvláda viacstupňové agentské programátorské pracovné postupy — je to silná voľba pre tímy využívajúce AI pri vývoji softvéru.
S výsledkom 92 % na GPQA Diamond (#4 zo 14 modelov) prekračuje Qwen 3.7-Max približne 65 % hranicu ľudského experta s PhD na otázkach z biológie, chémie a fyziky na postgraduálnej úrovni. Využite ho na syntézu vedeckej literatúry, vyhodnocovanie hypotéz, medicínske a právne otázky a odpovede, ako aj výskumné úlohy z viacerých disciplín, kde záleží na hlbokých doménových znalostiach.
Qwen 3.7-Max dosahuje 69 % na Terminal-Bench (#3 z 8 modelov), vďaka čomu je kompetentný na bežné shellové skriptovanie, príkazové riadkové pracovné postupy a ľahké úlohy správy systému v rámci agentských pipeline.
S kontextovým oknom 1 milión tokenov dokáže Qwen 3.7-Max spracovať celé softvérové repozitáre, dlhé právne zmluvy, knihám podobné výskumné správy alebo rozsiahle histórie konverzácií v jedinom dopyte — čo umožňuje hĺbkovú dokumentovú Q&A, analýzu kódových základní naprieč súbormi a komplexné sumarizovanie bez potreby heuristík delenia na časti alebo RAG pipeline.
Qwen 3.7-Max dosahuje 91 % na LiveCodeBench (#2 z 5 modelov), čo je benchmark odolný voči kontaminácii, ktorý je priebežne obnovovaný novými súťažnými programovacími úlohami. Na tejto úrovni zvláda pokročilé dátové štruktúry, grafové algoritmy a výzvy na úrovni pohovorov s vysokou spoľahlivosťou.
Ďalšie na porovnanie
Porovnajte všetkých 24 modelov naprieč 11 benchmarkmi — zoraditeľné, so zdrojmi a aktualizované jún 2026.

Qwen 3.7-Plus je proprietárny AI model od spoločnosti Alibaba, klasifikovaný ako Advanced úroveň s kontextovým oknom 1M tokenov. Je dostupný priamo v FlowHunt. ...

MiniMax M3 je open-weight AI model od spoločnosti MiniMax (MoE (nezverejnené)), klasifikovaný ako Frontier úroveň s kontextovým oknom 1M tokenov. Je dostupný pr...

Preskúmajte najnovší vývoj v oblasti umelej inteligencie vrátane Qwen3-Max od Alibaby, problémov OpenAI s prechodom na ziskovú spoločnosť, nových modelov genero...
Súhlas s cookies
Používame cookies na vylepšenie vášho prehliadania a analýzu našej návštevnosti. See our privacy policy.