Alibaba logo

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max je špičkový frontiérsky AI model vyvinutý spoločnosťou Alibaba a vydaný v máji 2026. Ide o proprietárny model s uzavretými váhami, dostupný prostredníctvom API spoločnosti Alibaba. Kontextové okno s veľkosťou 1 milión tokenov je dostatočne veľké na to, aby poňalo celé kódové základne, rozsiahle technické dokumenty alebo dlhé agentské relácie bez skracovania.

Na FlowHunt AI Leaderboard je jedným z 24 sledovaných modelov, vyhodnotených na 8 benchmarkoch. Výnimočné skóre: 89,6 % na MMLU-Pro (#1 z 8); 91,6 % na LiveCodeBench (#2 z 5); 41,4 % na HLE (#2 zo 6).

Qwen 3.7-Max bol vydaný 20. mája 2026 ako vlajkový model v generácii Qwen 3 od Alibaba, pričom priniesol to, čo Alibaba nazvala „thinking mode" — rozšírenú schopnosť uvažovania v reťazci myšlienok, ktorú je možné prepínať pre jednotlivé dopyty. V režime uvažovania model vykonáva interný krok rozmyslenia pred vytvorením konečnej odpovede, čo výrazne zlepšuje výkon pri viacstupňových úlohách vyžadujúcich logické uvažovanie. Pri uvedení dosiahol Qwen 3.7-Max skóre 92,4 % na GPQA Diamond (tretí na svete), 91,6 % na LiveCodeBench a 60,6 % na SWE-bench Pro — najvyššie skóre spomedzi modelov s otvoreným API na tomto benchmarku. V kombinácii s 1M kontextovým oknom a konkurencieschopnou cenou API sa etabloval ako primárna alternatíva v kategórii Frontier pre nákladovo orientované podnikové tímy.

Poznámka: GPQA Diamond líder (92,4 %). SWE-Pro líder (60,6 %). AA Index 56,6.

Vydaný
Máj 2026
Kontext
1M tokenov
Váhy
Uzavreté
Úroveň
Frontier
Poskytovateľ
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Alibaba Group je jedným z najväčších a najrozmanitejších technologických konglomerátov v Číne, založený v roku 1999 Jackom Ma a so sídlom v Chang-čou. Prostredníctvom svojej akadémie DAMO a laboratória Tongyi sa Alibaba stala významnou silou vo vývoji veľkých jazykových modelov s rodinou Qwen (Tongyi Qianwen). Generácia Qwen 3.7, vydaná v polovici roku 2026, znamenala prechod Alibaby z domácich nasadení na medzinárodnú konkurencieschopnosť v benchmarkoch, pričom Qwen 3.7-Max dosiahol 92,4 % na GPQA Diamond a 91,6 % na LiveCodeBench. Stratégia AI spoločnosti Alibaba je definovaná vydávaním otvorených váh ako protiváhy k americkým modelom len s API, integráciou generatívnej AI do svojich cloudových a elektronických obchodných činností a výraznými investíciami do infraštruktúry AI v rámci svojej divízie Alibaba Cloud.

Prípady použitia

Na čo použiť Qwen 3.7-Max

Softvérové inžinierstvo
Vedecké a technické uvažovanie
Agentská automatizácia CLI
Analýza dlhých dokumentov a kódových základní
Súťažné programovanie

Strengths & Limitations

Strengths

  • Silné softvérové inžinierstvo — 80 % SWE-bench Verified
  • Vedecké uvažovanie na úrovni postgraduálu — 92 % GPQA Diamond
  • Súťažné programovanie — 91 % LiveCodeBench
  • Kompozitná inteligencia — 56 b. AA Intelligence Index (nezávislý)
  • Veľmi dlhé dokumenty a rozsiahle kódové základne (1M kontext)

Limitations

  • Uzavreté váhy — nie je možné ho hostovať vlastnými silami ani doladiť na súkromných dátach

Prezrite si kompletný rebríček AI modelov

Najčastejšie kladené otázky

Zistiť viac

Qwen 3.7-Plus — Benchmarky, schopnosti a prípady použitia
Qwen 3.7-Plus — Benchmarky, schopnosti a prípady použitia

Qwen 3.7-Plus — Benchmarky, schopnosti a prípady použitia

Qwen 3.7-Plus je proprietárny AI model od spoločnosti Alibaba, klasifikovaný ako Advanced úroveň s kontextovým oknom 1M tokenov. Je dostupný priamo v FlowHunt. ...

3 min čítania
MiniMax M3 — Benchmarky, schopnosti a prípady použitia
MiniMax M3 — Benchmarky, schopnosti a prípady použitia

MiniMax M3 — Benchmarky, schopnosti a prípady použitia

MiniMax M3 je open-weight AI model od spoločnosti MiniMax (MoE (nezverejnené)), klasifikovaný ako Frontier úroveň s kontextovým oknom 1M tokenov. Je dostupný pr...

4 min čítania
Qwen3-Max, reštrukturalizácia OpenAI, aktualizácie Claude
Qwen3-Max, reštrukturalizácia OpenAI, aktualizácie Claude

Qwen3-Max, reštrukturalizácia OpenAI, aktualizácie Claude

Preskúmajte najnovší vývoj v oblasti umelej inteligencie vrátane Qwen3-Max od Alibaby, problémov OpenAI s prechodom na ziskovú spoločnosť, nových modelov genero...

15 min čítania
AI Machine Learning +3