Alibaba logo

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max este un model AI de top, de nivel frontieră, dezvoltat de Alibaba și lansat în mai 2026. Este un model proprietar cu greutăți închise, disponibil prin API-ul Alibaba. Fereastra de context de 1 milion de tokeni este suficient de mare pentru a cuprinde baze de cod întregi, documente tehnice lungi sau sesiuni agentice extinse, fără trunchiere.

Pe Clasamentul AI FlowHunt, este unul dintre cele 24 de modele urmărite, evaluate pe 8 benchmark-uri. Scoruri remarcabile: 89,6% pe MMLU-Pro (#1 din 8); 91,6% pe LiveCodeBench (#2 din 5); 41,4% pe HLE (#2 din 6).

Qwen 3.7-Max a fost lansat pe 20 mai 2026 ca modelul de top din generația Qwen 3 a Alibaba, introducând ceea ce Alibaba a numit un „mod de gândire" — o capacitate extinsă de raționament în lanț de gândire care poate fi activată pentru fiecare interogare. În modul de gândire, modelul execută un pas intern de deliberare înainte de a produce răspunsul final, îmbunătățind substanțial performanța la sarcinile de raționament în mai mulți pași. La lansare, Qwen 3.7-Max a obținut 92,4% pe GPQA Diamond (locul trei la nivel global), 91,6% pe LiveCodeBench și 60,6% pe SWE-bench Pro — cel mai mare scor open-API la acest benchmark. Combinat cu o fereastră de context de 1 milion de tokeni și prețuri competitive la API, s-a impus ca principala alternativă de nivel Frontier pentru echipele enterprise preocupate de costuri.

Notă: Lider GPQA Diamond (92,4%). Lider SWE-Pro (60,6%). Indice AA 56,6.

Lansat
Mai 2026
Context
1M tokeni
Greutăți
Închise
Nivel
Frontier
Furnizor
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Alibaba Group este unul dintre cele mai mari și mai diverse conglomerate tehnologice din China, fondat în 1999 de Jack Ma și cu sediul în Hangzhou. Prin Academia DAMO și Tongyi Lab, Alibaba a devenit o forță majoră în dezvoltarea modelelor lingvistice mari cu familia Qwen (Tongyi Qianwen). Generația Qwen 3.7, lansată la jumătatea anului 2026, a marcat tranziția Alibaba de la implementări interne la competitivitate pe criterii de referință internaționale, Qwen 3.7-Max obținând 92,4% pe GPQA Diamond și 91,6% pe LiveCodeBench. Strategia AI a Alibaba este definită de lansări cu greutăți deschise ca un contrabalans la modelele americane exclusiv prin API, integrarea AI-ului generativ în afacerile sale de cloud și comerț electronic și investiții masive în infrastructura AI în cadrul diviziei sale Alibaba Cloud.

Cazuri de Utilizare

Pentru Ce Să Folosești Qwen 3.7-Max

Inginerie Software
Raționament Științific și Tehnic
Automatizare CLI Agentică
Analiza Documentelor Lungi și a Bazelor de Cod
Programare Competitivă

Strengths & Limitations

Strengths

  • Inginerie software puternică — 80% SWE-bench Verified
  • Raționament științific de nivel postuniversitar — 92% GPQA Diamond
  • Programare competitivă — 91% LiveCodeBench
  • Inteligență compozită — 56 pts AA Intelligence Index (independent)
  • Documente foarte lungi și baze de cod mari (1M context)

Limitations

  • Greutăți închise — nu poate fi auto-găzduit sau fine-tunat pe date private

Vezi Clasamentul Complet al Modelelor AI

Întrebări frecvente

Află mai multe

Qwen Max
Qwen Max

Qwen Max

Integrează FlowHunt cu Qwen Max pentru a automatiza operațiunile serverului, a monitoriza sănătatea sistemului și a-ți crește productivitatea folosind fluxuri d...

4 min citire
AI Qwen Max +3