
Qwen 3.7-Plus – Vertailuarvot, ominaisuudet ja käyttötapaukset
Qwen 3.7-Plus on Alibaban oma tekoälymalli, joka luokitellaan Advanced-tasolle ja jossa on 1 miljoonan tokenin konteksti-ikkuna. Se on suoraan saatavilla FlowHu...
Qwen 3.7-Max on huippuluokan Frontier-tekoälymalli, jonka on kehittänyt Alibaba ja joka julkaistiin toukokuussa 2026. Se on suljettu malli, joka on saatavilla Alibaban API:n kautta. 1 miljoonan tokenin konteksti-ikkuna on riittävän suuri käsittelemään kokonaisia koodikantoja, laajoja teknisiä dokumentteja tai pitkiä agenttisessioita ilman katkaisua.
FlowHuntin AI Leaderboardissa se on yksi 24 seuratusta mallista, ja se on arvioitu 8 vertailuarvossa. Huomattavia tuloksia: 89,6 % MMLU-Prossa (#1/8); 91,6 % LiveCodeBenchissa (#2/5); 41,4 % HLE:ssä (#2/6).
Qwen 3.7-Max julkaistiin 20. toukokuuta 2026 Alibaban Qwen 3 -sukupolven huippumallina, ja se toi mukanaan Alibaban kutsuman ‘ajattelutilan’ — laajennetun päättelyketjun, joka voidaan ottaa käyttöön kyselykohtaisesti. Ajattelutilassa malli suorittaa sisäisen harkintavaiheen ennen lopullisen vastauksen tuottamista, mikä parantaa suorituskykyä huomattavasti monivaiheisissa päättelytehtävissä. Julkaisuhetkellä Qwen 3.7-Max saavutti 92,4 % GPQA Diamondissa (kolmanneksi paras maailmassa), 91,6 % LiveCodeBenchissa ja 60,6 % SWE-bench Prossa — korkein avoimen API:n pistemäärä kyseisessä vertailuarvossa. Yhdistettynä 1 miljoonan tokenin konteksti-ikkunaan ja kilpailukykyiseen API-hinnoitteluun se vakiinnutti asemansa ensisijaisena Frontier-tason vaihtoehtona kustannustietoisille yritystiimeille.
Huomio: GPQA Diamond -johtaja (92,4 %). SWE-Pro -johtaja (60,6 %). AA-indeksi 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Alibaba Group on yksi Kiinan suurimmista ja monipuolisimmista teknologiakonserneista, jonka Jack Ma perusti vuonna 1999 ja jonka pääkonttori sijaitsee Hangzhoussa. DAMO Academyn ja Tongyi Labin kautta Alibabasta on tullut merkittävä voima suurten kielimallien kehityksessä Qwen (Tongyi Qianwen) -malliperheen myötä. Vuoden 2026 puolivälissä julkaistu Qwen 3.7 -sukupolvi merkitsi Alibaban siirtymää kotimaisista käyttöönotoista kansainväliseen vertailukelpoisuuteen, ja Qwen 3.7-Max saavutti 92,4 % GPQA Diamondissa ja 91,6 % LiveCodeBenchissa. Alibaban tekoälystrategia määräytyy avointen painojen julkaisujen kautta vastapainona yhdysvaltalaisille API-vain -malleille, generatiivisen tekoälyn integroinnista sen pilvi- ja verkkokauppaliiketoimintoihin sekä mittavista investoinneista tekoälyinfrastruktuuriin Alibaba Cloud -divisioonassaan.
Käyttötapaukset
Qwen 3.7-Max saavuttaa 80 % SWE-bench Verified -testissä — sijalla #7/13 tässä seuratusta mallista. Se ratkaisee oikeita GitHub-ongelmia, kirjoittaa tuotantolaatuista koodia useilla kielillä ja hallitsee monivaiheisia agenttisia koodaustyönkulkuja — vahva valinta tekoälyavusteisille ohjelmistokehitystiimeille.
Saavuttaen 92 % GPQA Diamondissa (#4/14 mallista), Qwen 3.7-Max ylittää noin 65 %:n ihmisten tohtoritason perustason biologian, kemian ja fysiikan jatkokysymyksissä. Käytä sitä tieteellisen kirjallisuuden synteesiin, hypoteesien arviointiin, lääketieteelliseen ja juridiseen kyselyvastaukseen sekä monitieteisiin tutkimustehtäviin, joissa syvä asiantuntemus on tärkeää.
Qwen 3.7-Max saavuttaa 69 % Terminal-Benchissä (#3/8 mallista), mikä tekee siitä pätevän yleisille shell-skriptauksille, komentorivityönkuluille ja kevyille järjestelmänhallintatehtäville agenttiputkissa.
1 miljoonan tokenin konteksti-ikkunallaan Qwen 3.7-Max pystyy käsittelemään kokonaisia ohjelmistovarastoja, pitkiä juridisia sopimuksia, kirjanmittaisia tutkimusraportteja tai laajoja keskusteluhistorioita yhdessä kehotteessa — mahdollistaen syvällisen dokumenttien kysely-vastauksen, tiedostojen välisen koodikanta-analyysin ja kattavan yhteenvedon ilman paloittelua tai RAG-putkia.
Qwen 3.7-Max saavuttaa 91 % LiveCodeBenchissa (#2/5 mallista), joka on kontaminaationkestävä vertailuarvo, jota päivitetään jatkuvasti uusilla kilpailullisilla ohjelmointiongelmilla. Tällä tasolla se käsittelee edistyneitä tietorakenteita, graafialgoritmeja ja haastattelutason ongelmia korkealla luotettavuudella.
Lisää Vertailtavaa
Vertaa kaikkia 24 mallia 11 vertailuarvossa — lajiteltava, lähdeviitteellinen ja päivitetty kesäkuussa 2026.

Qwen 3.7-Plus on Alibaban oma tekoälymalli, joka luokitellaan Advanced-tasolle ja jossa on 1 miljoonan tokenin konteksti-ikkuna. Se on suoraan saatavilla FlowHu...

MiniMax M3 on avoimen painoarvon tekoälymalli MiniMaxilta (MoE (julkaisematon)), luokiteltuna Frontier-tasolle, 1 miljoonan tokenin konteksti-ikkunalla. Se on s...

Tutustu tekoälyn viimeisimpiin kehitysaskeleisiin, kuten Alibaban Qwen3-Max-malliin, OpenAI:n for-profit-muutoshaasteisiin, uusiin kuvamalleihin sekä siihen, mi...