Logo Alibaba

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max è un modello AI frontier di alto livello, sviluppato da Alibaba e rilasciato nel maggio 2026. Si tratta di un modello proprietario a pesi chiusi, disponibile tramite l’API di Alibaba. La finestra di contesto da 1 milione di token è sufficientemente grande da contenere interi codebase, lunghi documenti tecnici o sessioni agentiche estese senza troncamenti.

Nella Classifica AI di FlowHunt è uno dei 24 modelli monitorati, valutato su 8 benchmark. Punteggi di rilievo: 89,6% su MMLU-Pro (#1 su 8); 91,6% su LiveCodeBench (#2 su 5); 41,4% su HLE (#2 su 6).

Qwen 3.7-Max è stato rilasciato il 20 maggio 2026 come modello di punta della generazione Qwen 3 di Alibaba, introducendo quella che Alibaba ha chiamato ‘modalità pensiero’ — una capacità di ragionamento a catena di pensiero estesa che può essere attivata per ogni singola richiesta. In modalità pensiero, il modello esegue una fase di deliberazione interna prima di produrre la risposta finale, migliorando significativamente le prestazioni su compiti di ragionamento a più fasi. Al lancio, Qwen 3.7-Max ha ottenuto il 92,4% su GPQA Diamond (terzo a livello globale), il 91,6% su LiveCodeBench e il 60,6% su SWE-bench Pro — il punteggio più alto su quel benchmark tra i modelli con API aperta. Combinato con una finestra di contesto da 1 milione di token e prezzi API competitivi, si è affermato come la principale alternativa di livello Frontier per i team aziendali attenti ai costi.

Nota: GPQA Diamond leader (92,4%). SWE-Pro leader (60,6%). AA Index 56,6.

Rilasciato
Maggio 2026
Contesto
1M token
Pesi
Chiusi
Livello
Frontier
Fornitore
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Alibaba Group è uno dei più grandi e diversificati conglomerati tecnologici cinesi, fondato nel 1999 da Jack Ma e con sede a Hangzhou. Attraverso la DAMO Academy e il Tongyi Lab, Alibaba è diventata una forza importante nello sviluppo di modelli linguistici di grandi dimensioni con la famiglia Qwen (Tongyi Qianwen). La generazione Qwen 3.7, rilasciata a metà del 2026, ha segnato la transizione di Alibaba dalle implementazioni domestiche alla competitività internazionale nei benchmark, con Qwen 3.7-Max che ha ottenuto il 92,4% su GPQA Diamond e il 91,6% su LiveCodeBench. La strategia IA di Alibaba è definita dal rilascio di modelli a pesi aperti come contrappeso ai modelli statunitensi solo API, dall'integrazione dell'IA generativa nei suoi settori cloud ed e-commerce, e da forti investimenti nell'infrastruttura IA in tutta la divisione Alibaba Cloud.

Casi d'Uso

Per Cosa Usare Qwen 3.7-Max

Ingegneria del Software
Ragionamento Scientifico e Tecnico
Automazione Agentica CLI
Analisi di Documenti Lunghi e Codebase
Programmazione Competitiva

Strengths & Limitations

Strengths

  • Forte nell'ingegneria del software — 80% SWE-bench Verified
  • Ragionamento scientifico a livello universitario — 92% GPQA Diamond
  • Programmazione competitiva — 91% LiveCodeBench
  • Intelligenza composita — 56 pt AA Intelligence Index (indipendente)
  • Documenti molto lunghi e grandi codebase (contesto da 1M)

Limitations

  • Pesi chiusi — non può essere ospitato autonomamente o ottimizzato su dati privati

Sfoglia la Classifica Completa dei Modelli AI

Domande frequenti

Scopri di più

Qwen 3.7-Plus — Benchmark, Capacità e Casi d'Uso
Qwen 3.7-Plus — Benchmark, Capacità e Casi d'Uso

Qwen 3.7-Plus — Benchmark, Capacità e Casi d'Uso

Qwen 3.7-Plus è un modello di IA proprietario di Alibaba, classificato come livello Advanced con una finestra di contesto di 1 milione di token. È disponibile d...

3 min di lettura
MiniMax M3 — Benchmark, Capacità e Casi d'Uso
MiniMax M3 — Benchmark, Capacità e Casi d'Uso

MiniMax M3 — Benchmark, Capacità e Casi d'Uso

MiniMax M3 è un modello AI open-weight di MiniMax (MoE (non divulgato)), classificato come livello Frontier con una finestra di contesto di 1 milione di token. ...

4 min di lettura
Qwen3-Max, Ristrutturazione di OpenAI, Aggiornamenti Claude
Qwen3-Max, Ristrutturazione di OpenAI, Aggiornamenti Claude

Qwen3-Max, Ristrutturazione di OpenAI, Aggiornamenti Claude

Esplora gli ultimi sviluppi dell’IA, tra cui il Qwen3-Max di Alibaba, le sfide della conversione a scopo di lucro di OpenAI, i nuovi modelli di generazione di i...

19 min di lettura
AI Machine Learning +3