Logotipo da Alibaba

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

O Qwen 3.7-Max é um modelo de IA frontier de alto nível, desenvolvido pela Alibaba e lançado em maio de 2026. É um modelo proprietário de pesos fechados, disponível através da API da Alibaba. A janela de contexto de 1 milhão de tokens é grande o suficiente para conter bases de código inteiras, documentos técnicos extensos ou sessões agênticas prolongadas sem truncamento.

No FlowHunt AI Leaderboard, é um dos 24 modelos monitorados, avaliado em 8 benchmarks. Pontuações de destaque: 89,6% no MMLU-Pro (#1 de 8); 91,6% no LiveCodeBench (#2 de 5); 41,4% no HLE (#2 de 6).

O Qwen 3.7-Max foi lançado em 20 de maio de 2026 como o principal modelo da geração Qwen 3 da Alibaba, introduzindo o que a Alibaba chamou de ‘modo de pensamento’ — uma capacidade de raciocínio de cadeia de pensamento estendida que pode ser ativada por consulta. No modo de pensamento, o modelo executa uma etapa de deliberação interna antes de produzir sua resposta final, melhorando substancialmente o desempenho em tarefas de raciocínio de múltiplas etapas. No lançamento, o Qwen 3.7-Max obteve 92,4% no GPQA Diamond (terceiro globalmente), 91,6% no LiveCodeBench e 60,6% no SWE-bench Pro — a maior pontuação de API aberta nesse benchmark. Combinado com uma janela de contexto de 1 milhão de tokens e preços de API competitivos, estabeleceu-se como a principal alternativa de nível Frontier para equipes empresariais conscientes com custos.

Nota: Líder GPQA Diamond (92,4%). Líder SWE-Pro (60,6%). AA Index 56,6.

Lançamento
Maio de 2026
Contexto
1 milhão de tokens
Pesos
Fechados
Nível
Frontier
Provedor
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

O Grupo Alibaba é um dos maiores e mais diversificados conglomerados tecnológicos da China, fundado em 1999 por Jack Ma e com sede em Hangzhou. Através da sua DAMO Academy e Tongyi Lab, a Alibaba tornou-se uma força importante no desenvolvimento de modelos de linguagem de grande escala com a família Qwen (Tongyi Qianwen). A geração Qwen 3.7, lançada em meados de 2026, marcou a transição da Alibaba de implantações domésticas para competitividade em referências internacionais, com o Qwen 3.7-Max a alcançar 92,4% no GPQA Diamond e 91,6% no LiveCodeBench. A estratégia de IA da Alibaba é definida por lançamentos de pesos abertos como contrapeso aos modelos exclusivos de API dos EUA, integração de IA generativa em todos os seus negócios de cloud e comércio eletrónico, e forte investimento em infraestrutura de IA na sua divisão Alibaba Cloud.

Casos de Uso

Para Que Usar o Qwen 3.7-Max

Engenharia de Software
Raciocínio Científico e Técnico
Automação Agêntica de CLI
Análise de Documentos Longos e Bases de Código
Programação Competitiva

Strengths & Limitations

Strengths

  • Forte em engenharia de software — 80% SWE-bench Verified
  • Raciocínio científico de nível de pós-graduação — 92% GPQA Diamond
  • Programação competitiva — 91% LiveCodeBench
  • Inteligência composta — 56 pts AA Intelligence Index (independente)
  • Documentos muito longos e grandes bases de código (contexto de 1 milhão)

Limitations

  • Pesos fechados — não pode ser auto-hospedado ou ajustado em dados privados

Confira o Ranking Completo de Modelos de IA

Perguntas frequentes

Saiba mais

Qwen 3.7-Plus — Benchmarks, Capacidades e Casos de Uso
Qwen 3.7-Plus — Benchmarks, Capacidades e Casos de Uso

Qwen 3.7-Plus — Benchmarks, Capacidades e Casos de Uso

Qwen 3.7-Plus é um modelo de IA proprietário da Alibaba, classificado como nível Avançado com uma janela de contexto de 1 milhão de tokens. Está disponível dire...

4 min de leitura
MiniMax M3 — Benchmarks, Capacidades e Casos de Uso
MiniMax M3 — Benchmarks, Capacidades e Casos de Uso

MiniMax M3 — Benchmarks, Capacidades e Casos de Uso

MiniMax M3 é um modelo de IA de pesos abertos da MiniMax (MoE (não divulgado)), classificado como nível Frontier com janela de contexto de 1 milhão de tokens. E...

4 min de leitura
Qwen3-Max, Reestruturação da OpenAI, Atualizações do Claude
Qwen3-Max, Reestruturação da OpenAI, Atualizações do Claude

Qwen3-Max, Reestruturação da OpenAI, Atualizações do Claude

Explore os mais recentes avanços em IA, incluindo o Qwen3-Max da Alibaba, desafios de conversão da OpenAI para fins lucrativos, novos modelos de imagem e como a...

19 min de leitura
AI Machine Learning +3