
Qwen 3.7-Plus — Benchmarks, Capacidades e Casos de Uso
Qwen 3.7-Plus é um modelo de IA proprietário da Alibaba, classificado como nível Avançado com uma janela de contexto de 1 milhão de tokens. Está disponível dire...
O Qwen 3.7-Max é um modelo de IA frontier de alto nível, desenvolvido pela Alibaba e lançado em maio de 2026. É um modelo proprietário de pesos fechados, disponível através da API da Alibaba. A janela de contexto de 1 milhão de tokens é grande o suficiente para conter bases de código inteiras, documentos técnicos extensos ou sessões agênticas prolongadas sem truncamento.
No FlowHunt AI Leaderboard, é um dos 24 modelos monitorados, avaliado em 8 benchmarks. Pontuações de destaque: 89,6% no MMLU-Pro (#1 de 8); 91,6% no LiveCodeBench (#2 de 5); 41,4% no HLE (#2 de 6).
O Qwen 3.7-Max foi lançado em 20 de maio de 2026 como o principal modelo da geração Qwen 3 da Alibaba, introduzindo o que a Alibaba chamou de ‘modo de pensamento’ — uma capacidade de raciocínio de cadeia de pensamento estendida que pode ser ativada por consulta. No modo de pensamento, o modelo executa uma etapa de deliberação interna antes de produzir sua resposta final, melhorando substancialmente o desempenho em tarefas de raciocínio de múltiplas etapas. No lançamento, o Qwen 3.7-Max obteve 92,4% no GPQA Diamond (terceiro globalmente), 91,6% no LiveCodeBench e 60,6% no SWE-bench Pro — a maior pontuação de API aberta nesse benchmark. Combinado com uma janela de contexto de 1 milhão de tokens e preços de API competitivos, estabeleceu-se como a principal alternativa de nível Frontier para equipes empresariais conscientes com custos.
Nota: Líder GPQA Diamond (92,4%). Líder SWE-Pro (60,6%). AA Index 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
O Grupo Alibaba é um dos maiores e mais diversificados conglomerados tecnológicos da China, fundado em 1999 por Jack Ma e com sede em Hangzhou. Através da sua DAMO Academy e Tongyi Lab, a Alibaba tornou-se uma força importante no desenvolvimento de modelos de linguagem de grande escala com a família Qwen (Tongyi Qianwen). A geração Qwen 3.7, lançada em meados de 2026, marcou a transição da Alibaba de implantações domésticas para competitividade em referências internacionais, com o Qwen 3.7-Max a alcançar 92,4% no GPQA Diamond e 91,6% no LiveCodeBench. A estratégia de IA da Alibaba é definida por lançamentos de pesos abertos como contrapeso aos modelos exclusivos de API dos EUA, integração de IA generativa em todos os seus negócios de cloud e comércio eletrónico, e forte investimento em infraestrutura de IA na sua divisão Alibaba Cloud.
Casos de Uso
O Qwen 3.7-Max pontua 80% no SWE-bench Verified — classificado em #7 de 13 modelos aqui monitorados. Ele resolve problemas reais do GitHub, escreve código de qualidade de produção em múltiplas linguagens e gerencia fluxos de codificação agênticos de múltiplas etapas — uma escolha sólida para equipes de desenvolvimento de software assistidas por IA.
Com 92% no GPQA Diamond (#4 de 14 modelos), o Qwen 3.7-Max excede a linha de base de aproximadamente 65% de especialistas humanos com doutorado em questões de biologia, química e física de nível de pós-graduação. Use-o para síntese de literatura científica, avaliação de hipóteses, Q&A jurídico e médico, e tarefas de pesquisa multidisciplinar onde o conhecimento profundo de domínio é importante.
O Qwen 3.7-Max alcança 69% no Terminal-Bench (#3 de 8 modelos), tornando-o competente para scripts shell comuns, fluxos de trabalho de linha de comando e tarefas leves de administração de sistemas dentro de pipelines agênticos.
Com uma janela de contexto de 1 milhão de tokens, o Qwen 3.7-Max pode processar repositórios de software inteiros, contratos jurídicos extensos, relatórios de pesquisa do tamanho de livros ou históricos de conversas longos em um único prompt — permitindo Q&A profundo de documentos, raciocínio entre arquivos de base de código e sumarização abrangente sem heurísticas de fragmentação ou pipelines de RAG.
O Qwen 3.7-Max pontua 91% no LiveCodeBench (#2 de 5 modelos), um benchmark resistente a contaminação continuamente atualizado com novos problemas de programação competitiva. Neste nível, ele lida com estruturas de dados avançadas, algoritmos de grafos e desafios de nível de entrevista com alta confiabilidade.
Mais Para Comparar
Compare todos os 24 modelos em 11 benchmarks — classificável, com fontes e atualizado em junho de 2026.

Qwen 3.7-Plus é um modelo de IA proprietário da Alibaba, classificado como nível Avançado com uma janela de contexto de 1 milhão de tokens. Está disponível dire...

MiniMax M3 é um modelo de IA de pesos abertos da MiniMax (MoE (não divulgado)), classificado como nível Frontier com janela de contexto de 1 milhão de tokens. E...

Explore os mais recentes avanços em IA, incluindo o Qwen3-Max da Alibaba, desafios de conversão da OpenAI para fins lucrativos, novos modelos de imagem e como a...
Consentimento de Cookies
Usamos cookies para melhorar sua experiência de navegação e analisar nosso tráfego. See our privacy policy.