Logotipo de Alibaba

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max es un modelo de IA frontera de primer nivel, desarrollado por Alibaba y lanzado en mayo de 2026. Es un modelo propietario de pesos cerrados, disponible a través de la API de Alibaba. La ventana de contexto de 1 millón de tokens es lo suficientemente grande como para contener bases de código completas, documentos técnicos extensos o sesiones de agente prolongadas sin truncamiento.

En el FlowHunt AI Leaderboard es uno de los 24 modelos registrados, evaluado en 8 benchmarks. Puntuaciones destacadas: 89.6 % en MMLU-Pro (#1 de 8); 91.6 % en LiveCodeBench (#2 de 5); 41.4 % en HLE (#2 de 6).

Qwen 3.7-Max fue lanzado el 20 de mayo de 2026 como el modelo superior de la generación Qwen 3 de Alibaba, introduciendo lo que Alibaba denominó un ‘modo de pensamiento’ — una capacidad de razonamiento de cadena de pensamiento extendida que se puede activar por consulta. En el modo de pensamiento, el modelo realiza un paso de deliberación interna antes de generar su respuesta final, mejorando sustancialmente el rendimiento en tareas de razonamiento de múltiples pasos. En su lanzamiento, Qwen 3.7-Max obtuvo un 92.4 % en GPQA Diamond (tercero a nivel mundial), un 91.6 % en LiveCodeBench y un 60.6 % en SWE-bench Pro — la puntuación más alta en ese benchmark entre modelos con API abierta. Combinado con una ventana de contexto de 1M de tokens y precios competitivos de API, se consolidó como la principal alternativa de nivel Frontier para equipos empresariales conscientes de los costos.

Nota: Líder en GPQA Diamond (92.4 %). Líder en SWE-Pro (60.6 %). AA Index 56.6.

Lanzamiento
Mayo 2026
Contexto
1M tokens
Pesos
Cerrados
Nivel
Frontier
Proveedor
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Alibaba Group es uno de los conglomerados tecnológicos más grandes y diversos de China, fundado en 1999 por Jack Ma y con sede en Hangzhou. A través de su Academia DAMO y Tongyi Lab, Alibaba se ha convertido en una fuerza importante en el desarrollo de modelos de lenguaje grandes con la familia Qwen (Tongyi Qianwen). La generación Qwen 3.7, lanzada a mediados de 2026, marcó la transición de Alibaba desde implementaciones domésticas a la competitividad en benchmarks internacionales, con Qwen 3.7-Max obteniendo un 92.4 % en GPQA Diamond y un 91.6 % en LiveCodeBench. La estrategia de IA de Alibaba se define por lanzamientos de pesos abiertos como contrapeso a los modelos exclusivos de API estadounidenses, la integración de IA generativa en sus negocios de nube y comercio electrónico, y una fuerte inversión en infraestructura de IA en toda su división Alibaba Cloud.

Casos de Uso

Para Qué Usar Qwen 3.7-Max

Ingeniería de Software
Razonamiento Científico y Técnico
Automatización Agente de CLI
Análisis de Documentos Extensos y Bases de Código
Programación Competitiva

Strengths & Limitations

Strengths

  • Fuerte ingeniería de software — 80 % SWE-bench Verified
  • Razonamiento científico de posgrado — 92 % GPQA Diamond
  • Programación competitiva — 91 % LiveCodeBench
  • Inteligencia compuesta — 56 pts AA Intelligence Index (independiente)
  • Documentos muy extensos y bases de código grandes (1M de contexto)

Limitations

  • Pesos cerrados — no se puede alojar ni ajustar con datos privados

Explora el Ranking Completo de Modelos de IA

Preguntas frecuentes

Saber más

MiniMax M3 — Puntos de Referencia, Capacidades y Casos de Uso
MiniMax M3 — Puntos de Referencia, Capacidades y Casos de Uso

MiniMax M3 — Puntos de Referencia, Capacidades y Casos de Uso

MiniMax M3 es un modelo de IA de pesos abiertos de MiniMax (MoE (no revelado)), clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Est...

4 min de lectura
Qwen Max
Qwen Max

Qwen Max

Integra FlowHunt con Qwen Max para automatizar operaciones de servidores, monitorizar la salud del sistema y potenciar la productividad utilizando flujos de tra...

4 min de lectura
AI Qwen Max +3