
Qwen 3.7-Plus — Puntos de referencia, capacidades y casos de uso
Qwen 3.7-Plus es un modelo de IA propietario de Alibaba, clasificado como nivel Avanzado con una ventana de contexto de 1 millón de tokens. Está disponible dire...
Qwen 3.7-Max es un modelo de IA frontera de primer nivel, desarrollado por Alibaba y lanzado en mayo de 2026. Es un modelo propietario de pesos cerrados, disponible a través de la API de Alibaba. La ventana de contexto de 1 millón de tokens es lo suficientemente grande como para contener bases de código completas, documentos técnicos extensos o sesiones de agente prolongadas sin truncamiento.
En el FlowHunt AI Leaderboard es uno de los 24 modelos registrados, evaluado en 8 benchmarks. Puntuaciones destacadas: 89.6 % en MMLU-Pro (#1 de 8); 91.6 % en LiveCodeBench (#2 de 5); 41.4 % en HLE (#2 de 6).
Qwen 3.7-Max fue lanzado el 20 de mayo de 2026 como el modelo superior de la generación Qwen 3 de Alibaba, introduciendo lo que Alibaba denominó un ‘modo de pensamiento’ — una capacidad de razonamiento de cadena de pensamiento extendida que se puede activar por consulta. En el modo de pensamiento, el modelo realiza un paso de deliberación interna antes de generar su respuesta final, mejorando sustancialmente el rendimiento en tareas de razonamiento de múltiples pasos. En su lanzamiento, Qwen 3.7-Max obtuvo un 92.4 % en GPQA Diamond (tercero a nivel mundial), un 91.6 % en LiveCodeBench y un 60.6 % en SWE-bench Pro — la puntuación más alta en ese benchmark entre modelos con API abierta. Combinado con una ventana de contexto de 1M de tokens y precios competitivos de API, se consolidó como la principal alternativa de nivel Frontier para equipos empresariales conscientes de los costos.
Nota: Líder en GPQA Diamond (92.4 %). Líder en SWE-Pro (60.6 %). AA Index 56.6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Alibaba Group es uno de los conglomerados tecnológicos más grandes y diversos de China, fundado en 1999 por Jack Ma y con sede en Hangzhou. A través de su Academia DAMO y Tongyi Lab, Alibaba se ha convertido en una fuerza importante en el desarrollo de modelos de lenguaje grandes con la familia Qwen (Tongyi Qianwen). La generación Qwen 3.7, lanzada a mediados de 2026, marcó la transición de Alibaba desde implementaciones domésticas a la competitividad en benchmarks internacionales, con Qwen 3.7-Max obteniendo un 92.4 % en GPQA Diamond y un 91.6 % en LiveCodeBench. La estrategia de IA de Alibaba se define por lanzamientos de pesos abiertos como contrapeso a los modelos exclusivos de API estadounidenses, la integración de IA generativa en sus negocios de nube y comercio electrónico, y una fuerte inversión en infraestructura de IA en toda su división Alibaba Cloud.
Casos de Uso
Qwen 3.7-Max obtiene un 80 % en SWE-bench Verified, ubicándose en el #7 de 13 modelos registrados aquí. Resuelve incidencias reales de GitHub, escribe código de calidad de producción en múltiples lenguajes y maneja flujos de trabajo de codificación agente de múltiples pasos — una opción sólida para equipos de desarrollo de software asistido por IA.
Con un 92 % en GPQA Diamond (#4 de 14 modelos), Qwen 3.7-Max supera la línea base de ~65 % de expertos humanos con doctorado en preguntas de nivel de posgrado en biología, química y física. Úsalo para síntesis de literatura científica, evaluación de hipótesis, preguntas y respuestas médicas y legales, y tareas de investigación multidisciplinaria donde el conocimiento profundo del dominio sea importante.
Qwen 3.7-Max alcanza un 69 % en Terminal-Bench (#3 de 8 modelos), lo que lo hace competente para tareas comunes de scripting de shell, flujos de trabajo de línea de comandos y tareas ligeras de administración de sistemas dentro de pipelines de agentes.
Con una ventana de contexto de 1 millón de tokens, Qwen 3.7-Max puede procesar repositorios de software completos, contratos legales extensos, informes de investigación del tamaño de un libro o historiales extensos de conversaciones en una sola instrucción — lo que permite preguntas y respuestas profundas sobre documentos, razonamiento entre archivos en bases de código y resúmenes completos sin heurísticas de fragmentación ni pipelines de RAG.
Qwen 3.7-Max obtiene un 91 % en LiveCodeBench (#2 de 5 modelos), un benchmark resistente a la contaminación que se actualiza continuamente con nuevos problemas de programación competitiva. A este nivel, maneja estructuras de datos avanzadas, algoritmos de grafos y desafíos de nivel de entrevista con alta fiabilidad.
Más para Comparar
Compara los 24 modelos en 11 benchmarks — ordenable, con fuentes y actualizado a junio de 2026.

Qwen 3.7-Plus es un modelo de IA propietario de Alibaba, clasificado como nivel Avanzado con una ventana de contexto de 1 millón de tokens. Está disponible dire...

MiniMax M3 es un modelo de IA de pesos abiertos de MiniMax (MoE (no revelado)), clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Est...

Integra FlowHunt con Qwen Max para automatizar operaciones de servidores, monitorizar la salud del sistema y potenciar la productividad utilizando flujos de tra...
Consentimiento de Cookies
Usamos cookies para mejorar tu experiencia de navegación y analizar nuestro tráfico. See our privacy policy.