
GPT-4.1 — Puntos de referencia, capacidades y casos de uso
GPT-4.1 es un modelo de IA propietario de OpenAI, clasificado como nivel Avanzado con una ventana de contexto de 1M de tokens. Está disponible directamente en F...
GPT-4o es un modelo de IA probado y aún ampliamente implementado en sistemas de producción, desarrollado por OpenAI y lanzado en mayo de 2024. Es un modelo propietario de pesos cerrados, disponible a través de la API de OpenAI. Admite una ventana de contexto de 128 mil tokens, adecuada para la mayoría de documentos y aplicaciones de múltiples turnos.
En el AI Leaderboard de FlowHunt es uno de los 24 modelos registrados, evaluado en 3 pruebas comparativas. Puntuaciones destacadas: 72.6 % en MMLU-Pro (#6 de 8); 53.6 % en GPQA Diamond (#12 de 14); 33.2 % en SWE-bench Verified (#13 de 13).
GPT-4o («omni») se lanzó el 13 de mayo de 2024 como el primer modelo nativamente multimodal de OpenAI — texto, imagen y audio procesados por una única arquitectura en lugar de ser encaminados a través de submodelos especializados. La «o» en 4o significa omni, reflejando la arquitectura unificada. El modo de voz en tiempo real de GPT-4o, lanzado a finales de 2024, demostró por primera vez una latencia conversacional similar a la humana e impulsó una ola de productos de voz con IA. Se convirtió en el modelo predeterminado que impulsó ChatGPT durante todo 2024 y se utilizó para construir la primera generación de agentes con capacidad de visión. Para 2026 se encuentra en el nivel Established — superado cómodamente por la serie GPT-5 en evaluaciones de razonamiento complejo — pero sigue siendo popular para aplicaciones multimodales de gran volumen y sensibles al costo.
Nota: Modelo multimodal insignia original. Línea base ampliamente implementada.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 33.2% | 13 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| GPQA Diamond | 53.6% | 12 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 72.6% | 6 of 8 | SR | Hard knowledge reasoning, 12K questions |
Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.
| Benchmark | GPT-4o | Llama 4 Maverick | Llama 4 Scout |
|---|---|---|---|
| SWE-V | 33.2% | — | — |
| GPQA ◇ | 53.6% | 69.8% | — |
| MMLU-P | 72.6% | 80.5% | 52.2% |
OpenAI fue fundada en diciembre de 2015 como un laboratorio de investigación de IA sin fines de lucro por Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman y Wojciech Zaremba, con la misión de desarrollar inteligencia artificial general (AGI) que beneficie a toda la humanidad. En 2019 creó una subsidiaria con límite de ganancias, OpenAI LP, para recaudar capital institucional y escalar el entrenamiento de modelos. La empresa es conocida por la serie GPT de modelos de lenguaje (GPT-1 a GPT-5.5), la serie de generación de imágenes DALL-E, el reconocimiento de voz Whisper y la generación de video Sora. OpenAI opera la aplicación de consumo ChatGPT, una API para desarrolladores y servicios empresariales a través de Microsoft Azure. A partir de 2026 mantiene una estrecha alianza estratégica con Microsoft, que es el mayor inversor y proveedor de nube de la empresa.
Casos de Uso
GPT-4o alcanza el 33 % en SWE-bench Verified — clasificado #13 de 13 modelos registrados aquí. Maneja generación de código, corrección de errores y revisión de código para tareas de desarrollo típicas, aunque los modelos de frontera obtienen puntuaciones significativamente más altas en ingeniería compleja totalmente autónoma.
GPT-4o alcanza el 53 % en GPQA Diamond (#12 de 14 modelos). Responde preguntas científicas generales a un nivel sólido, aunque los modelos de frontera obtienen puntuaciones 25+ puntos porcentuales más altas en los problemas de nivel de posgrado más difíciles.
Más para Comparar
Compara los 24 modelos en 11 evaluaciones comparativas — ordenable, con fuentes y actualizado en junio de 2026.

GPT-4.1 es un modelo de IA propietario de OpenAI, clasificado como nivel Avanzado con una ventana de contexto de 1M de tokens. Está disponible directamente en F...

GPT-5 es un modelo de IA propietario de OpenAI, clasificado como nivel Frontier con una ventana de contexto de 400K tokens. Está disponible directamente en Flow...

GPT-5.4 es un modelo de IA propietario de OpenAI, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Está disponible directamente en F...
Consentimiento de Cookies
Usamos cookies para mejorar tu experiencia de navegación y analizar nuestro tráfico. See our privacy policy.