
GPT-5 — Puntos de referencia, capacidades y casos de uso
GPT-5 es un modelo de IA propietario de OpenAI, clasificado como nivel Frontier con una ventana de contexto de 400K tokens. Está disponible directamente en Flow...
GPT-5.5 es un modelo de IA frontera de primer nivel, desarrollado por OpenAI y lanzado en abril de 2026. Es un modelo propietario de pesos cerrados, disponible a través de la API de OpenAI. La ventana de contexto de 1M de tokens es lo suficientemente grande como para albergar repositorios de código completos, documentos técnicos extensos o sesiones de agente prolongadas sin truncamiento.
En el FlowHunt AI Leaderboard es uno de los 24 modelos rastreados, evaluado en 6 puntos de referencia. Puntuaciones destacadas: 82.7% en Terminal-Bench (#1 de 8); 88.7% en SWE-bench Verified (#2 de 13); 93.6% en GPQA Diamond (#2 de 14).
GPT-5.5 fue lanzado por OpenAI el 23 de abril de 2026 como un refinamiento iterativo de GPT-5. En su lanzamiento, igualó a Claude Opus 4.6 en GPQA Diamond con un 93.6% y registró la puntuación más alta de Terminal-Bench de cualquier modelo medido — 82.7% — reflejando una fortaleza particular en administración autónoma de sistemas, scripting de shell y automatización DevOps. OpenAI posicionó a GPT-5.5 como el modelo generalista principal en su API, y se convirtió en el modelo predeterminado que impulsa ChatGPT para la mayoría de los usuarios. También registró un 68.4% en SWE-bench Pro y un 88.7% en SWE-bench Verified, situándolo entre los tres mejores modelos de codificación a nivel global.
Nota: SWE-bench Verified más alto antes de Fable 5. Mejor puntuación de Terminal-Bench de OpenAI.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI fue fundada en diciembre de 2015 como un laboratorio de investigación de IA sin fines de lucro por Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman y Wojciech Zaremba, con la misión de desarrollar inteligencia artificial general (AGI) que beneficie a toda la humanidad. En 2019 creó una subsidiaria con límite de ganancias, OpenAI LP, para recaudar capital institucional y escalar el entrenamiento de modelos. La empresa es conocida por la serie GPT de modelos de lenguaje (GPT-1 a GPT-5.5), la serie de generación de imágenes DALL-E, el reconocimiento de voz Whisper y la generación de video Sora. OpenAI opera la aplicación de consumo ChatGPT, una API para desarrolladores y servicios empresariales a través de Microsoft Azure. A partir de 2026 mantiene una estrecha alianza estratégica con Microsoft, que es el mayor inversor y proveedor de nube de la empresa.
Casos de uso
GPT-5.5 obtiene un 88% en SWE-bench Verified — clasificado #2 de 13 modelos rastreados aquí. Resuelve problemas reales de GitHub, escribe código de calidad de producción en múltiples lenguajes y maneja flujos de trabajo de codificación de agente en varios pasos — una opción sólida para equipos de desarrollo de software asistidos por IA.
Con un 93% en GPQA Diamond (#2 de 14 modelos), GPT-5.5 supera la línea base de ~65% de expertos con PhD humano en preguntas de biología, química y física de nivel de posgrado. Úsalo para síntesis de literatura científica, evaluación de hipótesis, preguntas y respuestas médicas y legales, y tareas de investigación multidisciplinaria donde el conocimiento profundo del dominio es importante.
Con un 82% en Terminal-Bench (#1 de 8 modelos), GPT-5.5 es muy adecuado para automatización DevOps y de infraestructura con agentes. Terminal-Bench mide la finalización autónoma de tareas de shell de Linux — gestión de paquetes, operaciones del sistema de archivos, control de procesos y administración de sistemas en varios pasos — sin guía humana durante la tarea.
Con una ventana de contexto de 1M de tokens, GPT-5.5 puede ingerir repositorios de software completos, contratos legales extensos, informes de investigación del tamaño de un libro o historiales de conversación prolongados en una sola solicitud — permitiendo preguntas y respuestas profundas sobre documentos, razonamiento entre archivos de código y resúmenes completos sin necesidad de heurísticas de fragmentación o tuberías RAG.
Más para comparar
Compara los 24 modelos en 11 puntos de referencia — ordenable, con fuentes y actualizado a junio de 2026.

GPT-5 es un modelo de IA propietario de OpenAI, clasificado como nivel Frontier con una ventana de contexto de 400K tokens. Está disponible directamente en Flow...

GPT-5.4 es un modelo de IA propietario de OpenAI, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Está disponible directamente en F...

GPT-4.1 es un modelo de IA propietario de OpenAI, clasificado como nivel Avanzado con una ventana de contexto de 1M de tokens. Está disponible directamente en F...
Consentimiento de Cookies
Usamos cookies para mejorar tu experiencia de navegación y analizar nuestro tráfico. See our privacy policy.