
GPT-5 — Références, Capacités et Cas d'Usage
GPT-5 est un modèle d'IA propriétaire d'OpenAI, classé au niveau Frontier avec une fenêtre de contexte de 400 000 tokens. Il est disponible directement dans Flo...
GPT-5.5 est un modèle d’IA frontal de premier plan, développé par OpenAI et publié en avril 2026. Il s’agit d’un modèle propriétaire à poids fermés, accessible via l’API OpenAI. La fenêtre de contexte de 1 million de tokens est suffisamment grande pour contenir des bases de code entières, de longs documents techniques ou des sessions agentiques étendues sans troncature.
Sur le classement IA FlowHunt, il fait partie des 24 modèles suivis, évalués sur 6 benchmarks. Scores remarquables : 82,7 % sur Terminal-Bench (#1 sur 8) ; 88,7 % sur SWE-bench Verified (#2 sur 13) ; 93,6 % sur GPQA Diamond (#2 sur 14).
GPT-5.5 a été publié par OpenAI le 23 avril 2026 en tant qu’amélioration itérative de GPT-5. Lors de son lancement, il égalait Claude Opus 4.6 sur GPQA Diamond avec 93,6 % et a enregistré le meilleur score Terminal-Bench jamais mesuré pour un modèle — 82,7 % — reflétant une force particulière dans l’administration système autonome, le scripting shell et l’automatisation DevOps. OpenAI a positionné GPT-5.5 comme le modèle polyvalent principal de son API, et il est devenu le modèle par défaut propulsant ChatGPT pour la plupart des utilisateurs. Il a également obtenu 68,4 % sur SWE-bench Pro et 88,7 % sur SWE-bench Verified, se classant parmi les trois meilleurs modèles de codage au monde.
Note : Meilleur score SWE-bench Verified avant Fable 5. Meilleur score Terminal-Bench d’OpenAI.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI a été fondée en décembre 2015 en tant que laboratoire de recherche à but non lucratif par Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman et Wojciech Zaremba, avec pour mission de développer une intelligence générale artificielle (AGI) qui profite à toute l'humanité. En 2019, elle a créé une filiale à but lucratif plafonné, OpenAI LP, pour lever des capitaux institutionnels et passer à l'échelle l'entraînement des modèles. L'entreprise est connue pour la série de modèles de langage GPT (GPT-1 à GPT-5.5), la série de génération d'images DALL-E, la reconnaissance vocale Whisper et la génération vidéo Sora. OpenAI exploite l'application grand public ChatGPT, une API développeur et des services d'entreprise via Microsoft Azure. En 2026, elle maintient un partenariat stratégique étroit avec Microsoft, qui est le plus grand investisseur et fournisseur de cloud de l'entreprise.
Cas d'Usage
GPT-5.5 obtient 88 % sur SWE-bench Verified — classé #2 sur 13 modèles suivis ici. Il résout de véritables problèmes GitHub, écrit du code de qualité production dans plusieurs langages et gère des workflows de codage agentiques en plusieurs étapes — un choix solide pour les équipes de développement logiciel assistées par l'IA.
Avec 93 % sur GPQA Diamond (#2 sur 14 modèles), GPT-5.5 dépasse la référence humaine d'environ 65 % des experts titulaires d'un doctorat sur des questions de biologie, chimie et physique de niveau postgraduate. Utilisez-le pour la synthèse de littérature scientifique, l'évaluation d'hypothèses, les questions-réponses médicales et juridiques, et les tâches de recherche pluridisciplinaires où une connaissance approfondie du domaine est essentielle.
Avec un score de 82 % sur Terminal-Bench (#1 sur 8 modèles), GPT-5.5 est particulièrement adapté à l'automatisation DevOps et infrastructure agentique. Terminal-Bench mesure l'exécution autonome de tâches shell Linux — gestion de paquets, opérations sur le système de fichiers, contrôle de processus et administration système en plusieurs étapes — sans intervention humaine en cours de tâche.
Avec une fenêtre de contexte de 1 million de tokens, GPT-5.5 peut ingérer des dépôts logiciels entiers, de longs contrats juridiques, des rapports de recherche de la taille d'un livre ou de longs historiques de conversation en une seule requête — permettant des questions-réponses approfondies sur des documents, un raisonnement sur des bases de code multi-fichiers et une synthèse complète sans heuristiques de découpage ni pipelines RAG.
À Comparer
Comparez les 24 modèles sur 11 benchmarks — triable, sourcé et mis à jour en juin 2026.

GPT-5 est un modèle d'IA propriétaire d'OpenAI, classé au niveau Frontier avec une fenêtre de contexte de 400 000 tokens. Il est disponible directement dans Flo...

GPT-5.4 est un modèle d'IA propriétaire d'OpenAI, classé au niveau Frontier avec une fenêtre de contexte de 1 million de tokens. Il est disponible directement d...

Découvrez les avancées majeures de ChatGPT-5, ses cas d’usage, benchmarks, sécurité, tarification et perspectives d’avenir dans ce guide FlowHunt.
Consentement aux Cookies
Nous utilisons des cookies pour améliorer votre expérience de navigation et analyser notre trafic. See our privacy policy.