
GPT-5 — Benchmarks, mogelijkheden en gebruiksscenario's
GPT-5 is een propriëtair AI-model van OpenAI, geclassificeerd als Frontier-niveau met een contextvenster van 400K tokens. Het is direct beschikbaar in FlowHunt....
GPT-5.5 is een topmodel in de frontier-klasse, ontwikkeld door OpenAI en uitgebracht in april 2026. Het is een propriëtair closed-weight-model, beschikbaar via de OpenAI API. Het contextvenster van 1M tokens is groot genoeg om volledige codebases, uitgebreide technische documenten of langdurige agent-sessies zonder afkapping te verwerken.
Op de FlowHunt AI Leaderboard is het een van de 24 bijgehouden modellen, geëvalueerd op 6 benchmarks. Opvallende scores: 82,7% op Terminal-Bench (#1 van 8); 88,7% op SWE-bench Verified (#2 van 13); 93,6% op GPQA Diamond (#2 van 14).
GPT-5.5 werd op 23 april 2026 door OpenAI uitgebracht als een iteratieve verfijning van GPT-5. Bij de lancering evenaarde het Claude Opus 4.6 op GPQA Diamond met 93,6% en behaalde het de hoogste Terminal-Bench-score van alle gemeten modellen — 82,7% — wat wijst op een bijzondere sterkte in autonoom systeembeheer, shell-scripting en DevOps-automatisering. OpenAI positioneerde GPT-5.5 als het primaire algemene model in zijn API, en het werd het standaardmodel dat ChatGPT voor de meeste gebruikers aandrijft. Het behaalde ook 68,4% op SWE-bench Pro en 88,7% op SWE-bench Verified, waarmee het wereldwijd tot de top drie van codeermodellen behoort.
Opmerking: Hoogste SWE-bench Verified vóór Fable 5. Beste OpenAI Terminal-Bench-score.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI werd in december 2015 opgericht als een non-profit AI-onderzoekslaboratorium door Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman en Wojciech Zaremba, met de missie om kunstmatige algemene intelligentie (AGI) te ontwikkelen die de hele mensheid ten goede komt. In 2019 creëerde het een dochteronderneming met beperkte winstuitkering, OpenAI LP, om institutioneel kapitaal aan te trekken en modelschaalvergroting te financieren. Het bedrijf staat bekend om de GPT-serie van taalmodellen (GPT-1 tot en met GPT-5.5), de DALL-E-serie voor beeldgeneratie, Whisper-spraakherkenning en Sora-videogeneratie. OpenAI beheert de ChatGPT-consumententoepassing, een ontwikkelaar-API en zakelijke diensten via Microsoft Azure. Vanaf 2026 onderhoudt het een nauw strategisch partnerschap met Microsoft, de grootste investeerder en cloudprovider van het bedrijf.
Gebruiksscenario's
GPT-5.5 scoort 88% op SWE-bench Verified — gerangschikt #2 van de 13 hier bijgehouden modellen. Het lost echte GitHub-problemen op, schrijft productiekwaliteit-code in meerdere talen en verwerkt meerstaps agentische codewerkstromen — een sterke keuze voor AI-ondersteunde softwareontwikkelingsteams.
Met 93% op GPQA Diamond (#2 van 14 modellen) overtreft GPT-5.5 de ~65% menselijke PhD-expertbasislijn voor vragen op masterniveau in biologie, scheikunde en natuurkunde. Gebruik het voor synthese van wetenschappelijke literatuur, hypotheseevaluatie, medische en juridische Q&A, en multidisciplinaire onderzoekstaken waar diepgaande domeinkennis van belang is.
Met een score van 82% op Terminal-Bench (#1 van 8 modellen) is GPT-5.5 zeer geschikt voor agentische DevOps- en infrastructuurautomatisering. Terminal-Bench meet de autonome uitvoering van Linux-shelltaken — pakketbeheer, bestandssysteembewerkingen, procescontrole en meerstaps systeembeheer — zonder menselijke tussenkomst tijdens de taak.
Met een contextvenster van 1M tokens kan GPT-5.5 volledige softwarerepositories, lange juridische contracten, onderzoeksrapporten van boeklengte of uitgebreide gespreksgeschiedenissen in één prompt verwerken — wat diepgaande document-Q&A, cross-bestand codebase-redenering en uitgebreide samenvatting mogelijk maakt zonder chunking-heuristieken of RAG-pijplijnen.
Meer om te Vergelijken
Vergelijk alle 24 modellen op 11 benchmarks — sorteerbaar, met bronnen en bijgewerkt juni 2026.

GPT-5 is een propriëtair AI-model van OpenAI, geclassificeerd als Frontier-niveau met een contextvenster van 400K tokens. Het is direct beschikbaar in FlowHunt....

GPT-5.4 is een eigen AI-model van OpenAI, geclassificeerd als Frontier-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHunt. Ontdek ...

Ontdek ChatGPT-5’s baanbrekende vooruitgang, toepassingen, benchmarks, beveiliging, prijzen en toekomstperspectieven in deze definitieve FlowHunt-gids.
Cookie Toestemming
We gebruiken cookies om uw browse-ervaring te verbeteren en ons verkeer te analyseren. See our privacy policy.