OpenAI logo

OpenAI

GPT-5.5

FrontierAvailable in FlowHunt

GPT-5.5 is een topmodel in de frontier-klasse, ontwikkeld door OpenAI en uitgebracht in april 2026. Het is een propriëtair closed-weight-model, beschikbaar via de OpenAI API. Het contextvenster van 1M tokens is groot genoeg om volledige codebases, uitgebreide technische documenten of langdurige agent-sessies zonder afkapping te verwerken.

Op de FlowHunt AI Leaderboard is het een van de 24 bijgehouden modellen, geëvalueerd op 6 benchmarks. Opvallende scores: 82,7% op Terminal-Bench (#1 van 8); 88,7% op SWE-bench Verified (#2 van 13); 93,6% op GPQA Diamond (#2 van 14).

GPT-5.5 werd op 23 april 2026 door OpenAI uitgebracht als een iteratieve verfijning van GPT-5. Bij de lancering evenaarde het Claude Opus 4.6 op GPQA Diamond met 93,6% en behaalde het de hoogste Terminal-Bench-score van alle gemeten modellen — 82,7% — wat wijst op een bijzondere sterkte in autonoom systeembeheer, shell-scripting en DevOps-automatisering. OpenAI positioneerde GPT-5.5 als het primaire algemene model in zijn API, en het werd het standaardmodel dat ChatGPT voor de meeste gebruikers aandrijft. Het behaalde ook 68,4% op SWE-bench Pro en 88,7% op SWE-bench Verified, waarmee het wereldwijd tot de top drie van codeermodellen behoort.

Opmerking: Hoogste SWE-bench Verified vóór Fable 5. Beste OpenAI Terminal-Bench-score.

Uitgebracht
April 2026
Context
1M tokens
Gewichten
Gesloten
Niveau
Frontier
Aanbieder
OpenAI

GPT-5.5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.7%2 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro58.6%7 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%2 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench82.7%1 of 8SRAgentic Linux terminal task completion
HLE41.4%3 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index60.2 pts2 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.7%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
58.6%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
82.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
60.2 pts
Artificial Analysis composite score (independent)

GPT-5.5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5.5Claude Opus 4.8Claude Opus 4.7
SWE-V88.7%88.6%87.6%
SWE-Pro58.6%69.2%64.3%
GPQA ◇93.6%93.6%94.2%
Terminal82.7%74.6%66.1%
HLE41.4%
AA Idx60.2 pts61.4 pts57.3 pts

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI werd in december 2015 opgericht als een non-profit AI-onderzoekslaboratorium door Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman en Wojciech Zaremba, met de missie om kunstmatige algemene intelligentie (AGI) te ontwikkelen die de hele mensheid ten goede komt. In 2019 creëerde het een dochteronderneming met beperkte winstuitkering, OpenAI LP, om institutioneel kapitaal aan te trekken en modelschaalvergroting te financieren. Het bedrijf staat bekend om de GPT-serie van taalmodellen (GPT-1 tot en met GPT-5.5), de DALL-E-serie voor beeldgeneratie, Whisper-spraakherkenning en Sora-videogeneratie. OpenAI beheert de ChatGPT-consumententoepassing, een ontwikkelaar-API en zakelijke diensten via Microsoft Azure. Vanaf 2026 onderhoudt het een nauw strategisch partnerschap met Microsoft, de grootste investeerder en cloudprovider van het bedrijf.

Gebruiksscenario's

Waar GPT-5.5 voor te Gebruiken

Software-engineering
Wetenschappelijk & Technisch Redeneren
Agentische CLI-automatisering
Lange Documenten & Codebase-analyse

Strengths & Limitations

Strengths

  • Sterk in software-engineering — 88% SWE-bench Verified
  • Wetenschappelijk redeneren op masterniveau — 93% GPQA Diamond
  • Agentische Linux-/CLI-automatisering — 82% Terminal-Bench
  • Composiete intelligentie — 60 pt AA Intelligence Index (onafhankelijk)
  • Zeer lange documenten en grote codebases (1M context)

Limitations

  • Gesloten gewichten — kan niet zelf worden gehost of worden gefinetuned op privégegevens

Bekijk het Volledige AI Modellenoverzicht

Veelgestelde vragen

Meer informatie

GPT-5 — Benchmarks, mogelijkheden en gebruiksscenario's
GPT-5 — Benchmarks, mogelijkheden en gebruiksscenario's

GPT-5 — Benchmarks, mogelijkheden en gebruiksscenario's

GPT-5 is een propriëtair AI-model van OpenAI, geclassificeerd als Frontier-niveau met een contextvenster van 400K tokens. Het is direct beschikbaar in FlowHunt....

3 min lezen
GPT-5.4 — Benchmarks, mogelijkheden en gebruiksscenario's
GPT-5.4 — Benchmarks, mogelijkheden en gebruiksscenario's

GPT-5.4 — Benchmarks, mogelijkheden en gebruiksscenario's

GPT-5.4 is een eigen AI-model van OpenAI, geclassificeerd als Frontier-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHunt. Ontdek ...

3 min lezen