OpenAI logo

OpenAI

GPT-5.5

FrontierAvailable in FlowHunt

GPT-5.5 ist ein hochmodernes Frontier-KI-Modell, entwickelt von OpenAI und veröffentlicht im April 2026. Es handelt sich um ein proprietäres Closed-Weight-Modell, das über die OpenAI-API verfügbar ist. Das Kontextfenster von 1 Million Token ist groß genug, um gesamte Codebasen, umfangreiche technische Dokumente oder ausgedehnte agentische Sitzungen ohne Kürzung aufzunehmen.

Im FlowHunt KI-Ranking ist es eines von 24 erfassten Modellen, evaluiert in 6 Benchmarks. Herausragende Ergebnisse: 82,7 % im Terminal-Bench (#1 von 8); 88,7 % im SWE-bench Verified (#2 von 13); 93,6 % im GPQA Diamond (#2 von 14).

GPT-5.5 wurde von OpenAI am 23. April 2026 als iterative Weiterentwicklung von GPT-5 veröffentlicht. Zum Start erreichte es 93,6 % im GPQA Diamond – gleichauf mit Claude Opus 4.6 – und erzielte mit 82,7 % den höchsten jemals gemessenen Terminal-Bench-Wert aller Modelle, was eine besondere Stärke in der autonomen Systemadministration, Shell-Scripting und DevOps-Automation widerspiegelt. OpenAI positionierte GPT-5.5 als primäres Allzweckmodell in seiner API, und es wurde zum Standardmodell, das ChatGPT für die meisten Benutzer antreibt. Es erzielte außerdem 68,4 % im SWE-bench Pro und 88,7 % im SWE-bench Verified, was es weltweit unter die drei besten Codierungsmodelle bringt.

Hinweis: Höchster SWE-bench Verified vor Fable 5. Bester OpenAI Terminal-Bench-Wert.

Veröffentlicht
April 2026
Kontext
1M Token
Gewichte
Geschlossen
Stufe
Frontier
Anbieter
OpenAI

GPT-5.5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.7%2 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro58.6%7 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%2 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench82.7%1 of 8SRAgentic Linux terminal task completion
HLE41.4%3 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index60.2 pts2 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.7%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
58.6%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
82.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
60.2 pts
Artificial Analysis composite score (independent)

GPT-5.5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5.5Claude Opus 4.8Claude Opus 4.7
SWE-V88.7%88.6%87.6%
SWE-Pro58.6%69.2%64.3%
GPQA ◇93.6%93.6%94.2%
Terminal82.7%74.6%66.1%
HLE41.4%
AA Idx60.2 pts61.4 pts57.3 pts

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI wurde im Dezember 2015 als gemeinnütziges KI-Forschungslabor von Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman und Wojciech Zaremba mit dem Ziel gegründet, eine künstliche allgemeine Intelligenz (AGI) zu entwickeln, die der gesamten Menschheit zugutekommt. 2019 gründete das Unternehmen eine gewinnbegrenzte Tochtergesellschaft, OpenAI LP, um institutionelles Kapital einzuwerben und das Modelltraining zu skalieren. Das Unternehmen ist bekannt für die GPT-Serie von Sprachmodellen (GPT-1 bis GPT-5.5), die DALL-E-Serie zur Bildgenerierung, Whisper zur Spracherkennung und Sora zur Videogenerierung. OpenAI betreibt die Verbraucheranwendung ChatGPT, eine Entwickler-API und Unternehmensdienste über Microsoft Azure. Seit 2026 unterhält das Unternehmen eine enge strategische Partnerschaft mit Microsoft, dem größten Investor und Cloud-Anbieter des Unternehmens.

Anwendungsfälle

Wofür GPT-5.5 genutzt werden sollte

Softwareentwicklung
Wissenschaftliches & Technisches Denken
Agentische CLI-Automation
Analyse langer Dokumente & Codebasen

Strengths & Limitations

Strengths

  • Starke Softwareentwicklung — 88 % SWE-bench Verified
  • Wissenschaftliches Denken auf Graduiertenniveau — 93 % GPQA Diamond
  • Agentische Linux-/CLI-Automation — 82 % Terminal-Bench
  • Verbundene Intelligenz — 60 Punkte AA Intelligence Index (unabhängig)
  • Sehr lange Dokumente und große Codebasen (1M Kontext)

Limitations

  • Closed-Weight — kann nicht selbst gehostet oder mit privaten Daten feinabgestimmt werden

Das vollständige KI-Modell-Ranking durchstöbern

Häufig gestellte Fragen

Mehr erfahren

GPT-5 — Benchmarks, Fähigkeiten und Anwendungsfälle
GPT-5 — Benchmarks, Fähigkeiten und Anwendungsfälle

GPT-5 — Benchmarks, Fähigkeiten und Anwendungsfälle

GPT-5 ist ein proprietäres KI-Modell von OpenAI, das als Frontier-Tier mit einem Kontextfenster von 400K Token eingestuft ist. Es ist direkt in FlowHunt verfügb...

3 Min. Lesezeit
GPT-5.4 — Benchmarks, Fähigkeiten und Anwendungsfälle
GPT-5.4 — Benchmarks, Fähigkeiten und Anwendungsfälle

GPT-5.4 — Benchmarks, Fähigkeiten und Anwendungsfälle

GPT-5.4 ist ein proprietäres KI-Modell von OpenAI, das als Frontier-Tier eingestuft wird und über ein Kontextfenster von 1M Token verfügt. Es ist direkt in Flow...

3 Min. Lesezeit