OpenAI logo

OpenAI

GPT-5

FrontierAvailable in FlowHunt

GPT-5 ist ein erstklassiges Frontier-KI-Modell, das von OpenAI entwickelt und im August 2025 veröffentlicht wurde. Es ist ein proprietäres Closed-Weight-Modell, das über die OpenAI-API verfügbar ist. Es unterstützt ein Kontextfenster von 400K Token, das für die meisten Dokumente und Multi-Turn-Anwendungen ausreicht.

Im FlowHunt AI Leaderboard ist es eines von 24 verfolgten Modellen, die in 2 Benchmarks evaluiert wurden. Hervorragende Ergebnisse: 88,4 % auf GPQA Diamond (Platz 7 von 14); 74,9 % auf SWE-bench Verified (Platz 10 von 13).

GPT-5 wurde am 7. August 2025 als erstes Modell von OpenAI veröffentlicht, das eine übermenschliche Leistung bei mehreren anspruchsvollen Reasoning-Benchmarks selbst meldete. Es war der erste GPT, der Text-, Bild- und Audioeingaben als einheitliche Fähigkeit auf Reasoning-Ebene integrierte, anstatt durch eine Pipeline spezialisierter Modelle. GPT-5 legte das Fundament für die aktuelle Frontier-Stufe: Sein Kontextfenster von 400K Token war zum Zeitpunkt der Veröffentlichung das längste, das von OpenAI angeboten wurde; seine Verbesserung beim Programmieren gegenüber GPT-4o war so signifikant, dass ein Großteil der auf Codex und GPT-4o basierenden Entwicklungswerkzeuge verdrängt wurde. Die Markteinführung führte zur schnellsten Beschleunigung der GPT-API-Nutzung seit dem Debüt von ChatGPT im Jahr 2022.

Hinweis: Einheitliches Modell, das GPT-4o, o3, o4-mini, GPT-4.1 ersetzt. AIME 2025: 94,6 %.

Veröffentlicht
August 2025
Kontext
400K Token
Gewichte
Geschlossen
Stufe
Frontier
Anbieter
OpenAI

GPT-5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified74.9%10 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond88.4%7 of 14SRGraduate-level Google-proof science Q&A

Detailed Benchmark Scores

SWE-V SR
74.9%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
88.4%
Graduate-level Google-proof science Q&A

GPT-5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5Claude Opus 4.8Claude Opus 4.7
SWE-V74.9%88.6%87.6%
GPQA ◇88.4%93.6%94.2%

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI wurde im Dezember 2015 als gemeinnütziges KI-Forschungslabor von Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman und Wojciech Zaremba mit dem Ziel gegründet, eine künstliche allgemeine Intelligenz (AGI) zu entwickeln, die der gesamten Menschheit zugutekommt. 2019 gründete das Unternehmen eine gewinnbegrenzte Tochtergesellschaft, OpenAI LP, um institutionelles Kapital einzuwerben und das Modelltraining zu skalieren. Das Unternehmen ist bekannt für die GPT-Serie von Sprachmodellen (GPT-1 bis GPT-5.5), die DALL-E-Serie zur Bildgenerierung, Whisper zur Spracherkennung und Sora zur Videogenerierung. OpenAI betreibt die Verbraucheranwendung ChatGPT, eine Entwickler-API und Unternehmensdienste über Microsoft Azure. Seit 2026 unterhält das Unternehmen eine enge strategische Partnerschaft mit Microsoft, dem größten Investor und Cloud-Anbieter des Unternehmens.

Anwendungsfälle

Wofür GPT-5 verwendet werden sollte

Softwareentwicklung
Wissenschaftliches & Technisches Reasoning

Strengths & Limitations

Strengths

  • Zuverlässige Programmierunterstützung — 74 % SWE-bench Verified
  • Fortschrittliche wissenschaftliche Fragenbeantwortung — 88 % GPQA Diamond
  • Aufgaben mit langem Kontext (400K Kontextfenster)

Limitations

  • Closed-Weight — kann nicht selbst gehostet oder mit privaten Daten feinabgestimmt werden

Das vollständige KI-Modell-Ranking durchstöbern

Häufig gestellte Fragen

Mehr erfahren

GPT-5.5 — Benchmarks, Fähigkeiten und Anwendungsfälle
GPT-5.5 — Benchmarks, Fähigkeiten und Anwendungsfälle

GPT-5.5 — Benchmarks, Fähigkeiten und Anwendungsfälle

GPT-5.5 ist ein proprietäres KI-Modell von OpenAI, das als Frontier-Stufe mit einem Kontextfenster von 1M Token eingestuft wird. Es ist direkt in FlowHunt verfü...

4 Min. Lesezeit