
GPT-5 — Prestandamått, Kapacitet och Användningsområden
GPT-5 är en proprietär AI-modell från OpenAI, klassificerad som Frontier-nivå med ett kontextfönster på 400K tokens. Den är direkt tillgänglig i FlowHunt. Utfor...
GPT-5.5 är en toppmodern frontier AI-modell, utvecklad av OpenAI och släppt i april 2026. Det är en proprietär modell med stängda vikter, tillgänglig via OpenAI API. Kontextfönstret på 1M tokens är tillräckligt stort för att innehålla hela kodbaser, långa tekniska dokument eller utökade agentiska sessioner utan trunkering.
På FlowHunt AI Leaderboard är den en av 24 spårade modeller, utvärderade över 6 prestandamått. Utmärkande resultat: 82,7% på Terminal-Bench (#1 av 8); 88,7% på SWE-bench Verified (#2 av 13); 93,6% på GPQA Diamond (#2 av 14).
GPT-5.5 släpptes av OpenAI den 23 april 2026 som en iterativ förbättring av GPT-5. Vid lanseringen matchade den Claude Opus 4.6 på GPQA Diamond med 93,6% och noterade det högsta Terminal-Bench-resultatet av någon uppmätt modell — 82,7% — vilket återspeglar särskild styrka inom autonom systemadministration, shell-skriptning och DevOps-automation. OpenAI positionerade GPT-5.5 som den primära allmänna modellen i sitt API, och den blev standardmodellen som driver ChatGPT för de flesta användare. Den noterade också 68,4% på SWE-bench Pro och 88,7% på SWE-bench Verified, vilket placerar den bland de tre bästa kodningsmodellerna globalt.
Obs: Högsta SWE-bench Verified före Fable 5. Bästa OpenAI Terminal-Bench-resultatet.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI grundades i december 2015 som ett icke-vinstdrivande AI-forskningslaboratorium av Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman och Wojciech Zaremba, med uppdraget att utveckla artificiell allmän intelligens (AGI) som gynnar hela mänskligheten. 2019 skapade man ett dotterbolag med vinsttak, OpenAI LP, för att anskaffa institutionellt kapital och skala modellträning. Företaget är känt för GPT-serien av språkmodeller (GPT-1 till GPT-5.5), DALL-E-serien för bildgenerering, Whisper för taligenkänning och Sora för videogenerering. OpenAI driver konsumentapplikationen ChatGPT, ett utvecklar-API och företagstjänster via Microsoft Azure. Från och med 2026 har man ett nära strategiskt partnerskap med Microsoft, som är företagets största investerare och molnleverantör.
Användningsområden
GPT-5.5 får 88% på SWE-bench Verified — rankad #2 av 13 modeller som spåras här. Den löser verkliga GitHub-ärenden, skriver produktionsklar kod på flera språk och hanterar flerstegs agentiska kodningsarbetsflöden — ett starkt val för AI-assisterade programvaruutvecklingsteam.
Med 93% på GPQA Diamond (#2 av 14 modeller) överträffar GPT-5.5 den ungefärliga PhD-expertnivån på ~65% för doktorandnivå frågor inom biologi, kemi och fysik. Använd den för vetenskaplig litteratursyntes, hypotesutvärdering, medicinska och juridiska frågor och svar samt forskningsuppgifter över flera discipliner där djup domänkunskap spelar roll.
Med 82% på Terminal-Bench (#1 av 8 modeller) är GPT-5.5 väl lämpad för agentisk DevOps och infrastrukturautomation. Terminal-Bench mäter autonomt genomförande av Linux-skaluppgifter — pakethantering, filsystemoperationer, processkontroll och flerstegs systemadministration — utan mänsklig vägledning under uppgiften.
Med ett kontextfönster på 1M tokens kan GPT-5.5 ta in hela mjukvarurepositories, långa juridiska avtal, boklånga forskningsrapporter eller omfattande konversationshistoriker i en enda prompt — vilket möjliggör djupgående dokument-Q&A, kodbasanalys över flera filer och omfattande sammanfattning utan chunkningsheuristik eller RAG-pipelines.
Mer att jämföra
Jämför alla 24 modeller över 11 prestandamått — sorterbar, källbelagd och uppdaterad juni 2026.

GPT-5 är en proprietär AI-modell från OpenAI, klassificerad som Frontier-nivå med ett kontextfönster på 400K tokens. Den är direkt tillgänglig i FlowHunt. Utfor...

GPT-5.4 är en proprietär AI-modell från OpenAI, klassificerad som Frontier-nivå med ett kontextfönster på 1M tokens. Den finns direkt tillgänglig i FlowHunt. Ut...

Utforska ChatGPT-5:s banbrytande framsteg, användningsområden, benchmarkresultat, säkerhet, prissättning och framtida riktningar i denna definitiva guide från F...