
GPT-5 — Benchmark, kapaciteter og anvendelsesmuligheder
GPT-5 er en proprietær AI-model fra OpenAI, klassificeret som Frontier-tier med et kontekstvindue på 400K tokens. Den er direkte tilgængelig i FlowHunt. Udforsk...
GPT-5.5 er en top-tier frontier AI-model, udviklet af OpenAI og udgivet i april 2026. Det er en proprietær closed-weight-model, tilgængelig via OpenAI API. Kontekstvinduet på 1M tokens er stort nok til at indeholde hele kodebaser, lange tekniske dokumenter eller udvidede agentiske sessioner uden afkortning.
På FlowHunt AI Leaderboard er den en af 24 sporede modeller, evalueret på tværs af 6 benchmarks. Fremtrædende scoringer: 82,7 % på Terminal-Bench (#1 ud af 8); 88,7 % på SWE-bench Verified (#2 ud af 13); 93,6 % på GPQA Diamond (#2 ud af 14).
GPT-5.5 blev udgivet af OpenAI den 23. april 2026 som en iterativ forbedring af GPT-5. Ved lanceringen matchede den Claude Opus 4.6 på GPQA Diamond med 93,6 % og opnåede den højeste Terminal-Bench-score af nogen målt model — 82,7 % — hvilket afspejler særlig styrke inden for autonom systemadministration, shell-scripting og DevOps-automatisering. OpenAI positionerede GPT-5.5 som den primære generelle model i sin API, og den blev standardmodellen, der driver ChatGPT for de fleste brugere. Den opnåede også 68,4 % på SWE-bench Pro og 88,7 % på SWE-bench Verified, hvilket placerer den blandt de tre bedste kodningsmodeller globalt.
Bemærk: Højeste SWE-bench Verified før Fable 5. Bedste OpenAI Terminal-Bench-score.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI blev grundlagt i december 2015 som et nonprofit AI-forskningslaboratorium af Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman og Wojciech Zaremba med missionen om at udvikle kunstig generel intelligens (AGI), der gavner hele menneskeheden. I 2019 oprettede det et profitbegrænset datterselskab, OpenAI LP, for at rejse institutionel kapital og skalere modeltræning. Virksomheden er kendt for GPT-serien af sprogmodeller (GPT-1 til GPT-5.5), DALL-E-billedgenereringsserien, Whisper-talegenkendelse og Sora-videogenerering. OpenAI driver forbrugerapplikationen ChatGPT, en udvikler-API og virksomhedstjenester gennem Microsoft Azure. Fra 2026 opretholder det et tæt strategisk partnerskab med Microsoft, som er virksomhedens største investor og cloud-udbyder.
Anvendelsesmuligheder
GPT-5.5 opnår 88 % på SWE-bench Verified — rangeret #2 ud af 13 modeller sporet her. Den løser reelle GitHub-problemer, skriver produktionsklar kode på tværs af flere sprog og håndterer flertrins agentiske kodningsarbejdsgange — et stærkt valg for AI-assisterede softwareudviklingsteams.
Med 93 % på GPQA Diamond (#2 ud af 14 modeller) overgår GPT-5.5 den ~65 % menneskelige PhD-ekspert-baseline på graduate-level biologi-, kemi- og fysikspørgsmål. Brug den til videnskabelig litteratursyntese, hypoteseevaluering, medicinsk og juridisk Q&A samt tværfaglige forskningsopgaver, hvor dyb domæneviden er vigtig.
Med en score på 82 % på Terminal-Bench (#1 ud af 8 modeller) er GPT-5.5 velegnet til agentisk DevOps og infrastrukturautomatisering. Terminal-Bench måler autonom gennemførelse af Linux shell-opgaver — pakkehåndtering, filsystemoperationer, proceskontrol og flertrins systemadministration — uden menneskelig vejledning midt i opgaven.
Med et kontekstvindue på 1M tokens kan GPT-5.5 indlæse hele softwarerepositorier, lange juridiske kontrakter, bogstore forskningsrapporter eller omfattende samtalehistorikker i en enkelt prompt — hvilket muliggør dybdegående dokument-Q&A, kodebase-ræsonnering på tværs af filer og omfattende opsummering uden chunking-heuristikker eller RAG-pipelines.
Mere at sammenligne
Sammenlign alle 24 modeller på tværs af 11 benchmarks — sorterbare, med kildeangivelse og opdateret juni 2026.

GPT-5 er en proprietær AI-model fra OpenAI, klassificeret som Frontier-tier med et kontekstvindue på 400K tokens. Den er direkte tilgængelig i FlowHunt. Udforsk...

GPT-5.4 er en proprietær AI-model fra OpenAI, klassificeret som Frontier-niveau med et kontekstvindue på 1M tokens. Den er tilgængelig direkte i FlowHunt. Udfor...

Udforsk ChatGPT-5’s banebrydende fremskridt, anvendelsesmuligheder, benchmarks, sikkerhed, priser og fremtidige retning i denne definitive FlowHunt-guide.
Cookie Samtykke
Vi bruger cookies til at forbedre din browsingoplevelse og analysere vores trafik. See our privacy policy.