
GPT-5 — Referansetester, Egenskaper og Bruksområder
GPT-5 er en proprietær AI-modell fra OpenAI, klassifisert som Frontier-nivå med et kontekstvindu på 400K tokens. Den er tilgjengelig direkte i FlowHunt. Utforsk...
GPT-5.5 er en toppklasses frontier AI-modell, utviklet av OpenAI og utgitt i april 2026. Det er en proprietær lukket vektmodell, tilgjengelig via OpenAI API. Kontekstvinduet på 1M tokens er stort nok til å inneholde hele kodebaser, lange tekniske dokumenter eller utvidede agentsesjoner uten avkorting.
På FlowHunt AI Leaderboard er den en av 24 sporede modeller, evaluert på tvers av 6 referansetester. Fremragende resultater: 82,7 % på Terminal-Bench (#1 av 8); 88,7 % på SWE-bench Verified (#2 av 13); 93,6 % på GPQA Diamond (#2 av 14).
GPT-5.5 ble utgitt av OpenAI 23. april 2026 som en iterativ forbedring av GPT-5. Ved lansering matchet den Claude Opus 4.6 på GPQA Diamond med 93,6 % og oppnådde den høyeste Terminal-Bench-scoren av noen målte modell — 82,7 % — noe som gjenspeiler særlig styrke innen autonom systemadministrasjon, shell-skripting og DevOps-automasjon. OpenAI posisjonerte GPT-5.5 som den primære generelle modellen i API-en deres, og den ble standardmodellen som driver ChatGPT for de fleste brukere. Den oppnådde også 68,4 % på SWE-bench Pro og 88,7 % på SWE-bench Verified, noe som plasserer den blant de tre beste kodingsmodellene globalt.
Merk: Høyeste SWE-bench Verified før Fable 5. Beste OpenAI Terminal-Bench-score.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI ble grunnlagt i desember 2015 som et non-profit KI-forskningslaboratorium av Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman og Wojciech Zaremba, med oppdrag om å utvikle kunstig generell intelligens (AGI) som gagner hele menneskeheten. I 2019 opprettet de et overskuddsbegrenset datterselskap, OpenAI LP, for å heve institusjonell kapital og skalere modelltrening. Selskapet er kjent for GPT-serien av språkmodeller (GPT-1 til GPT-5.5), DALL-E-serien for bildegenerering, Whisper for talegjenkjenning og Sora for videogenerering. OpenAI driver forbrukerappen ChatGPT, et utvikler-API og bedriftstjenester gjennom Microsoft Azure. Fra 2026 opprettholder de et nært strategisk partnerskap med Microsoft, som er selskapets største investor og skyleverandør.
Bruksområder
GPT-5.5 oppnår 88 % på SWE-bench Verified — rangert #2 av 13 modeller som spores her. Den løser reelle GitHub-problemer, skriver produksjonsklar kode på tvers av flere språk, og håndterer flertrinns agentiske kodingearbeidsflyter — et sterkt valg for AI-assisterte programvareutviklingsteam.
Med 93 % på GPQA Diamond (#2 av 14 modeller) overgår GPT-5.5 den omtrentlige menneskelige PhD-ekspertbasen på ~65 % innen biologi, kjemi og fysikk på masternivå. Bruk den til analyse av vitenskapelig litteratur, medisinsk og juridisk spørsmål og svar, og tverrfaglige forskningsoppgaver der dyp domenekunnskap er avgjørende.
Med en score på 82 % på Terminal-Bench (#1 av 8 modeller) er GPT-5.5 svært godt egnet for agentisk DevOps og infrastrukturautomasjon. Terminal-Bench måler autonom fullføring av Linux-skalloppgaver — pakkehåndtering, filsystemoperasjoner, prosesskontroll og flertrinns systemadministrasjon — uten menneskelig veiledning underveis.
Med et kontekstvindu på 1M tokens kan GPT-5.5 innta hele programvarelagre, lange juridiske kontrakter, forskningsrapporter på boklengde eller omfattende samtalelogger i én enkelt forespørsel — noe som muliggjør dyp dokument-spørsmål og svar, tverrfiltlig kodebaseresonnering, og omfattende oppsummering uten oppdelingsheuristikker eller RAG-pipelines.
Mer å sammenligne
Sammenlign alle 24 modellene på tvers av 11 referansetester — sorterbar, kildebelagt og oppdatert juni 2026.

GPT-5 er en proprietær AI-modell fra OpenAI, klassifisert som Frontier-nivå med et kontekstvindu på 400K tokens. Den er tilgjengelig direkte i FlowHunt. Utforsk...

GPT-5.4 er en proprietær AI-modell fra OpenAI, klassifisert som Frontier-nivå med et kontekstvindu på 1M tokens. Den er tilgjengelig direkte i FlowHunt. Utforsk...

Utforsk ChatGPT-5s banebrytende fremskritt, bruksområder, benchmark-tester, sikkerhet, prisnivåer og fremtidige retninger i denne definitive FlowHunt-guiden.