OpenAI logo

OpenAI

GPT-4o

EstablishedAvailable in FlowHunt

GPT-4o er en gennemprøvet AI-model, der stadig er udbredt i produktionssystemer, udviklet af OpenAI og udgivet i maj 2024. Det er en proprietær closed-weight-model, tilgængelig via OpenAI API. Den understøtter et kontekstvindue på 128K tokens, tilstrækkeligt til de fleste dokumenter og multi-turn-applikationer.

På FlowHunt AI Leaderboard er den en af 24 spores modeller, evalueret på tværs af 3 benchmarks. Fremtrædende scoringer: 72,6% på MMLU-Pro (#6 af 8); 53,6% på GPQA Diamond (#12 af 14); 33,2% på SWE-bench Verified (#13 af 13).

GPT-4o (‘omni’) blev udgivet den 13. maj 2024 som OpenAIs første indbygget multimodale model — tekst, billede og lyd behandlet af en enkelt arkitektur i stedet for at blive dirigeret gennem specialiserede undermodeller. ‘o’ i 4o står for omni, hvilket afspejler den samlede arkitektur. GPT-4o’s realtidsstemmetilstand, udgivet senere i 2024, demonstrerede menneskelignende samtalelatens for første gang og drev en bølge af stemme-AI-produkter. Den blev standardmodellen, der drev ChatGPT gennem 2024, og blev brugt til at bygge den første generation af synsduelige agenter. I 2026 befinder den sig i Established-niveauet — komfortabelt overgået af GPT-5-serien på svære ræsonneringsbenchmarks — men forbliver populær til prisbevidste, højvolumen multimodale applikationer.

Bemærk: Original flagskibs multimodal model. Udbredt baseline.

Udgivet
Maj 2024
Kontekst
128K tokens
Vægte
Lukket
Niveau
Established
Udbyder
OpenAI

GPT-4o Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified33.2%13 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond53.6%12 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro72.6%6 of 8SRHard knowledge reasoning, 12K questions

Detailed Benchmark Scores

SWE-V SR
33.2%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
53.6%
Graduate-level Google-proof science Q&A
MMLU-P SR
72.6%
Hard knowledge reasoning, 12K questions

GPT-4o vs. Established Peers

Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.

BenchmarkGPT-4oLlama 4 MaverickLlama 4 Scout
SWE-V33.2%
GPQA ◇53.6%69.8%
MMLU-P72.6%80.5%52.2%

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI blev grundlagt i december 2015 som et nonprofit AI-forskningslaboratorium af Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman og Wojciech Zaremba med missionen om at udvikle kunstig generel intelligens (AGI), der gavner hele menneskeheden. I 2019 oprettede det et profitbegrænset datterselskab, OpenAI LP, for at rejse institutionel kapital og skalere modeltræning. Virksomheden er kendt for GPT-serien af sprogmodeller (GPT-1 til GPT-5.5), DALL-E-billedgenereringsserien, Whisper-talegenkendelse og Sora-videogenerering. OpenAI driver forbrugerapplikationen ChatGPT, en udvikler-API og virksomhedstjenester gennem Microsoft Azure. Fra 2026 opretholder det et tæt strategisk partnerskab med Microsoft, som er virksomhedens største investor og cloud-udbyder.

Anvendelsesmuligheder

Hvad skal GPT-4o bruges til

Software Engineering
Videnskabelig & Teknisk Ræsonnering

Strengths & Limitations

Strengths

  • Langkontekst-opgaver (128K kontekstvindue)

Limitations

  • Under frontlinjeniveau for svær videnskabelig ræsonnering (53% GPQA — frontlinje er 90%+)
  • Betydeligt bagud i forhold til 2026 frontlinjemodeller inden for agentisk kodning og kompleks ræsonnering
  • Lukkede vægte — kan ikke selv-hostes eller finjusteres på private data

Se hele AI Model Leaderboard

Ofte stillede spørgsmål

Lær mere

GPT-4.1 — Benchmarks, funktioner og anvendelsesområder
GPT-4.1 — Benchmarks, funktioner og anvendelsesområder

GPT-4.1 — Benchmarks, funktioner og anvendelsesområder

GPT-4.1 er en proprietær AI-model fra OpenAI, klassificeret som Avanceret niveau med et kontekstvindue på 1M tokens. Den er direkte tilgængelig i FlowHunt. Udfo...

3 min læsning
GPT-5 — Benchmark, kapaciteter og anvendelsesmuligheder
GPT-5 — Benchmark, kapaciteter og anvendelsesmuligheder

GPT-5 — Benchmark, kapaciteter og anvendelsesmuligheder

GPT-5 er en proprietær AI-model fra OpenAI, klassificeret som Frontier-tier med et kontekstvindue på 400K tokens. Den er direkte tilgængelig i FlowHunt. Udforsk...

3 min læsning
GPT-5.4 — Benchmarks, ydeevne og anvendelsesmuligheder
GPT-5.4 — Benchmarks, ydeevne og anvendelsesmuligheder

GPT-5.4 — Benchmarks, ydeevne og anvendelsesmuligheder

GPT-5.4 er en proprietær AI-model fra OpenAI, klassificeret som Frontier-niveau med et kontekstvindue på 1M tokens. Den er tilgængelig direkte i FlowHunt. Udfor...

3 min læsning