
GPT-5 — Benchmarky, schopnosti a případy použití
GPT-5 je proprietární AI model od OpenAI klasifikovaný jako Frontier s kontextovým oknem 400K tokenů. Je přímo dostupný v FlowHunt. Prozkoumejte výsledky benchm...
GPT-5.5 je špičkový frontier model umělé inteligence, vyvinutý společností OpenAI a vydaný v dubnu 2026. Jedná se o proprietární model s uzavřenými váhami, dostupný přes OpenAI API. Kontextové okno o velikosti 1 milionu tokenů je dostatečně velké, aby pojalo celé kódové základny, rozsáhlé technické dokumenty nebo dlouhé agentní relace bez nutnosti zkracování.
Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů, hodnocených napříč 6 benchmarky. Výrazná skóre: 82,7 % na Terminal-Bench (#1 z 8); 88,7 % na SWE-bench Verified (#2 z 13); 93,6 % na GPQA Diamond (#2 ze 14).
GPT-5.5 byl vydán společností OpenAI 23. dubna 2026 jako iterativní vylepšení modelu GPT-5. Při uvedení dosáhl stejného skóre jako Claude Opus 4.6 na GPQA Diamond (93,6 %) a zaznamenal nejvyšší skóre Terminal-Bench ze všech měřených modelů – 82,7 % – což odráží jeho zvláštní sílu v autonomní správě systémů, shell skriptování a automatizaci DevOps. OpenAI postavila GPT-5.5 jako primární univerzální model ve svém API a stal se výchozím modelem pohánějícím ChatGPT pro většinu uživatelů. Dále dosáhl 68,4 % na SWE-bench Pro a 88,7 % na SWE-bench Verified, čímž se zařadil mezi tři nejlepší modely pro kódování na světě.
Poznámka: Nejvyšší SWE-bench Verified před Fable 5. Nejlepší skóre OpenAI na Terminal-Bench.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI byla založena v prosinci 2015 jako nezisková výzkumná laboratoř AI Samem Altmanem, Elonem Muskem, Gregem Brockmanem, Iljou Sutskeverem, Johnem Schulmanem a Wojciechem Zarembou s cílem vyvinout umělou obecnou inteligenci (AGI), která prospěje celému lidstvu. V roce 2019 vytvořila dceřinou společnost s omezeným ziskem OpenAI LP, aby získala institucionální kapitál a škálovala trénování modelů. Společnost je známá sérií jazykových modelů GPT (GPT‑1 až GPT‑5.5), sérií generování obrázků DALL‑E, rozpoznáváním řeči Whisper a generováním videa Sora. OpenAI provozuje spotřebitelskou aplikaci ChatGPT, vývojářské API a podnikové služby prostřednictvím Microsoft Azure. Od roku 2026 udržuje úzké strategické partnerství s Microsoftem, který je největším investorem a cloudovým poskytovatelem společnosti.
Případy použití
GPT-5.5 dosahuje 88 % na SWE-bench Verified – umístění #2 ze 13 modelů sledovaných zde. Řeší reálné GitHub issues, píše produkční kód ve více jazycích a zvládá vícekrokové agentní pracovní postupy pro kódování – je silnou volbou pro týmy využívající AI-assisted vývoj softwaru.
S 93 % na GPQA Diamond (#2 ze 14 modelů) překonává GPT-5.5 přibližně 65% baseline lidských doktorandů-expertů na postgraduální otázky z biologie, chemie a fyziky. Využijte jej pro syntézu vědecké literatury, hodnocení hypotéz, lékařské a právní Q&A a víceoborové výzkumné úkoly, kde záleží na hluboké doménové znalosti.
Se skórem 82 % na Terminal-Bench (#1 z 8 modelů) je GPT-5.5 vhodný pro agentní DevOps a automatizaci infrastruktury. Terminal-Bench měří autonomní plnění úloh v Linux shellu – správu balíčků, operace se souborovým systémem, řízení procesů a vícekrokovou správu systému – bez lidského vedení v průběhu úlohy.
S kontextovým oknem 1M tokenů dokáže GPT-5.5 pojmout celé softwarové repozitáře, dlouhé právní smlouvy, knižně dlouhé výzkumné zprávy nebo rozsáhlé historie konverzací v jediném promptu – což umožňuje hluboké Q&A nad dokumenty, uvažování napříč soubory v kódové základně a komplexní sumarizaci bez heuristik chunkování nebo RAG pipeline.
Více ke srovnání
Porovnejte všech 24 modelů napříč 11 benchmarky – řaditelné, s uvedením zdrojů, aktualizováno červen 2026.

GPT-5 je proprietární AI model od OpenAI klasifikovaný jako Frontier s kontextovým oknem 400K tokenů. Je přímo dostupný v FlowHunt. Prozkoumejte výsledky benchm...

GPT-5.4 je proprietární AI model od OpenAI, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Je přímo dostupný v FlowHunt. Prozkoumejte výsledk...

Objevte přelomové možnosti ChatGPT-5, jeho využití, výkonnost, bezpečnost, ceny a budoucí směry v tomto komplexním průvodci FlowHunt.
Souhlas s cookies
Používáme cookies ke zlepšení vašeho prohlížení a analýze naší návštěvnosti. See our privacy policy.