
GPT-5 — Benchmarky, schopnosti a prípady použitia
GPT-5 je proprietárny AI model od OpenAI, klasifikovaný ako Frontier úroveň s kontextovým oknom 400 000 tokenov. Je priamo dostupný v FlowHunt. Preskúmajte benc...
GPT-5.5 je špičkový frontier AI model vyvinutý spoločnosťou OpenAI a vydaný v apríli 2026. Ide o proprietárny model s uzavretými váhami, dostupný cez OpenAI API. Kontextové okno s veľkosťou 1 milión tokenov je dostatočne veľké na to, aby poňalo celé kódové základne, dlhé technické dokumenty alebo rozsiahle agentské relácie bez skracovania.
Na FlowHunt AI Leaderboard je jedným z 24 sledovaných modelov vyhodnotených v 6 benchmarkoch. Výnimočné skóre: 82,7 % na Terminal-Bench (#1 z 8); 88,7 % na SWE-bench Verified (#2 z 13); 93,6 % na GPQA Diamond (#2 zo 14).
GPT-5.5 bol vydaný spoločnosťou OpenAI 23. apríla 2026 ako iteratívne vylepšenie modelu GPT-5. Pri uvedení dosiahol rovnaké skóre ako Claude Opus 4.6 na GPQA Diamond (93,6 %) a zaznamenal najvyššie skóre Terminal-Bench spomedzi všetkých doteraz nameraných modelov — 82,7 % — čo odráža mimoriadnu silu v autonómnej správe systémov, shell skriptovaní a DevOps automatizácii. OpenAI postavilo GPT-5.5 ako primárny univerzálny model vo svojom API a stal sa predvoleným modelom poháňajúcim ChatGPT pre väčšinu používateľov. Dosiahol tiež 68,4 % na SWE-bench Pro a 88,7 % na SWE-bench Verified, čo ho radí medzi tri najlepšie modely na kódovanie na svete.
Poznámka: Najvyššie SWE-bench Verified pred Fable 5. Najlepšie OpenAI skóre na Terminal-Bench.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI bola založená v decembri 2015 ako neziskové výskumné laboratórium umelej inteligencie Samom Altmanom, Elonom Muskom, Gregom Brockmanom, Ilyom Sutskeverom, Johnom Schulmanom a Wojciechom Zarembom s poslaním vyvinúť umelú všeobecnú inteligenciu (AGI), ktorá prospeje celému ľudstvu. V roku 2019 vytvorila dcérsku spoločnosť s obmedzeným ziskom OpenAI LP na získanie inštitucionálneho kapitálu a škálovanie trénovania modelov. Spoločnosť je známa sériou jazykových modelov GPT (GPT-1 až GPT-5.5), sériou generovania obrázkov DALL-E, rozpoznávaním reči Whisper a generovaním videa Sora. OpenAI prevádzkuje spotrebiteľskú aplikáciu ChatGPT, vývojárske API a podnikové služby prostredníctvom Microsoft Azure. Od roku 2026 udržiava úzke strategické partnerstvo so spoločnosťou Microsoft, ktorá je najväčším investorom a poskytovateľom cloudových služieb spoločnosti.
Prípady použitia
GPT-5.5 dosahuje 88 % na SWE-bench Verified — umiestnenie #2 z 13 modelov sledovaných tu. Rieši skutočné GitHub problémy, píše produkčný kód vo viacerých jazykoch a zvláda viackrokové agentské kódovacie workflowy — ide o silnú voľbu pre tímy využívajúce AI asistované vývojové nástroje.
S 93 % na GPQA Diamond (#2 zo 14 modelov) GPT-5.5 prekračuje približne 65 % hranicu ľudského PhD experta na otázky z biológie, chémie a fyziky na postgraduálnej úrovni. Využite ho na syntézu vedeckej literatúry, vyhodnocovanie hypotéz, medicínske a právne Q&A a viacodborové výskumné úlohy, kde záleží na hlbokej doménovej znalosti.
So skóre 82 % na Terminal-Bench (#1 z 8 modelov) je GPT-5.5 veľmi vhodný pre agentskú DevOps a infraštruktúrnu automatizáciu. Terminal-Bench meria autonómne vykonávanie úloh v Linux shelli — správu balíkov, operácie so súborovým systémom, riadenie procesov a viackrokovú správu systémov — bez ľudského vedenia počas úlohy.
S kontextovým oknom 1 milión tokenov dokáže GPT-5.5 spracovať celé softvérové repozitáre, dlhé právne zmluvy, výskumné správy v rozsahu kníh alebo rozsiahle histórie konverzácií v jedinom prompte — čo umožňuje hĺbkové Q&A nad dokumentmi, uvažovanie naprieč súbormi v kódovej základni a komplexnú sumarizáciu bez delenia na časti alebo RAG pipeline.
Viac na porovnanie
Porovnajte všetkých 24 modelov naprieč 11 benchmarkmi — zoraditeľné, so zdrojmi, aktualizované jún 2026.

GPT-5 je proprietárny AI model od OpenAI, klasifikovaný ako Frontier úroveň s kontextovým oknom 400 000 tokenov. Je priamo dostupný v FlowHunt. Preskúmajte benc...

GPT-5.4 je proprietárny AI model od OpenAI, klasifikovaný ako úroveň Frontier s kontextovým oknom 1M tokenov. Je priamo dostupný v FlowHunt. Preskúmajte benchma...

GPT-4.1 je proprietárny AI model od OpenAI, klasifikovaný ako pokročilý s kontextovým oknom 1 milión tokenov. Je priamo dostupný v aplikácii FlowHunt. Preskúmaj...
Súhlas s cookies
Používame cookies na vylepšenie vášho prehliadania a analýzu našej návštevnosti. See our privacy policy.