
GPT-5 — Repere, Capacități și Cazuri de Utilizare
GPT-5 este un model AI proprietar dezvoltat de OpenAI, clasificat la nivel Frontier, cu o fereastră de context de 400K de tokeni. Este disponibil direct în Flow...
GPT-5.5 este un model AI de frontieră de top, dezvoltat de OpenAI și lansat în aprilie 2026. Este un model proprietar cu greutăți închise, disponibil prin API-ul OpenAI. Fereastra de context de 1 milion de tokeni este suficient de mare pentru a stoca baze de cod întregi, documente tehnice lungi sau sesiuni agentice extinse fără trunchiere.
În Clasamentul AI FlowHunt este unul dintre cele 24 de modele urmărite, evaluate pe 6 benchmark-uri. Scoruri remarcabile: 82,7% pe Terminal-Bench (#1 din 8); 88,7% pe SWE-bench Verified (#2 din 13); 93,6% pe GPQA Diamond (#2 din 14).
GPT-5.5 a fost lansat de OpenAI pe 23 aprilie 2026 ca o rafinare iterativă a GPT-5. La lansare, a egalat Claude Opus 4.6 pe GPQA Diamond cu 93,6% și a înregistrat cel mai mare scor Terminal-Bench dintre toate modelele măsurate — 82,7% — reflectând o putere deosebită în administrarea autonomă a sistemelor, scripting shell și automatizare DevOps. OpenAI a poziționat GPT-5.5 ca modelul principal de uz general în API-ul său, iar acesta a devenit modelul implicit care alimentează ChatGPT pentru majoritatea utilizatorilor. De asemenea, a înregistrat 68,4% pe SWE-bench Pro și 88,7% pe SWE-bench Verified, plasându-se printre primele trei modele de codare la nivel global.
Notă: Cel mai mare scor SWE-bench Verified înainte de Fable 5. Cel mai bun scor OpenAI pe Terminal-Bench.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI a fost fondată în decembrie 2015 ca un laborator non-profit de cercetare AI de către Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman și Wojciech Zaremba, cu misiunea de a dezvolta inteligența artificială generală (AGI) care să beneficieze întreaga umanitate. În 2019 a creat o subsidiară cu profit limitat, OpenAI LP, pentru a atrage capital instituțional și a scala instruirea modelelor. Compania este cunoscută pentru seria de modele lingvistice GPT (GPT-1 până la GPT-5.5), seria de generare de imagini DALL-E, recunoașterea vocală Whisper și generarea video Sora. OpenAI operează aplicația de consum ChatGPT, un API pentru dezvoltatori și servicii enterprise prin Microsoft Azure. Începând cu 2026, menține un parteneriat strategic strâns cu Microsoft, care este cel mai mare investitor și furnizor de cloud al companiei.
Cazuri de Utilizare
GPT-5.5 obține 88% pe SWE-bench Verified — clasat #2 din 13 modele urmărite aici. Rezolvă probleme reale de pe GitHub, scrie cod de calitate industrială în mai multe limbaje de programare și gestionează fluxuri de lucru agentice în mai mulți pași — o alegere solidă pentru echipele de dezvoltare software asistată de AI.
Cu 93% pe GPQA Diamond (#2 din 14 modele), GPT-5.5 depășește pragul de referință de ~65% al experților umani cu doctorat la întrebări de biologie, chimie și fizică de nivel universitar. Folosește-l pentru sinteza literaturii științifice, evaluarea ipotezelor, întrebări și răspunsuri medicale și juridice și sarcini de cercetare multidisciplinară unde cunoașterea aprofundată contează.
Cu un scor de 82% pe Terminal-Bench (#1 din 8 modele), GPT-5.5 este potrivit pentru automatizarea DevOps și a infrastructurii agentice. Terminal-Bench măsoară finalizarea autonomă a sarcinilor din terminalul Linux — gestionarea pachetelor, operațiuni cu sistemul de fișiere, controlul proceselor și administrarea sistemului în mai mulți pași — fără ghidare umană pe parcurs.
Cu o fereastră de context de 1 milion de tokeni, GPT-5.5 poate procesa depozite software întregi, contracte juridice lungi, rapoarte de cercetare de dimensiunea unei cărți sau istorii extinse de conversații într-un singur prompt — permițând întrebări și răspunsuri profunde pe documente, raționament cross-fișier în baze de cod și sumarizare cuprinzătoare fără euristici de chunking sau pipeline-uri RAG.
Mai Multe de Comparat
Compară toate cele 24 de modele pe 11 benchmark-uri — sortabil, cu surse, actualizat iunie 2026.

GPT-5 este un model AI proprietar dezvoltat de OpenAI, clasificat la nivel Frontier, cu o fereastră de context de 400K de tokeni. Este disponibil direct în Flow...

GPT-5.4 este un model AI proprietar dezvoltat de OpenAI, clasificat la nivelul Frontier, cu un context de 1M tokeni. Este disponibil direct în FlowHunt. Explore...

Explorează progresele de referință ale ChatGPT-5, cazuri de utilizare, benchmarkuri, securitate, prețuri și direcții viitoare în acest ghid FlowHunt.
Consimțământ Cookie
Folosim cookie-uri pentru a vă îmbunătăți experiența de navigare și a analiza traficul nostru. See our privacy policy.