
GPT-5 — Benchmark, Capacità e Casi d'Uso
GPT-5 è un modello AI proprietario di OpenAI, classificato come livello Frontier con una finestra di contesto di 400K token. È disponibile direttamente in FlowH...
GPT-5.5 è un modello AI frontier di alto livello, sviluppato da OpenAI e rilasciato ad aprile 2026. È un modello proprietario a pesi chiusi, disponibile tramite l’API di OpenAI. La finestra di contesto di 1 milione di token è sufficientemente grande da contenere intere codebase, lunghi documenti tecnici o sessioni agentiche estese senza troncamento.
Nella Classifica AI di FlowHunt è uno dei 24 modelli tracciati, valutato su 6 benchmark. Punteggi di rilievo: 82,7% su Terminal-Bench (#1 di 8); 88,7% su SWE-bench Verified (#2 di 13); 93,6% su GPQA Diamond (#2 di 14).
GPT-5.5 è stato rilasciato da OpenAI il 23 aprile 2026 come perfezionamento incrementale di GPT-5. Al lancio, ha eguagliato Claude Opus 4.6 su GPQA Diamond con il 93,6% e ha registrato il punteggio più alto mai misurato su Terminal-Bench — 82,7% — riflettendo una particolare forza nell’amministrazione autonoma di sistemi, scripting shell e automazione DevOps. OpenAI ha posizionato GPT-5.5 come modello generalista principale nella sua API, ed è diventato il modello predefinito per ChatGPT per la maggior parte degli utenti. Ha inoltre registrato il 68,4% su SWE-bench Pro e l'88,7% su SWE-bench Verified, collocandosi tra i primi tre modelli di coding a livello globale.
Nota: SWE-bench Verified più alto prima di Fable 5. Miglior punteggio OpenAI su Terminal-Bench.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI è stata fondata nel dicembre 2015 come laboratorio di ricerca sull'IA senza scopo di lucro da Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman e Wojciech Zaremba, con la missione di sviluppare un'intelligenza artificiale generale (AGI) che avvantaggi tutta l'umanità. Nel 2019 ha creato una sussidiaria a profitto limitato, OpenAI LP, per raccogliere capitali istituzionali e scalare l'addestramento dei modelli. L'azienda è nota per la serie GPT di modelli linguistici (da GPT-1 a GPT-5.5), la serie di generazione di immagini DALL-E, il riconoscimento vocale Whisper e la generazione video Sora. OpenAI gestisce l'applicazione consumer ChatGPT, un'API per sviluppatori e servizi enterprise tramite Microsoft Azure. A partire dal 2026 mantiene una stretta partnership strategica con Microsoft, che è il maggiore investitore e fornitore cloud dell'azienda.
Casi d'Uso
GPT-5.5 ottiene l'88% su SWE-bench Verified — classificato #2 di 13 modelli tracciati qui. Risolve problemi reali di GitHub, scrive codice di qualità produzione in più linguaggi e gestisce flussi di lavoro agentici di coding multi-step — una scelta forte per team di sviluppo software assistiti dall'AI.
Con il 93% su GPQA Diamond (#2 di 14 modelli), GPT-5.5 supera la linea di base umana di circa il 65% di esperti con dottorato su domande di biologia, chimica e fisica di livello universitario avanzato. Usalo per sintesi di letteratura scientifica, valutazione di ipotesi, Q&A medico e legale e attività di ricerca multidisciplinare dove la conoscenza approfondita del dominio è importante.
Con un punteggio dell'82% su Terminal-Bench (#1 di 8 modelli), GPT-5.5 è particolarmente adatto per DevOps agentico e automazione dell'infrastruttura. Terminal-Bench misura il completamento autonomo di attività shell Linux — gestione pacchetti, operazioni sul filesystem, controllo dei processi e amministrazione di sistema multi-step — senza guida umana durante l'attività.
Con una finestra di contesto di 1 milione di token, GPT-5.5 può ingerire interi repository software, lunghi contratti legali, rapporti di ricerca della lunghezza di un libro o estese cronologie di conversazione in un unico prompt — consentendo Q&A approfonditi su documenti, ragionamento su codebase multi-file e riassunti completi senza euristiche di chunking o pipeline RAG.
Altri da Confrontare
Confronta tutti i 24 modelli su 11 benchmark — ordinabili, fonti citate, aggiornato a giugno 2026.

GPT-5 è un modello AI proprietario di OpenAI, classificato come livello Frontier con una finestra di contesto di 400K token. È disponibile direttamente in FlowH...

GPT-5.4 è un modello AI proprietario di OpenAI, classificato come livello Frontier con una finestra di contesto di 1 milione di token. È disponibile direttament...

Scopri i rivoluzionari progressi, casi d’uso, benchmark, sicurezza, prezzi e prospettive future di ChatGPT-5 in questa guida definitiva di FlowHunt.
Consenso Cookie
Usiamo i cookie per migliorare la tua esperienza di navigazione e analizzare il nostro traffico. See our privacy policy.