Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 è un modello AI frontier di alto livello, sviluppato da Anthropic e rilasciato a maggio 2026. È un modello proprietario a pesi chiusi, disponibile tramite l’API Anthropic. La finestra di contesto di 1 milione di token è sufficientemente grande da contenere interi codebase, lunghi documenti tecnici o sessioni agentiche estese senza troncamento.

Nella Classifica AI di FlowHunt è uno dei 24 modelli tracciati, valutato su 5 benchmark. Punteggi di rilievo: 61,4 pt su AA Intelligence Index (#1 su 9); 69,2% su SWE-bench Pro (#2 su 9); 74,6% su Terminal-Bench (#2 su 8).

Claude Opus 4.8 è stato rilasciato il 28 maggio 2026 come rilascio puntuale mirato basato su Opus 4.7, con Anthropic che lo ha descritto come un “upgrade modesto ma tangibile allo stesso prezzo”. Il rilascio ha seguito un ritmo serrato: Opus 4.6, 4.7 e 4.8 sono stati tutti distribuiti nello stesso trimestre solare, riflettendo il passaggio di Anthropic verso una consegna incrementale continua. Nonostante miglioramenti modesti nei benchmark, Opus 4.8 ha conquistato la prima posizione nell’Artificial Analysis Intelligence Index con 61,4 punti — il punteggio composito indipendente più alto di qualsiasi modello al momento del rilascio — rendendolo il modello frontier più completo secondo misurazioni indipendenti di terze parti, anche se è stato superato da Claude Fable 5 nei puri compiti di codifica due settimane dopo.

Nota: upgrade modesto ma tangibile rispetto al 4.7 allo stesso prezzo. #1 AA Intelligence Index a 61,4.

Rilasciato
Maggio 2026
Contesto
1 milione di token
Pesi
Chiusi
Livello
Frontier
Fornitore
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic è un'azienda di sicurezza dell'IA fondata nel 2021 dagli ex ricercatori di OpenAI Dario Amodei e Daniela Amodei, insieme a un gruppo di colleghi che avevano guidato i team di sicurezza e policy di OpenAI. La missione dichiarata dell'azienda è lo sviluppo responsabile dell'IA per il beneficio a lungo termine dell'umanità, e la sua agenda di ricerca è definita da questo impegno: IA Costituzionale (CAI), una tecnica per addestrare modelli a essere utili, innocui e onesti attraverso l'autocritica; interpretabilità meccanicistica, che mira a fare reverse-engineering di ciò che i singoli neuroni e circuiti all'interno di grandi reti effettivamente calcolano; e scienza della scalabilità, che cerca di prevedere come il comportamento dei modelli cambi con la potenza di calcolo e i dati. Anthropic pubblica questa ricerca apertamente ed è diventato uno dei laboratori di sicurezza dell'IA più citati nella letteratura accademica. Claude è la famiglia di modelli pubblici di Anthropic — dal nome di Claude Shannon, il fondatore della teoria dell'informazione — e copre quattro generazioni (dalla 1 alla 4.x/Fable 5). Anthropic gestisce un'API commerciale e il prodotto consumer Claude.ai, e mantiene profonde partnership cloud con AWS (Amazon Bedrock) e Google Cloud (Vertex AI).

Casi d'Uso

Per Cosa Utilizzare Claude Opus 4.8

Ingegneria del Software
Ragionamento Scientifico e Tecnico
Automazione Agentica da CLI
Analisi di Documenti Lunghi e Codebase

Strengths & Limitations

Strengths

  • Solida ingegneria del software — 88% SWE-bench Verified
  • Ragionamento scientifico a livello universitario — 93% GPQA Diamond
  • Automazione agentica Linux / CLI — 74% Terminal-Bench
  • Intelligenza composita — 61 pt AA Intelligence Index (indipendente)
  • Documenti molto lunghi e grandi codebase (1 milione di contesto)

Limitations

  • Pesi chiusi — non può essere auto-ospitato o messo a punto su dati privati

Esplora la Classifica Completa dei Modelli AI

Domande frequenti

Scopri di più

Claude Opus 4.7 — Benchmark, Capacità e Casi d'Uso
Claude Opus 4.7 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.7 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.7 è un modello AI proprietario di Anthropic, classificato come livello Frontier con una finestra di contesto di 1 milione di token. Esplora punteg...

5 min di lettura
Claude Opus 4.6 — Benchmark, Capacità e Casi d'Uso
Claude Opus 4.6 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.6 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.6 è un modello di IA proprietario di Anthropic, classificato come Frontier con una finestra di contesto di 1 milione di token. È disponibile diret...

5 min di lettura
Claude Fable 5 — Benchmark, Capacità e Casi d'Uso
Claude Fable 5 — Benchmark, Capacità e Casi d'Uso

Claude Fable 5 — Benchmark, Capacità e Casi d'Uso

Claude Fable 5 è un modello AI proprietario di Anthropic, classificato come livello Super-Frontier con una finestra di contesto di 1 milione di token. Esplora i...

4 min di lettura