Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 est un modèle d’IA frontalier de premier plan, développé par Anthropic et publié en mai 2026. Il s’agit d’un modèle propriétaire à poids fermés, accessible via l’API d’Anthropic. La fenêtre de contexte de 1 million de tokens est suffisamment grande pour contenir des bases de code entières, de longs documents techniques ou des sessions agentiques étendues sans troncature.

Sur le classement FlowHunt AI Leaderboard, il fait partie des 24 modèles suivis, évalués sur 5 benchmarks. Scores remarquables : 61,4 pts sur l’AA Intelligence Index (n°1 sur 9) ; 69,2 % sur SWE-bench Pro (n°2 sur 9) ; 74,6 % sur Terminal-Bench (n°2 sur 8).

Claude Opus 4.8 a été publié le 28 mai 2026 en tant que version ponctuelle ciblée par rapport à Opus 4.7, Anthropic le décrivant comme une « amélioration modeste mais tangible au même prix ». La publication a suivi une cadence rapide : Opus 4.6, 4.7 et 4.8 sont tous sortis au cours du même trimestre calendaire, reflétant le virage d’Anthropic vers une livraison incrémentale continue. Malgré des améliorations modestes des benchmarks, Opus 4.8 a pris la première place de l’Artificial Analysis Intelligence Index avec 61,4 points — le score composite indépendant le plus élevé de tous les modèles au moment de sa publication — ce qui en fait le modèle frontalier le plus polyvalent selon des mesures indépendantes tierces, même s’il a été dépassé par Claude Fable 5 sur les tâches pures de codage deux semaines plus tard.

Note : Amélioration modeste mais tangible par rapport à la version 4.7 au même prix. N°1 de l’AA Intelligence Index à 61,4.

Date de sortie
Mai 2026
Contexte
1M tokens
Poids
Fermés
Niveau
Frontier
Fournisseur
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic est une entreprise de sécurité de l'IA fondée en 2021 par d'anciens chercheurs d'OpenAI, Dario Amodei et Daniela Amodei, ainsi qu'un groupe de collègues ayant dirigé les équipes de sécurité et de politique d'OpenAI. La mission déclarée de l'entreprise est le développement responsable de l'IA pour le bien à long terme de l'humanité, et son programme de recherche est défini par cet engagement : l'IA Constitutionnelle (CAI), une technique d'entraînement des modèles à être utiles, inoffensifs et honnêtes par l'auto-critique ; l'interprétabilité mécaniste, qui vise à rétro-ingénier ce que les neurones et circuits individuels au sein des grands réseaux calculent réellement ; et la science de la mise à l'échelle, qui tente de prédire comment le comportement des modèles évolue avec la puissance de calcul et les données. Anthropic publie cette recherche ouvertement et est devenu l'un des laboratoires de sécurité de l'IA les plus cités dans la littérature académique. Claude est la famille de modèles publique d'Anthropic — nommée d'après Claude Shannon, le fondateur de la théorie de l'information — et couvre quatre générations (1 à 4.x/Fable 5). Anthropic exploite une API commerciale et un produit grand public Claude.ai, et entretient des partenariats cloud profonds avec AWS (Amazon Bedrock) et Google Cloud (Vertex AI).

Cas d'usage

À quoi utiliser Claude Opus 4.8

Génie logiciel
Raisonnement scientifique et technique
Automatisation agentique en ligne de commande
Analyse de longs documents et de bases de code

Strengths & Limitations

Strengths

  • Solide en génie logiciel — 88 % SWE-bench Verified
  • Raisonnement scientifique de niveau graduate — 93 % GPQA Diamond
  • Automatisation agentique Linux/CLI — 74 % Terminal-Bench
  • Intelligence composite — 61 pts AA Intelligence Index (indépendant)
  • Très longs documents et grandes bases de code (1M de contexte)

Limitations

  • Poids fermés — ne peut pas être auto-hébergé ni affiné sur des données privées

Parcourir le classement complet des modèles d'IA

Questions fréquemment posées

En savoir plus

Claude Opus 4.7 — Références, Capacités et Cas d'Usage
Claude Opus 4.7 — Références, Capacités et Cas d'Usage

Claude Opus 4.7 — Références, Capacités et Cas d'Usage

Claude Opus 4.7 est un modèle d'IA propriétaire d'Anthropic, classé au niveau Frontier avec une fenêtre de contexte de 1M de tokens. Découvrez ses scores de réf...

5 min de lecture
Claude Opus 4.6 — Benchmarks, Capacités et Cas d'Usage
Claude Opus 4.6 — Benchmarks, Capacités et Cas d'Usage

Claude Opus 4.6 — Benchmarks, Capacités et Cas d'Usage

Claude Opus 4.6 est un modèle d'IA propriétaire d'Anthropic, classé au niveau Frontière avec une fenêtre de contexte de 1 million de tokens. Il est disponible d...

5 min de lecture
Claude Fable 5 — Benchmarks, Capacités et Cas d'Utilisation
Claude Fable 5 — Benchmarks, Capacités et Cas d'Utilisation

Claude Fable 5 — Benchmarks, Capacités et Cas d'Utilisation

Claude Fable 5 est un modèle d'IA propriétaire d'Anthropic, classé dans la catégorie Super-Frontier avec une fenêtre de contexte de 1 million de tokens. Découvr...

4 min de lecture