Anthropic Logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 ist ein erstklassiges Frontier-KI-Modell, entwickelt von Anthropic und veröffentlicht im Mai 2026. Es ist ein proprietäres Closed-Weight-Modell, das über die Anthropic-API verfügbar ist. Das Kontextfenster von 1 Million Token ist groß genug für vollständige Codebasen, umfangreiche technische Dokumente oder ausgedehnte agentische Sitzungen ohne Kürzung.

In der FlowHunt-KI-Rangliste ist es eines von 24 erfassten Modellen, evaluiert anhand von 5 Benchmarks. Herausragende Ergebnisse: 61,4 Pkt. im AA Intelligence Index (#1 von 9); 69,2 % im SWE-bench Pro (#2 von 9); 74,6 % im Terminal-Bench (#2 von 8).

Claude Opus 4.8 wurde am 28. Mai 2026 als gezieltes Punkt-Release auf Basis von Opus 4.7 veröffentlicht. Anthropic beschrieb es als „bescheidenes, aber spürbares Upgrade zum gleichen Preis“. Die Veröffentlichung folgte einem schnellen Rhythmus: Opus 4.6, 4.7 und 4.8 kamen alle im selben Kalenderquartal auf den Markt – ein Zeichen für Anthropics Wandel hin zu kontinuierlicher, inkrementeller Auslieferung. Trotz bescheidener Verbesserungen bei den Benchmarks belegte Opus 4.8 mit 61,4 Punkten den Spitzenplatz im Artificial Analysis Intelligence Index – der höchste unabhängige Gesamtwert aller Modelle zum Zeitpunkt der Veröffentlichung – und war damit das vielseitigste Frontier-Modell nach unabhängiger Drittanbieter-Messung, auch wenn es zwei Wochen später von Claude Fable 5 bei reinen Codierungsaufgaben übertroffen wurde.

Hinweis: Bescheidenes, aber spürbares Upgrade gegenüber 4.7 zum gleichen Preis. #1 AA Intelligence Index mit 61,4.

Veröffentlicht
Mai 2026
Kontext
1 M Token
Gewichte
Geschlossen
Stufe
Frontier
Anbieter
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic ist ein KI-Sicherheitsunternehmen, das 2021 von den ehemaligen OpenAI-Forschern Dario Amodei und Daniela Amodei zusammen mit einer Gruppe von Kollegen gegründet wurde, die zuvor die Sicherheits- und Policy-Teams von OpenAI geleitet hatten. Die erklärte Mission des Unternehmens ist die verantwortungsvolle Entwicklung von KI zum langfristigen Nutzen der Menschheit, und seine Forschungsagenda wird durch dieses Engagement definiert: Constitutional AI (CAI), eine Technik zum Trainieren von Modellen, die durch Selbstkritik hilfreich, harmlos und ehrlich sind; mechanistische Interpretierbarkeit, die darauf abzielt, nachzuvollziehen, was einzelne Neuronen und Schaltkreise in großen Netzwerken tatsächlich berechnen; und Scaling Science, die versucht vorherzusagen, wie sich Modellverhalten mit Rechenleistung und Daten verändert. Anthropic veröffentlicht diese Forschung offen und hat sich zu einem der meistzitierten KI-Sicherheitslabore in der akademischen Literatur entwickelt. Claude ist Anthropics öffentliche Modellfamilie – benannt nach Claude Shannon, dem Begründer der Informationstheorie – und umfasst vier Generationen (1 bis 4.x/Fable 5). Anthropic betreibt eine kommerzielle API und das verbraucherorientierte Produkt Claude.ai und unterhält tiefe Cloud-Partnerschaften mit AWS (Amazon Bedrock) und Google Cloud (Vertex AI).

Anwendungsfälle

Wofür Sie Claude Opus 4.8 Nutzen Sollten

Softwareentwicklung
Wissenschaftliches & technisches Denken
Agentische CLI-Automatisierung
Langdokument- & Codebase-Analyse

Strengths & Limitations

Strengths

  • Starke Softwareentwicklung – 88 % SWE-bench Verified
  • Wissenschaftliches Denken auf Graduiertenniveau – 93 % GPQA Diamond
  • Agentische Linux-/CLI-Automatisierung – 74 % Terminal-Bench
  • Verbundintelligenz – 61 Pkt. AA Intelligence Index (unabhängig)
  • Sehr lange Dokumente und große Codebasen (1 M Kontext)

Limitations

  • Closed-Weight – kann nicht selbst gehostet oder mit privaten Daten feinabgestimmt werden

Zur vollständigen KI-Modell-Rangliste

Häufig gestellte Fragen

Mehr erfahren