Logo Anthropic

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 je špičkový frontier AI model vyvinutý společností Anthropic a vydaný v květnu 2026. Jedná se o proprietární model s uzavřenými váhami dostupný prostřednictvím Anthropic API. Kontextové okno o velikosti 1M tokenů je dostatečně velké pro celé kódové základny, rozsáhlé technické dokumenty nebo dlouhé agentní relace bez nutnosti zkracování.

Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů hodnocených napříč 5 benchmarky. Výrazná skóre: 61,4 bodů v AA Intelligence Index (#1 z 9); 69,2 % v SWE-bench Pro (#2 z 9); 74,6 % v Terminal-Bench (#2 z 8).

Claude Opus 4.8 byl vydán 28. května 2026 jako cílená bodová aktualizace nad Opus 4.7, přičemž Anthropic jej popsal jako „mírné, ale hmatatelné vylepšení za stejnou cenu“. Vydání následovalo rychlé tempo: Opus 4.6, 4.7 a 4.8 byly všechny vydány během jednoho kalendářního čtvrtletí, což odráží posun Anthropic směrem k průběžnému inkrementálnímu doručování. Přes mírná zlepšení v benchmarkách se Opus 4.8 umístil na prvním místě v Artificial Analysis Intelligence Index s 61,4 body — nejvyšší nezávislé komplexní skóre ze všech modelů v době vydání — což z něj dělá nejvšestrannější frontier model podle nezávislého měření třetí strany, a to i přesto, že byl o dva týdny později překonán modelem Claude Fable 5 v čistě programovacích úlohách.

Poznámka: Mírné, ale hmatatelné vylepšení oproti 4.7 za stejnou cenu. #1 AA Intelligence Index s 61,4 body.

Vydáno
Květen 2026
Kontext
1M tokenů
Váhy
Uzavřené
Třída
Frontier
Poskytovatel
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic je společnost zabývající se bezpečností umělé inteligence, založená v roce 2021 bývalými výzkumníky OpenAI Dario Amodeim a Danielou Amodei spolu se skupinou kolegů, kteří dříve vedli bezpečnostní a politické týmy OpenAI. Deklarovaným posláním společnosti je odpovědný rozvoj AI pro dlouhodobý prospěch lidstva a její výzkumný program je touto vizí definován: Konstituční AI (CAI) – technika pro trénování modelů k užitečnosti, neškodnosti a poctivosti prostřednictvím sebekritiky; mechanistická interpretovatelnost, jejímž cílem je reverzním inženýrstvím zjistit, co jednotlivé neurony a obvody ve velkých sítích skutečně počítají; a škálovací věda, která se snaží předvídat, jak se chování modelů mění s výpočetním výkonem a daty. Anthropic zveřejňuje tento výzkum otevřeně a stal se jedním z nejcitovanějších AI bezpečnostních laboratoří v akademické literatuře. Claude je veřejná rodina modelů společnosti Anthropic – pojmenovaná po Claudu Shannonovi, zakladateli teorie informace – a zahrnuje čtyři generace (1 až 4.x/Fable 5). Anthropic provozuje komerční API a spotřebitelský produkt Claude.ai a udržuje hluboká cloudová partnerství s AWS (Amazon Bedrock) a Google Cloud (Vertex AI).

Případy použití

K čemu použít Claude Opus 4.8

Softwarové inženýrství
Vědecké a technické uvažování
Agentní automatizace CLI
Analýza dlouhých dokumentů a kódových základen

Strengths & Limitations

Strengths

  • Silné softwarové inženýrství — 88 % SWE-bench Verified
  • Vědecké uvažování na úrovni PhD — 93 % GPQA Diamond
  • Agentní automatizace Linux/CLI — 74 % Terminal-Bench
  • Komplexní inteligence — 61 bodů AA Intelligence Index (nezávislé)
  • Velmi dlouhé dokumenty a rozsáhlé kódové základny (1M kontext)

Limitations

  • Uzavřené váhy — nelze hostovat vlastní instanci ani dolaďovat na soukromých datech

Prohlédněte si celý AI Model Leaderboard

Často kladené otázky

Zjistit více

Claude Opus 4.7 — Benchmarky, schopnosti a případy použití
Claude Opus 4.7 — Benchmarky, schopnosti a případy použití

Claude Opus 4.7 — Benchmarky, schopnosti a případy použití

Claude Opus 4.7 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Prozkoumejte výsledky bench...

5 min čtení
Claude Opus 4.6 — benchmarky, schopnosti a případy použití
Claude Opus 4.6 — benchmarky, schopnosti a případy použití

Claude Opus 4.6 — benchmarky, schopnosti a případy použití

Claude Opus 4.6 je proprietární model AI od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Je přímo dostupný ve FlowHu...

5 min čtení
Claude Fable 5 — Benchmarky, schopnosti a případy použití
Claude Fable 5 — Benchmarky, schopnosti a případy použití

Claude Fable 5 — Benchmarky, schopnosti a případy použití

Claude Fable 5 je proprietární model AI od společnosti Anthropic, zařazený do kategorie Super-Frontier s kontextovým oknem 1M tokenů. Prozkoumejte výsledky benc...

4 min čtení