
Claude Opus 4.8 — Srovnávací testy, schopnosti a případy použití
Claude Opus 4.8 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Frontier s kontextovým oknem 1M tokenů. Prozkoumejte výsledky benchmarků, ...
Claude Opus 4.6 je špičkový frontier AI model, vyvinutý společností Anthropic a vydaný v únoru 2026. Jedná se o proprietární model s uzavřenými váhami, dostupný prostřednictvím Anthropic API. Kontextové okno o velikosti 1M tokenů je dostatečně velké pro celé kódové základny, rozsáhlé technické dokumenty nebo dlouhé agentské relace bez zkracování.
Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů, hodnocených napříč 6 benchmarky. Výrazná skóre: 69,2 % na ARC-AGI-2 (#1 ze 3); 53,0 % na HLE (#1 ze 6); 80,8 % na SWE-bench Verified (#5 ze 13).
Claude Opus 4.6 byl vydán 5. února 2026 a získal zvláštní pozornost díky svému výkonu v nových úlohách vizuálního uvažování. Drží nejvyšší veřejně ověřené skóre na ARC-AGI-2 s hodnotou 69,17 % — benchmark abstraktního rozpoznávání vizuálních vzorů nezávisle ověřený nadací ARC Prize Foundation a navržený speciálně proti zapamatování. Tento výsledek posunul Opus 4.6 nad přibližně 60% lidský baseline v testu, který předchozí frontier modely jen stěží překonávaly. Dosáhl také 91,3 % na GPQA Diamond a 53,0 % na Humanity’s Last Exam, čímž se v první polovině roku 2026 stal vedoucím modelem pro náročné úlohy uvažování.
Poznámka: SOTA ARC-AGI-2 69,17 % (3P ARC Prize). Bezpečnostní klasifikace ASL-3.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.8% | 5 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 57.3% | 8 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 91.3% | 5 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 65.4% | 7 of 8 | SR | Agentic Linux terminal task completion |
| ARC-AGI-2 | 69.2% | 1 of 3 | 3P | Novel visual reasoning, no memorisation |
| HLE | 53.0% | 1 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic je společnost zabývající se bezpečností umělé inteligence, založená v roce 2021 bývalými výzkumníky OpenAI Dario Amodeim a Danielou Amodei spolu se skupinou kolegů, kteří dříve vedli bezpečnostní a politické týmy OpenAI. Deklarovaným posláním společnosti je odpovědný rozvoj AI pro dlouhodobý prospěch lidstva a její výzkumný program je touto vizí definován: Konstituční AI (CAI) – technika pro trénování modelů k užitečnosti, neškodnosti a poctivosti prostřednictvím sebekritiky; mechanistická interpretovatelnost, jejímž cílem je reverzním inženýrstvím zjistit, co jednotlivé neurony a obvody ve velkých sítích skutečně počítají; a škálovací věda, která se snaží předvídat, jak se chování modelů mění s výpočetním výkonem a daty. Anthropic zveřejňuje tento výzkum otevřeně a stal se jedním z nejcitovanějších AI bezpečnostních laboratoří v akademické literatuře. Claude je veřejná rodina modelů společnosti Anthropic – pojmenovaná po Claudu Shannonovi, zakladateli teorie informace – a zahrnuje čtyři generace (1 až 4.x/Fable 5). Anthropic provozuje komerční API a spotřebitelský produkt Claude.ai a udržuje hluboká cloudová partnerství s AWS (Amazon Bedrock) a Google Cloud (Vertex AI).
Případy použití
Claude Opus 4.6 dosahuje 80 % na SWE-bench Verified — umístěn na #5 ze 13 modelů sledovaných zde. Řeší reálné GitHub problémy, píše produkční kód ve více jazycích a zvládá vícekrokové agentské programátorské workflow — silná volba pro týmy využívající AI-assisted vývoj softwaru.
S 91 % na GPQA Diamond (#5 ze 14 modelů) Claude Opus 4.6 překonává přibližně 65% baseline lidských PhD studentů v otázkách z biologie, chemie a fyziky na postgraduální úrovni. Použijte jej pro syntézu vědecké literatury, vyhodnocování hypotéz, lékařské a právní Q&A a víceoborové výzkumné úlohy, kde záleží na hlubokých doménových znalostech.
Claude Opus 4.6 dosahuje 65 % na Terminal-Bench (#7 z 8 modelů), což jej činí kompetentním pro běžné shell skriptování, CLI workflow a lehkou správu systémů v rámci agentských pipeline.
S kontextovým oknem 1M tokenů dokáže Claude Opus 4.6 zpracovat celé softwarové repozitáře, dlouhé právní smlouvy, knižní výzkumné zprávy nebo rozsáhlé historie konverzací v jediném promptu — což umožňuje hlubokou Q&A nad dokumenty, uvažování napříč soubory v kódové základně a komplexní sumarizaci bez dělení do chunků nebo RAG pipeline.
Více k porovnání
Porovnejte všech 24 modelů napříč 11 benchmarky — řaditelné, s uvedením zdrojů, aktualizováno červen 2026.

Claude Opus 4.8 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Frontier s kontextovým oknem 1M tokenů. Prozkoumejte výsledky benchmarků, ...

Claude Opus 4.7 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Prozkoumejte výsledky bench...

Claude Sonnet 4.6 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Advanced s kontextovým oknem 1M tokenů. Je dostupný přímo v FlowHunt. Pr...
Souhlas s cookies
Používáme cookies ke zlepšení vašeho prohlížení a analýze naší návštěvnosti. See our privacy policy.