
Claude Opus 4.6 — benchmarky, schopnosti a případy použití
Claude Opus 4.6 je proprietární model AI od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Je přímo dostupný ve FlowHu...
Claude Sonnet 4.6 je pokročilý AI model vhodný pro náročné produkční úlohy, vyvinutý společností Anthropic a vydaný v únoru 2026. Jedná se o proprietární model s uzavřenými váhami, dostupný prostřednictvím Anthropic API. Kontextové okno o velikosti 1M tokenů je dostatečně velké pro zpracování celých kódových základen, rozsáhlých technických dokumentů nebo dlouhých agentických relací bez nutnosti ořezávání.
Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů, hodnocených napříč 4 benchmarky. Výrazná skóre: 89,0 % na MATH-500 (#2 ze 4); 58,3 % na ARC-AGI-2 (#2 ze 3); 79,6 % na SWE-bench Verified (#8 ze 13).
Claude Sonnet 4.6 byl vydán 17. února 2026 jako střední model v generaci Claude 4, umístěný mezi řadou Opus a řadou Haiku jak z hlediska schopností, tak ceny. Řada Sonnet historicky nabízela nejlepší poměr ceny a výkonu v nabídce Anthropicu — je dostatečně výkonná pro naprostou většinu programátorských a logických úloh za zhruba pětinu ceny modelů Opus. Sonnet 4.6 dosáhl skóre 58,3 % na ARC-AGI-2 (nezávisle ověřeno organizací ARC Prize Foundation), což mu při vydání zajistilo druhé nejvyšší skóre na světě v tomto benchmarku. Podporuje stejné kontextové okno 1M tokenů jako modely Opus.
Poznámka: Nejlepší finanční agent ve své třídě (63,3 %) a MCP-Atlas (61,3 %). Adaptivní myšlení.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 79.6% | 8 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| Terminal-Bench | 59.1% | 8 of 8 | SR | Agentic Linux terminal task completion |
| MATH-500 | 89.0% | 2 of 4 | SR | Hendrycks math (500 problems) |
| ARC-AGI-2 | 58.3% | 2 of 3 | 3P | Novel visual reasoning, no memorisation |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Claude Sonnet 4.6 | GPT-4.1 | DeepSeek V4-Flash |
|---|---|---|---|
| SWE-V | 79.6% | 54.6% | 79.0% |
| Terminal | 59.1% | — | — |
| MATH | 89.0% | — | — |
| ARC-2 | 58.3% | — | — |
Anthropic je společnost zabývající se bezpečností umělé inteligence, založená v roce 2021 bývalými výzkumníky OpenAI Dario Amodeim a Danielou Amodei spolu se skupinou kolegů, kteří dříve vedli bezpečnostní a politické týmy OpenAI. Deklarovaným posláním společnosti je odpovědný rozvoj AI pro dlouhodobý prospěch lidstva a její výzkumný program je touto vizí definován: Konstituční AI (CAI) – technika pro trénování modelů k užitečnosti, neškodnosti a poctivosti prostřednictvím sebekritiky; mechanistická interpretovatelnost, jejímž cílem je reverzním inženýrstvím zjistit, co jednotlivé neurony a obvody ve velkých sítích skutečně počítají; a škálovací věda, která se snaží předvídat, jak se chování modelů mění s výpočetním výkonem a daty. Anthropic zveřejňuje tento výzkum otevřeně a stal se jedním z nejcitovanějších AI bezpečnostních laboratoří v akademické literatuře. Claude je veřejná rodina modelů společnosti Anthropic – pojmenovaná po Claudu Shannonovi, zakladateli teorie informace – a zahrnuje čtyři generace (1 až 4.x/Fable 5). Anthropic provozuje komerční API a spotřebitelský produkt Claude.ai a udržuje hluboká cloudová partnerství s AWS (Amazon Bedrock) a Google Cloud (Vertex AI).
Případy použití
Claude Sonnet 4.6 dosahuje skóre 79 % na SWE-bench Verified — umístěn na #8 ze 13 zde sledovaných modelů. Řeší reálné GitHub problémy, píše produkční kód ve více jazycích a zvládá vícekrokové agentické programátorské pracovní postupy — je silnou volbou pro týmy využívající AI asistované vývoje softwaru.
Claude Sonnet 4.6 dosahuje 59 % na Terminal-Bench (#8 z 8 modelů), což jej předurčuje pro shellové skriptování, příkazové řádkové pracovní postupy a nenáročné úlohy správy systému v rámci agentických pipeline.
S kontextovým oknem 1M tokenů dokáže Claude Sonnet 4.6 zpracovat celé softwarové repozitáře, dlouhé právní smlouvy, výzkumné zprávy o velikosti knih nebo rozsáhlé historie konverzací v jediném promptu — umožňuje hlubokou Q&A nad dokumenty, uvažování napříč soubory v kódové základně a komplexní sumarizaci bez heuristik chunkování nebo RAG pipeline.
Více ke srovnání
Porovnejte všech 24 modelů napříč 11 benchmarky — řaditelné, s uvedenými zdroji, aktualizováno červen 2026.

Claude Opus 4.6 je proprietární model AI od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Je přímo dostupný ve FlowHu...

Claude Opus 4.7 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Prozkoumejte výsledky bench...

Zjistěte více o modelu Claude 3.5 Sonnet od společnosti Anthropic: jak si vede ve srovnání s ostatními modely, jeho silné a slabé stránky a využití v oblastech ...
Souhlas s cookies
Používáme cookies ke zlepšení vašeho prohlížení a analýze naší návštěvnosti. See our privacy policy.