Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 je pokročilý AI model vhodný pro náročné produkční úlohy, vyvinutý společností Anthropic a vydaný v únoru 2026. Jedná se o proprietární model s uzavřenými váhami, dostupný prostřednictvím Anthropic API. Kontextové okno o velikosti 1M tokenů je dostatečně velké pro zpracování celých kódových základen, rozsáhlých technických dokumentů nebo dlouhých agentických relací bez nutnosti ořezávání.

Na FlowHunt AI Leaderboard je jedním z 24 sledovaných modelů, hodnocených napříč 4 benchmarky. Výrazná skóre: 89,0 % na MATH-500 (#2 ze 4); 58,3 % na ARC-AGI-2 (#2 ze 3); 79,6 % na SWE-bench Verified (#8 ze 13).

Claude Sonnet 4.6 byl vydán 17. února 2026 jako střední model v generaci Claude 4, umístěný mezi řadou Opus a řadou Haiku jak z hlediska schopností, tak ceny. Řada Sonnet historicky nabízela nejlepší poměr ceny a výkonu v nabídce Anthropicu — je dostatečně výkonná pro naprostou většinu programátorských a logických úloh za zhruba pětinu ceny modelů Opus. Sonnet 4.6 dosáhl skóre 58,3 % na ARC-AGI-2 (nezávisle ověřeno organizací ARC Prize Foundation), což mu při vydání zajistilo druhé nejvyšší skóre na světě v tomto benchmarku. Podporuje stejné kontextové okno 1M tokenů jako modely Opus.

Poznámka: Nejlepší finanční agent ve své třídě (63,3 %) a MCP-Atlas (61,3 %). Adaptivní myšlení.

Vydáno
Únor 2026
Kontext
1M tokenů
Váhy
Uzavřené
Úroveň
Advanced
Poskytovatel
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic je společnost zabývající se bezpečností umělé inteligence, založená v roce 2021 bývalými výzkumníky OpenAI Dario Amodeim a Danielou Amodei spolu se skupinou kolegů, kteří dříve vedli bezpečnostní a politické týmy OpenAI. Deklarovaným posláním společnosti je odpovědný rozvoj AI pro dlouhodobý prospěch lidstva a její výzkumný program je touto vizí definován: Konstituční AI (CAI) – technika pro trénování modelů k užitečnosti, neškodnosti a poctivosti prostřednictvím sebekritiky; mechanistická interpretovatelnost, jejímž cílem je reverzním inženýrstvím zjistit, co jednotlivé neurony a obvody ve velkých sítích skutečně počítají; a škálovací věda, která se snaží předvídat, jak se chování modelů mění s výpočetním výkonem a daty. Anthropic zveřejňuje tento výzkum otevřeně a stal se jedním z nejcitovanějších AI bezpečnostních laboratoří v akademické literatuře. Claude je veřejná rodina modelů společnosti Anthropic – pojmenovaná po Claudu Shannonovi, zakladateli teorie informace – a zahrnuje čtyři generace (1 až 4.x/Fable 5). Anthropic provozuje komerční API a spotřebitelský produkt Claude.ai a udržuje hluboká cloudová partnerství s AWS (Amazon Bedrock) a Google Cloud (Vertex AI).

Případy použití

K čemu použít Claude Sonnet 4.6

Softwarové inženýrství
Agentická automatizace CLI
Analýza dlouhých dokumentů a kódových základen

Strengths & Limitations

Strengths

  • Silné softwarové inženýrství — 79 % SWE-bench Verified
  • Nové vizuální uvažování — 58 % ARC-AGI-2 (nezávisle ověřeno)
  • Pokročilá matematika — 89 % MATH-500
  • Velmi dlouhé dokumenty a rozsáhlé kódové základny (1M kontext)

Limitations

  • Uzavřené váhy — nelze hostovat vlastními silami ani dolaďovat na soukromých datech

Prohlédněte si celý AI Model Leaderboard

Často kladené otázky

Zjistit více

Claude Opus 4.6 — benchmarky, schopnosti a případy použití
Claude Opus 4.6 — benchmarky, schopnosti a případy použití

Claude Opus 4.6 — benchmarky, schopnosti a případy použití

Claude Opus 4.6 je proprietární model AI od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Je přímo dostupný ve FlowHu...

5 min čtení
Claude Opus 4.7 — Benchmarky, schopnosti a případy použití
Claude Opus 4.7 — Benchmarky, schopnosti a případy použití

Claude Opus 4.7 — Benchmarky, schopnosti a případy použití

Claude Opus 4.7 je proprietární AI model od společnosti Anthropic, klasifikovaný jako Frontier úroveň s kontextovým oknem 1M tokenů. Prozkoumejte výsledky bench...

5 min čtení
Claude 3.5 Sonnet
Claude 3.5 Sonnet

Claude 3.5 Sonnet

Zjistěte více o modelu Claude 3.5 Sonnet od společnosti Anthropic: jak si vede ve srovnání s ostatními modely, jeho silné a slabé stránky a využití v oblastech ...

3 min čtení
AI Anthropic +6