Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 to zaawansowany model AI przeznaczony do wymagających obciążeń produkcyjnych, opracowany przez firmę Anthropic i wydany w lutym 2026 roku. Jest to zastrzeżony model o zamkniętych wagach, dostępny przez API Anthropic. Okno kontekstowe o pojemności 1 miliona tokenów jest wystarczająco duże, aby pomieścić całe bazy kodu źródłowego, obszerne dokumenty techniczne lub rozszerzone sesje agencyjne bez obcinania treści.

Na liście rankingowej AI FlowHunt jest jednym z 24 śledzonych modeli, ocenianym w 4 benchmarkach. Wyróżniające się wyniki: 89,0% w MATH-500 (#2 z 4); 58,3% w ARC-AGI-2 (#2 z 3); 79,6% w SWE-bench Verified (#8 z 13).

Claude Sonnet 4.6 został wydany 17 lutego 2026 roku jako model średniego poziomu w generacji Claude 4, umiejscowiony pomiędzy serią Opus a linią Haiku zarówno pod względem możliwości, jak i ceny. Poziom Sonnet historycznie oferował najlepszy stosunek ceny do wydajności w ofercie Anthropic — wystarczająco wydajny dla zdecydowanej większości zadań związanych z kodowaniem i rozumowaniem, przy mniej więcej jednej piątej ceny modeli Opus. Sonnet 4.6 uzyskał 58,3% w ARC-AGI-2 (niezależnie zweryfikowane przez ARC Prize Foundation), co dało mu drugi najwyższy wynik globalnie w tym benchmarku w momencie premiery. Obsługuje to samo okno kontekstowe 1 miliona tokenów co modele Opus.

Uwaga: Najlepszy w swojej klasie agent finansowy (63,3%) i MCP-Atlas (61,3%). Myślenie adaptacyjne.

Data wydania
Luty 2026
Kontekst
1M tokenów
Wagi
Zamknięte
Poziom
Advanced
Dostawca
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic to firma zajmująca się bezpieczeństwem sztucznej inteligencji, założona w 2021 roku przez byłych badaczy OpenAI – Dario Amodei i Danielę Amodei wraz z grupą współpracowników, którzy wcześniej kierowali zespołami ds. bezpieczeństwa i polityki OpenAI. Deklarowaną misją firmy jest odpowiedzialny rozwój AI dla długoterminowego dobra ludzkości, a jej program badawczy określają: Sztuczna Inteligencja Konstytucyjna (CAI) – technika trenowania modeli, by były pomocne, nieszkodliwe i uczciwe poprzez samokrytykę; interpretowalność mechanistyczna, której celem jest inżynieria wsteczna tego, co faktycznie obliczają poszczególne neurony i obwody w dużych sieciach; oraz nauka o skalowaniu, która próbuje przewidzieć, jak zmienia się zachowanie modelu wraz ze wzrostem mocy obliczeniowej i danych. Anthropic publikuje te badania otwarcie i stało się jednym z najczęściej cytowanych laboratoriów bezpieczeństwa AI w literaturze akademickiej. Claude to publiczna rodzina modeli Anthropic – nazwana na cześć Claude'a Shannona, twórcy teorii informacji – i obejmuje cztery generacje (od 1 do 4.x/Fable 5). Anthropic prowadzi komercyjne API oraz konsumencki produkt Claude.ai, a także utrzymuje głęboką współpracę chmurową z AWS (Amazon Bedrock) i Google Cloud (Vertex AI).

Zastosowania

Do czego używać Claude Sonnet 4.6

Inżynieria oprogramowania
Automatyzacja CLI z agentami
Analiza długich dokumentów i baz kodu

Strengths & Limitations

Strengths

  • Silna inżynieria oprogramowania — 79% SWE-bench Verified
  • Nowatorskie rozumowanie wizualne — 58% ARC-AGI-2 (niezależnie zweryfikowane)
  • Zaawansowana matematyka — 89% MATH-500
  • Bardzo długie dokumenty i duże bazy kodu (kontekst 1M)

Limitations

  • Zamknięte wagi — brak możliwości samodzielnego hostowania lub dostrajania na prywatnych danych

Przeglądaj pełną listę rankingową modeli AI

Najczęściej zadawane pytania

Dowiedz się więcej

Claude Opus 4.6 — Benchmarki, możliwości i zastosowania
Claude Opus 4.6 — Benchmarki, możliwości i zastosowania

Claude Opus 4.6 — Benchmarki, możliwości i zastosowania

Claude Opus 4.6 to autorski model AI od Anthropic, sklasyfikowany jako poziom Frontier z oknem kontekstowym 1 mln tokenów. Jest dostępny bezpośrednio w FlowHunt...

5 min czytania
Claude 3.5 Sonnet
Claude 3.5 Sonnet

Claude 3.5 Sonnet

Dowiedz się więcej o Claude 3.5 Sonnet firmy Anthropic: jak wypada na tle innych modeli, jakie ma mocne i słabe strony oraz gdzie znajduje zastosowanie – w tym ...

2 min czytania
AI Anthropic +6