Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 är en avancerad AI-modell som lämpar sig för krävande produktionsarbetsflöden, utvecklad av Anthropic och släppt i februari 2026. Det är en proprietär modell med stängda vikter, tillgänglig via Anthropic API. Kontextfönstret på 1M tokens är tillräckligt stort för att rymma hela kodbaser, långa tekniska dokument eller utökade agentiska sessioner utan trunkering.

På FlowHunts AI-topplista är den en av 24 spårade modeller, utvärderad över 4 benchmarktester. Framstående resultat: 89,0 % på MATH-500 (#2 av 4); 58,3 % på ARC-AGI-2 (#2 av 3); 79,6 % på SWE-bench Verified (#8 av 13).

Claude Sonnet 4.6 släpptes den 17 februari 2026 som mellannivåmodellen i Claude 4-generationen, placerad mellan Opus-serien och Haiku-linjen både vad gäller kapacitet och pris. Sonnet-nivån har historiskt sett erbjudit det bästa pris-till-prestanda-förhållandet i Anthropics sortiment — tillräckligt kraftfull för de allra flesta programmerings- och resonemangsuppgifter till ungefär en femtedel av Opus prissättning. Sonnet 4.6 uppnådde 58,3 % på ARC-AGI-2 (oberoende verifierad av ARC Prize Foundation), vilket gav den näst högsta poängen globalt på det benchmarktestet vid lanseringen. Den har samma kontextfönster på 1M tokens som Opus-modellerna.

Notera: Bäst i klassen för finansagent (63,3 %) och MCP-Atlas (61,3 %). Adaptivt tänkande.

Utgiven
Februari 2026
Kontext
1M tokens
Vikter
Stängda
Nivå
Advanced
Utgivare
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic är ett AI-säkerhetsföretag som grundades 2021 av tidigare OpenAI-forskarna Dario Amodei och Daniela Amodei, tillsammans med en grupp kollegor som hade lett OpenAIs säkerhets- och policyteam. Företagets uttalade uppdrag är en ansvarsfull utveckling av AI för mänsklighetens långsiktiga nytta, och dess forskningsagenda definieras av detta åtagande: Constitutional AI (CAI), en teknik för att träna modeller att vara hjälpsamma, ofarliga och ärliga genom självkritik; mekanistisk tolkningsbarhet, som syftar till att omvändkonstruera vad enskilda neuroner och kretsar i stora nätverk faktiskt beräknar; och skalningsvetenskap, som försöker förutsäga hur modellbeteende förändras med beräkningskraft och data. Anthropic publicerar denna forskning öppet och har blivit ett av de mest citerade AI-säkerhetslabbarna i akademisk litteratur. Claude är Anthropics publika modellfamilj — uppkallad efter Claude Shannon, informationsteorins grundare — och omfattar fyra generationer (1 till 4.x/Fable 5). Anthropic driver ett kommersiellt API och en konsumentinriktad Claude.ai-produkt, och har djupa molnpartnerskap med AWS (Amazon Bedrock) och Google Cloud (Vertex AI).

Användningsområden

Vad du ska använda Claude Sonnet 4.6 till

Programvaruteknik
Agentisk CLI-automation
Analys av långa dokument och kodbaser

Strengths & Limitations

Strengths

  • Stark programvaruteknik — 79 % SWE-bench Verified
  • Nyskapande visuellt resonemang — 58 % ARC-AGI-2 (oberoende verifierad)
  • Avancerad matematik — 89 % MATH-500
  • Mycket långa dokument och stora kodbaser (1M kontext)

Limitations

  • Stängda vikter — kan inte självhostas eller finjusteras på privat data

Bläddra i hela AI-modelltopplistan

Vanliga frågor

Lär dig mer