Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 er en avanceret AI-model, der er velegnet til krævende produktionsarbejdsbelastninger, udviklet af Anthropic og udgivet i februar 2026. Det er en proprietær closed-weight-model, tilgængelig via Anthropic API. Kontekstvinduet på 1M tokens er stort nok til at rumme hele kodebaser, lange tekniske dokumenter eller udvidede agentiske sessioner uden trunkering.

På FlowHunt AI Leaderboard er den en af 24 overvågede modeller, evalueret på tværs af 4 benchmarks. Fremtrædende scoringer: 89,0% på MATH-500 (#2 af 4); 58,3% på ARC-AGI-2 (#2 af 3); 79,6% på SWE-bench Verified (#8 af 13).

Claude Sonnet 4.6 blev udgivet den 17. februar 2026 som mellemniveau-modellen i Claude 4-generationen, placeret mellem Opus-serien og Haiku-linjen både i kapacitet og pris. Sonnet-niveauet har historisk set tilbudt det bedste pris-til-ydelse-forhold i Anthropics sortiment — dygtig nok til langt de fleste kodnings- og ræsonneringsopgaver til cirka en femtedel af Opus-prisen. Sonnet 4.6 opnåede 58,3% på ARC-AGI-2 (uafhængigt verificeret af ARC Prize Foundation), hvilket gav den den næsthøjeste score globalt på det benchmark ved udgivelsen. Den understøtter det samme kontekstvindue på 1M tokens som Opus-modellerne.

Bemærk: Bedst-i-klasse finansagent (63,3%) og MCP-Atlas (61,3%). Adaptiv tænkning.

Udgivet
Februar 2026
Kontekst
1M tokens
Vægte
Lukkede
Niveau
Advanced
Udbyder
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic er et AI-sikkerhedsselskab grundlagt i 2021 af tidligere OpenAI-forskere Dario Amodei og Daniela Amodei sammen med en gruppe kolleger, der tidligere havde ledet OpenAIs sikkerheds- og politikafdelinger. Virksomhedens erklærede mission er den ansvarlige udvikling af AI til gavn for menneskeheden på lang sigt, og dens forskningsdagsorden er defineret af dette engagement: Constitutional AI (CAI), en teknik til at træne modeller til at være hjælpsomme, harmløse og ærlige gennem selvkritik; mekanistisk fortolkbarhed, som sigter mod at reverse-engineere, hvad individuelle neuroner og kredsløb i store netværk rent faktisk beregner; og skaleringsvidenskab, som forsøger at forudsige, hvordan modeladfærd ændrer sig med regnekraft og data. Anthropic offentliggør denne forskning åbent og er blevet et af de mest citerede AI-sikkerhedslaboratorier i den akademiske litteratur. Claude er Anthropics offentlige modelfamilie — opkaldt efter Claude Shannon, grundlæggeren af informationsteori — og spænder over fire generationer (1 til 4.x/Fable 5). Anthropic driver en kommerciel API og det forbrugerrettede Claude.ai-produkt og opretholder dybe cloud-partnerskaber med AWS (Amazon Bedrock) og Google Cloud (Vertex AI).

Anvendelsesmuligheder

Hvad skal Claude Sonnet 4.6 bruges til

Softwareudvikling
Agentisk CLI-automatisering
Langdokument- og kodebaseanalyse

Strengths & Limitations

Strengths

  • Stærk softwareudvikling — 79% SWE-bench Verified
  • Ny visuel ræsonnering — 58% ARC-AGI-2 (uafhængigt verificeret)
  • Avanceret matematik — 89% MATH-500
  • Meget lange dokumenter og store kodebaser (1M kontekst)

Limitations

  • Lukkede vægte — kan ikke selv-hostes eller finjusteres på private data

Se hele AI Model Leaderboard

Ofte stillede spørgsmål

Lær mere