
Claude Opus 4.6 — Prestandamått, Kapaciteter och Användningsområden
Claude Opus 4.6 är en proprietär AI-modell från Anthropic, klassificerad som Frontier-nivå med ett kontextfönster på 1M tokens. Den finns direkt tillgänglig i F...
Claude Sonnet 4.6 är en avancerad AI-modell som lämpar sig för krävande produktionsarbetsflöden, utvecklad av Anthropic och släppt i februari 2026. Det är en proprietär modell med stängda vikter, tillgänglig via Anthropic API. Kontextfönstret på 1M tokens är tillräckligt stort för att rymma hela kodbaser, långa tekniska dokument eller utökade agentiska sessioner utan trunkering.
På FlowHunts AI-topplista är den en av 24 spårade modeller, utvärderad över 4 benchmarktester. Framstående resultat: 89,0 % på MATH-500 (#2 av 4); 58,3 % på ARC-AGI-2 (#2 av 3); 79,6 % på SWE-bench Verified (#8 av 13).
Claude Sonnet 4.6 släpptes den 17 februari 2026 som mellannivåmodellen i Claude 4-generationen, placerad mellan Opus-serien och Haiku-linjen både vad gäller kapacitet och pris. Sonnet-nivån har historiskt sett erbjudit det bästa pris-till-prestanda-förhållandet i Anthropics sortiment — tillräckligt kraftfull för de allra flesta programmerings- och resonemangsuppgifter till ungefär en femtedel av Opus prissättning. Sonnet 4.6 uppnådde 58,3 % på ARC-AGI-2 (oberoende verifierad av ARC Prize Foundation), vilket gav den näst högsta poängen globalt på det benchmarktestet vid lanseringen. Den har samma kontextfönster på 1M tokens som Opus-modellerna.
Notera: Bäst i klassen för finansagent (63,3 %) och MCP-Atlas (61,3 %). Adaptivt tänkande.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 79.6% | 8 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| Terminal-Bench | 59.1% | 8 of 8 | SR | Agentic Linux terminal task completion |
| MATH-500 | 89.0% | 2 of 4 | SR | Hendrycks math (500 problems) |
| ARC-AGI-2 | 58.3% | 2 of 3 | 3P | Novel visual reasoning, no memorisation |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Claude Sonnet 4.6 | GPT-4.1 | DeepSeek V4-Flash |
|---|---|---|---|
| SWE-V | 79.6% | 54.6% | 79.0% |
| Terminal | 59.1% | — | — |
| MATH | 89.0% | — | — |
| ARC-2 | 58.3% | — | — |
Anthropic är ett AI-säkerhetsföretag som grundades 2021 av tidigare OpenAI-forskarna Dario Amodei och Daniela Amodei, tillsammans med en grupp kollegor som hade lett OpenAIs säkerhets- och policyteam. Företagets uttalade uppdrag är en ansvarsfull utveckling av AI för mänsklighetens långsiktiga nytta, och dess forskningsagenda definieras av detta åtagande: Constitutional AI (CAI), en teknik för att träna modeller att vara hjälpsamma, ofarliga och ärliga genom självkritik; mekanistisk tolkningsbarhet, som syftar till att omvändkonstruera vad enskilda neuroner och kretsar i stora nätverk faktiskt beräknar; och skalningsvetenskap, som försöker förutsäga hur modellbeteende förändras med beräkningskraft och data. Anthropic publicerar denna forskning öppet och har blivit ett av de mest citerade AI-säkerhetslabbarna i akademisk litteratur. Claude är Anthropics publika modellfamilj — uppkallad efter Claude Shannon, informationsteorins grundare — och omfattar fyra generationer (1 till 4.x/Fable 5). Anthropic driver ett kommersiellt API och en konsumentinriktad Claude.ai-produkt, och har djupa molnpartnerskap med AWS (Amazon Bedrock) och Google Cloud (Vertex AI).
Användningsområden
Claude Sonnet 4.6 uppnår 79 % på SWE-bench Verified — rankad #8 av 13 modeller som spåras här. Den löser verkliga GitHub-problem, skriver produktionsklar kod på flera språk och hanterar flerstegs-agentiska kodningsarbetsflöden — ett starkt val för AI-assisterade programvaruutvecklingsteam.
Claude Sonnet 4.6 uppnår 59 % på Terminal-Bench (#8 av 8 modeller), vilket gör den kompetent för shellskriptning, kommandoradsarbetsflöden och lätta systemadministrationsuppgifter i agentiska pipelines.
Med ett kontextfönster på 1M tokens kan Claude Sonnet 4.6 mata in hela programvarurepositorier, långa juridiska avtal, boklånga forskningsrapporter eller omfattande konversationshistorik i en enda prompt — vilket möjliggör djupgående dokument-Q&A, tvärfilskodbasresonemang och omfattande sammanfattning utan chunka-heuristik eller RAG-pipelines.
Mer att jämföra
Jämför alla 24 modeller över 11 benchmarktester — sorterbara, källbelagda och uppdaterade juni 2026.

Claude Opus 4.6 är en proprietär AI-modell från Anthropic, klassificerad som Frontier-nivå med ett kontextfönster på 1M tokens. Den finns direkt tillgänglig i F...

Claude Opus 4.8 är en proprietär AI-modell från Anthropic, klassificerad som Frontier-nivå med ett kontextfönster på 1M token. Utforska benchmarkresultat, styrk...

Claude Opus 4.7 är en proprietär AI-modell från Anthropic, klassificerad som Frontier-nivå med ett kontextfönster på 1M tokens. Utforska prestandamått, styrkor ...