
Claude Opus 4.6 — Benchmarks, mogelijkheden en gebruiksscenario's
Claude Opus 4.6 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHu...
Claude Sonnet 4.6 is een geavanceerd AI-model, geschikt voor veeleisende productieworkloads, ontwikkeld door Anthropic en uitgebracht in februari 2026. Het is een propriëtair closed-weight model, beschikbaar via de Anthropic API. Het contextvenster van 1M tokens is groot genoeg om volledige codebases, uitgebreide technische documenten of langdurige agentische sessies zonder afkapping te verwerken.
Op het FlowHunt AI Leaderboard is het een van de 24 gevolgde modellen, geëvalueerd op 4 benchmarks. Opvallende scores: 89,0% op MATH-500 (#2 van 4); 58,3% op ARC-AGI-2 (#2 van 3); 79,6% op SWE-bench Verified (#8 van 13).
Claude Sonnet 4.6 werd uitgebracht op 17 februari 2026 als het middensegmentmodel in de Claude 4-generatie, gepositioneerd tussen de Opus-serie en de Haiku-lijn qua zowel capaciteit als prijs. Het Sonnet-segment heeft historisch gezien de beste prijs-prestatieverhouding in Anthropic’s aanbod geboden — krachtig genoeg voor de overgrote meerderheid van codeer- en redeneertaken tegen ongeveer een vijfde van de Opus-prijs. Sonnet 4.6 scoorde 58,3% op ARC-AGI-2 (onafhankelijk geverifieerd door de ARC Prize Foundation), waarmee het bij uitgave de op een na hoogste score wereldwijd op die benchmark behaalde. Het ondersteunt hetzelfde contextvenster van 1M tokens als de Opus-modellen.
Opmerking: Best-in-class finance agent (63,3%) en MCP-Atlas (61,3%). Adaptief denken.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 79.6% | 8 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| Terminal-Bench | 59.1% | 8 of 8 | SR | Agentic Linux terminal task completion |
| MATH-500 | 89.0% | 2 of 4 | SR | Hendrycks math (500 problems) |
| ARC-AGI-2 | 58.3% | 2 of 3 | 3P | Novel visual reasoning, no memorisation |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Claude Sonnet 4.6 | GPT-4.1 | DeepSeek V4-Flash |
|---|---|---|---|
| SWE-V | 79.6% | 54.6% | 79.0% |
| Terminal | 59.1% | — | — |
| MATH | 89.0% | — | — |
| ARC-2 | 58.3% | — | — |
Anthropic is een AI-veiligheidsbedrijf dat in 2021 werd opgericht door voormalige OpenAI-onderzoekers Dario Amodei en Daniela Amodei, samen met een groep collega's die leiding hadden gegeven aan de veiligheids- en beleidsteams van OpenAI. De aangegeven missie van het bedrijf is de verantwoorde ontwikkeling van AI voor het welzijn van de mensheid op de lange termijn, en haar onderzoeksagenda wordt bepaald door die toewijding: Constitutionele AI (CAI), een techniek voor het trainen van modellen om behulpzaam, onschadelijk en eerlijk te zijn via zelfkritiek; mechanistische interpreteerbaarheid, die tot doel heeft te achterhalen wat individuele neuronen en circuits in grote netwerken daadwerkelijk berekenen; en schaalwetenschap, die probeert te voorspellen hoe modelgedrag verandert met rekenkracht en data. Anthropic publiceert dit onderzoek openlijk en is een van de meest geciteerde AI-veiligheidslaboratoria in de academische literatuur geworden. Claude is de openbare modellenfamilie van Anthropic — genoemd naar Claude Shannon, de grondlegger van de informatietheorie — en omvat vier generaties (1 tot en met 4.x/Fable 5). Anthropic heeft een commerciële API en het consumentengerichte Claude.ai-product, en onderhoudt diepe cloudpartnerschappen met AWS (Amazon Bedrock) en Google Cloud (Vertex AI).
Gebruiksscenario's
Claude Sonnet 4.6 scoort 79% op SWE-bench Verified — gerangschikt op #8 van 13 hier gevolgde modellen. Het lost echte GitHub-problemen op, schrijft productiekwaliteit-code in meerdere talen en verwerkt meerstaps agentische codeerworkflows — een sterke keuze voor AI-ondersteunde softwareontwikkelingsteams.
Claude Sonnet 4.6 behaalt 59% op Terminal-Bench (#8 van 8 modellen), waardoor het geschikt is voor shell-scripting, command-line-workflows en lichte systeembeheertaken binnen agentische pijplijnen.
Met een contextvenster van 1M tokens kan Claude Sonnet 4.6 volledige softwarerepositories, lange juridische contracten, boeklange onderzoeksrapporten of uitgebreide gespreksgeschiedenissen in één prompt verwerken — wat diepgaande document-Q&A, redeneren over meerdere bestanden in een codebase en uitgebreide samenvatting mogelijk maakt zonder chunking-heuristieken of RAG-pijplijnen.
Meer om te vergelijken
Vergelijk alle 24 modellen op 11 benchmarks — sorteerbaar, met bronvermelding en bijgewerkt in juni 2026.

Claude Opus 4.6 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHu...

Claude Opus 4.8 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-niveau met een contextvenster van 1M tokens. Ontdek benchmarkscores, sterke pu...

Claude Opus 4.7 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-niveau met een contextvenster van 1M tokens. Ontdek benchmarkscores, sterke pu...
Cookie Toestemming
We gebruiken cookies om uw browse-ervaring te verbeteren en ons verkeer te analyseren. See our privacy policy.