
Claude Opus 4.7 — Benchmarks, mogelijkheden en gebruiksscenario's
Claude Opus 4.7 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-niveau met een contextvenster van 1M tokens. Ontdek benchmarkscores, sterke pu...
Claude Opus 4.8 is een topklasse frontier AI-model, ontwikkeld door Anthropic en uitgebracht in mei 2026. Het is een eigen closed-weight model met beperkte toegang tot de Anthropic API.
Het contextvenster van 1M tokens is groot genoeg om volledige codebases, uitgebreide technische documenten of langdurige agentische sessies zonder truncatie te bevatten.
Op het FlowHunt AI Leaderboard is het een van 24 gevolgde modellen, geëvalueerd op 5 benchmarks. Opvallende scores: 61,4 pt op de AA Intelligence Index (#1 van 9); 69,2% op SWE-bench Pro (#2 van 9); 74,6% op Terminal-Bench (#2 van 8).
Claude Opus 4.8 werd uitgebracht op 28 mei 2026 als een gerichte puntrelease bovenop Opus 4.7, waarbij Anthropic het omschreef als een “bescheiden maar tastbare upgrade tegen dezelfde prijs.” De release volgde op een snel tempo: Opus 4.6, 4.7 en 4.8 werden allemaal binnen hetzelfde kalenderkwartaal uitgebracht, wat de verschuiving van Anthropic naar continue incrementele levering weerspiegelt. Ondanks bescheiden benchmarkverbeteringen nam Opus 4.8 de eerste positie in op de Artificial Analysis Intelligence Index met 61,4 punten — de hoogste onafhankelijke samengestelde score van elk model op het moment van uitgave — waardoor het het meest veelzijdige frontiermodel was volgens onafhankelijke metingen van derden, zelfs toen het twee weken later werd voorbijgestreefd door Claude Fable 5 op pure coderingstaken.
Opmerking: Bescheiden maar tastbare upgrade ten opzichte van 4.7 tegen dezelfde prijs. #1 AA Intelligence Index met 61,4.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.6% | 3 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 69.2% | 2 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 3 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 74.6% | 2 of 8 | SR | Agentic Linux terminal task completion |
| AA Intelligence Index | 61.4 pts | 1 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic is een AI-veiligheidsbedrijf dat in 2021 werd opgericht door voormalige OpenAI-onderzoekers Dario Amodei en Daniela Amodei, samen met een groep collega's die leiding hadden gegeven aan de veiligheids- en beleidsteams van OpenAI. De aangegeven missie van het bedrijf is de verantwoorde ontwikkeling van AI voor het welzijn van de mensheid op de lange termijn, en haar onderzoeksagenda wordt bepaald door die toewijding: Constitutionele AI (CAI), een techniek voor het trainen van modellen om behulpzaam, onschadelijk en eerlijk te zijn via zelfkritiek; mechanistische interpreteerbaarheid, die tot doel heeft te achterhalen wat individuele neuronen en circuits in grote netwerken daadwerkelijk berekenen; en schaalwetenschap, die probeert te voorspellen hoe modelgedrag verandert met rekenkracht en data. Anthropic publiceert dit onderzoek openlijk en is een van de meest geciteerde AI-veiligheidslaboratoria in de academische literatuur geworden. Claude is de openbare modellenfamilie van Anthropic — genoemd naar Claude Shannon, de grondlegger van de informatietheorie — en omvat vier generaties (1 tot en met 4.x/Fable 5). Anthropic heeft een commerciële API en het consumentengerichte Claude.ai-product, en onderhoudt diepe cloudpartnerschappen met AWS (Amazon Bedrock) en Google Cloud (Vertex AI).
Gebruiksscenario's
Claude Opus 4.8 scoort 88% op SWE-bench Verified — gerangschikt #3 van 13 modellen die hier worden gevolgd. Het lost echte GitHub-problemen op, schrijft productiekwaliteitscode in meerdere talen en verwerkt meerstaps agentische coderingsworkflows — een sterke keuze voor AI-ondersteunde softwareontwikkelingsteams.
Met 93% op GPQA Diamond (#3 van 14 modellen) overtreft Claude Opus 4.8 de ~65% menselijke PhD-expertbasislijn voor vragen op graduatesniveau op het gebied van biologie, scheikunde en natuurkunde. Gebruik het voor wetenschappelijke literatuursynthese, hypotheseevaluatie, medische en juridische vraag-en-antwoord en multidisciplinaire onderzoekstaken waar diepgaande domeinkennis van belang is.
Met een score van 74% op Terminal-Bench (#2 van 8 modellen) is Claude Opus 4.8 zeer geschikt voor agentische DevOps- en infrastructuurautomatisering. Terminal-Bench meet de autonome uitvoering van Linux-shelltaken — pakketbeheer, bestandssysteembewerkingen, procescontrole en meerstaps systeembeheer — zonder menselijke begeleiding tijdens de taak.
Met een contextvenster van 1M tokens kan Claude Opus 4.8 volledige softwarerepository's, lange juridische contracten, onderzoeksrapporten van boeklengte of uitgebreide gespreksgeschiedenissen in één prompt opnemen — wat diepgaande document-Q&A, redeneren over codebase heen en uitgebreide samenvatting mogelijk maakt zonder chunking-heuristieken of RAG-pijplijnen.
Meer om te Vergelijken
Vergelijk alle 24 modellen op 11 benchmarks — sorteerbaar, met bronvermelding en bijgewerkt juni 2026.

Claude Opus 4.7 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-niveau met een contextvenster van 1M tokens. Ontdek benchmarkscores, sterke pu...

Claude Opus 4.6 is een eigen AI-model van Anthropic, geclassificeerd als Frontier-tier met een contextvenster van 1M tokens. Het is direct beschikbaar in FlowHu...

Claude Fable 5 is een eigen AI-model van Anthropic, geclassificeerd als Super-Frontier tier met een contextvenster van 1M tokens. Ontdek benchmarkscores, sterke...