Anthropic logo

Anthropic

Claude Opus 4.7

Frontier

Claude Opus 4.7 is een topmodel in de frontier-categorie, ontwikkeld door Anthropic en uitgebracht in april 2026. Het is een eigen closed-weight model, beschikbaar via de Anthropic API. Het contextvenster van 1M tokens is groot genoeg om volledige codebases, uitgebreide technische documenten of langdurige agent-sessies zonder afkapping te verwerken.

Op het FlowHunt AI Leaderboard is het een van de 24 gevolgde modellen, geëvalueerd op 5 benchmarks. Opvallende scores: 94,2% op GPQA Diamond (#1 van 14); 64,3% op SWE-bench Pro (#3 van 9); 57,3 pts op AA Intelligence Index (#3 van 9).

Claude Opus 4.7 werd uitgebracht op 1 april 2026 als een substantiëlere generatiestap dan de opvolger. Het introduceerde betekenisvolle verbeteringen in coherentie over lange contexten en het voltooien van meerstaps agent-taken, met een score van 57,3 punten op de Artificial Analysis Intelligence Index — de hoogste onafhankelijke score van elk model op dat moment. Opus 4.7 werd gedurende april en mei 2026 de primaire enterprise-keuze voor agent-werkstromen, en veel productiesystemen werden gebouwd rond de API voordat Opus 4.8 het opvolgde. Het benchmarkprofiel blijft concurrerend met sommige nieuwere modellen en het wordt nog steeds veel gebruikt in productie naast de nieuwere Opus-lijn.

Opmerking: Directe voorganger van 4.8 tegen hetzelfde prijspunt.

Uitgebracht
April 2026
Context
1M tokens
Gewichten
Gesloten
Niveau
Frontier
Aanbieder
Anthropic

Claude Opus 4.7 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified87.6%4 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro64.3%3 of 9SRMulti-language, standardised scaffold
GPQA Diamond94.2%1 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench66.1%5 of 8SRAgentic Linux terminal task completion
AA Intelligence Index57.3 pts3 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
87.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
64.3%
Multi-language, standardised scaffold
GPQA ◇ SR
94.2%
Graduate-level Google-proof science Q&A
Terminal SR
66.1%
Agentic Linux terminal task completion
AA Idx AA
57.3 pts
Artificial Analysis composite score (independent)

Claude Opus 4.7 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.7GPT-5.5GPT-5.4
SWE-V87.6%88.7%
SWE-Pro64.3%58.6%59.1%
GPQA ◇94.2%93.6%
Terminal66.1%82.7%
AA Idx57.3 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic is een AI-veiligheidsbedrijf dat in 2021 werd opgericht door voormalige OpenAI-onderzoekers Dario Amodei en Daniela Amodei, samen met een groep collega's die leiding hadden gegeven aan de veiligheids- en beleidsteams van OpenAI. De aangegeven missie van het bedrijf is de verantwoorde ontwikkeling van AI voor het welzijn van de mensheid op de lange termijn, en haar onderzoeksagenda wordt bepaald door die toewijding: Constitutionele AI (CAI), een techniek voor het trainen van modellen om behulpzaam, onschadelijk en eerlijk te zijn via zelfkritiek; mechanistische interpreteerbaarheid, die tot doel heeft te achterhalen wat individuele neuronen en circuits in grote netwerken daadwerkelijk berekenen; en schaalwetenschap, die probeert te voorspellen hoe modelgedrag verandert met rekenkracht en data. Anthropic publiceert dit onderzoek openlijk en is een van de meest geciteerde AI-veiligheidslaboratoria in de academische literatuur geworden. Claude is de openbare modellenfamilie van Anthropic — genoemd naar Claude Shannon, de grondlegger van de informatietheorie — en omvat vier generaties (1 tot en met 4.x/Fable 5). Anthropic heeft een commerciële API en het consumentengerichte Claude.ai-product, en onderhoudt diepe cloudpartnerschappen met AWS (Amazon Bedrock) en Google Cloud (Vertex AI).

Gebruiksscenario's

Waarvoor Claude Opus 4.7 te Gebruiken

Softwareontwikkeling
Wetenschappelijk & Technisch Redeneren
Agentische CLI-automatisering
Lange Documenten & Codebase-analyse

Strengths & Limitations

Strengths

  • Sterke softwareontwikkeling — 87% SWE-bench Verified
  • Wetenschappelijk redeneren op graduate-niveau — 94% GPQA Diamond
  • Samengestelde intelligentie — 57 pts AA Intelligence Index (onafhankelijk)
  • Zeer lange documenten en grote codebases (1M context)

Limitations

  • Closed-weight — niet zelf te hosten of te finetunen op privégegevens

Bekijk het Volledige AI-model Leaderboard

Veelgestelde vragen

Meer informatie