Anthropic logo

Anthropic

Claude Opus 4.7

Frontier

Claude Opus 4.7 er en topklasse frontier AI-model, udviklet af Anthropic og udgivet i april 2026. Det er en proprietær closed-weight-model, tilgængelig via Anthropic API. Kontekstvinduet på 1M tokens er stort nok til at rumme hele kodebaser, lange tekniske dokumenter eller udvidede agentiske sessioner uden afkortning.

På FlowHunt AI Leaderboard er den en af 24 sporede modeller, evalueret på tværs af 5 benchmarks. Fremtrædende scorer: 94,2% på GPQA Diamond (#1 ud af 14); 64,3% på SWE-bench Pro (#3 ud af 9); 57,3 point på AA Intelligence Index (#3 ud af 9).

Claude Opus 4.7 blev udgivet den 1. april 2026 som et mere markant generationsspring end sin efterfølger. Den introducerede meningsfulde forbedringer inden for langkontekst-koherens og flertrins agentiske opgaveløsninger med en score på 57,3 point på Artificial Analysis Intelligence Index — den højeste uafhængige score for nogen model på det tidspunkt. Opus 4.7 blev det primære enterprise-valg til agentiske arbejdsgange i løbet af april og maj 2026, og mange produktionssystemer blev bygget omkring dens API før Opus 4.8 overgik den. Dens benchmark-profil forbliver konkurrencedygtig med nogle nyere modeller, og den fortsætter med at blive bredt anvendt i produktion sammen med den nyere Opus-serie.

Bemærk: Direkte forgænger til 4.8 til samme prisniveau.

Udgivet
April 2026
Kontekst
1M tokens
Vægte
Lukkede
Niveau
Frontier
Udbyder
Anthropic

Claude Opus 4.7 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified87.6%4 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro64.3%3 of 9SRMulti-language, standardised scaffold
GPQA Diamond94.2%1 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench66.1%5 of 8SRAgentic Linux terminal task completion
AA Intelligence Index57.3 pts3 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
87.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
64.3%
Multi-language, standardised scaffold
GPQA ◇ SR
94.2%
Graduate-level Google-proof science Q&A
Terminal SR
66.1%
Agentic Linux terminal task completion
AA Idx AA
57.3 pts
Artificial Analysis composite score (independent)

Claude Opus 4.7 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.7GPT-5.5GPT-5.4
SWE-V87.6%88.7%
SWE-Pro64.3%58.6%59.1%
GPQA ◇94.2%93.6%
Terminal66.1%82.7%
AA Idx57.3 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic er et AI-sikkerhedsselskab grundlagt i 2021 af tidligere OpenAI-forskere Dario Amodei og Daniela Amodei sammen med en gruppe kolleger, der tidligere havde ledet OpenAIs sikkerheds- og politikafdelinger. Virksomhedens erklærede mission er den ansvarlige udvikling af AI til gavn for menneskeheden på lang sigt, og dens forskningsdagsorden er defineret af dette engagement: Constitutional AI (CAI), en teknik til at træne modeller til at være hjælpsomme, harmløse og ærlige gennem selvkritik; mekanistisk fortolkbarhed, som sigter mod at reverse-engineere, hvad individuelle neuroner og kredsløb i store netværk rent faktisk beregner; og skaleringsvidenskab, som forsøger at forudsige, hvordan modeladfærd ændrer sig med regnekraft og data. Anthropic offentliggør denne forskning åbent og er blevet et af de mest citerede AI-sikkerhedslaboratorier i den akademiske litteratur. Claude er Anthropics offentlige modelfamilie — opkaldt efter Claude Shannon, grundlæggeren af informationsteori — og spænder over fire generationer (1 til 4.x/Fable 5). Anthropic driver en kommerciel API og det forbrugerrettede Claude.ai-produkt og opretholder dybe cloud-partnerskaber med AWS (Amazon Bedrock) og Google Cloud (Vertex AI).

Anvendelsesmuligheder

Hvad skal Claude Opus 4.7 bruges til

Software Engineering
Videnskabelig & Teknisk Ræsonnering
Agentisk CLI-automatisering
Analyse af Lange Dokumenter & Kodebaser

Strengths & Limitations

Strengths

  • Stærk software engineering — 87% SWE-bench Verified
  • Videnskabelig ræsonnering på kandidatniveau — 94% GPQA Diamond
  • Sammensat intelligens — 57 point AA Intelligence Index (uafhængig)
  • Meget lange dokumenter og store kodebaser (1M kontekst)

Limitations

  • Lukkede vægte — kan ikke selv-hostes eller finjusteres på private data

Se Det Fulde AI Model Leaderboard

Ofte stillede spørgsmål

Lær mere