
Claude Opus 4.7 — Benchmarks, egenskaber og anvendelsesmuligheder
Claude Opus 4.7 er en proprietær AI-model fra Anthropic, klassificeret som Frontier-niveau med et kontekstvindue på 1M tokens. Udforsk benchmark-scorer, styrker...
Claude Opus 4.8 er en topklasse frontier AI-model, udviklet af Anthropic og udgivet i maj 2026. Det er en proprietær closed-weight-model, tilgængelig via Anthropic API. Kontekstvinduet på 1M tokens er stort nok til at rumme hele kodebaser, lange tekniske dokumenter eller udvidede agentiske sessioner uden afkortning.
På FlowHunt AI Leaderboard er den en af 24 sporede modeller, evalueret på tværs af 5 benchmarks. Fremtrædende scoringer: 61,4 pts på AA Intelligence Index (#1 af 9); 69,2 % på SWE-bench Pro (#2 af 9); 74,6 % på Terminal-Bench (#2 af 8).
Claude Opus 4.8 blev udgivet den 28. maj 2026 som en fokuseret punktudgivelse oven på Opus 4.7, hvor Anthropic beskrev den som en ‘beskeden, men håndgribelig opgradering til samme pris.’ Udgivelsen fulgte en hurtig kadence: Opus 4.6, 4.7 og 4.8 blev alle sendt inden for samme kalenderkvartal, hvilket afspejler Anthropics skift mod løbende inkrementel levering. På trods af beskedne benchmarkforbedringer indtog Opus 4.8 førstepladsen på Artificial Analysis Intelligence Index med 61,4 point — den højeste uafhængige sammensatte score af nogen model på udgivelsestidspunktet — hvilket gør den til den mest alsidige frontier-model ifølge uafhængig tredjepartsmåling, selvom den blev overgået af Claude Fable 5 på rene kodningsopgaver to uger senere.
Bemærk: Beskeden, men håndgribelig opgradering i forhold til 4.7 til samme pris. #1 AA Intelligence Index ved 61,4.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.6% | 3 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 69.2% | 2 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 3 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 74.6% | 2 of 8 | SR | Agentic Linux terminal task completion |
| AA Intelligence Index | 61.4 pts | 1 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic er et AI-sikkerhedsselskab grundlagt i 2021 af tidligere OpenAI-forskere Dario Amodei og Daniela Amodei sammen med en gruppe kolleger, der tidligere havde ledet OpenAIs sikkerheds- og politikafdelinger. Virksomhedens erklærede mission er den ansvarlige udvikling af AI til gavn for menneskeheden på lang sigt, og dens forskningsdagsorden er defineret af dette engagement: Constitutional AI (CAI), en teknik til at træne modeller til at være hjælpsomme, harmløse og ærlige gennem selvkritik; mekanistisk fortolkbarhed, som sigter mod at reverse-engineere, hvad individuelle neuroner og kredsløb i store netværk rent faktisk beregner; og skaleringsvidenskab, som forsøger at forudsige, hvordan modeladfærd ændrer sig med regnekraft og data. Anthropic offentliggør denne forskning åbent og er blevet et af de mest citerede AI-sikkerhedslaboratorier i den akademiske litteratur. Claude er Anthropics offentlige modelfamilie — opkaldt efter Claude Shannon, grundlæggeren af informationsteori — og spænder over fire generationer (1 til 4.x/Fable 5). Anthropic driver en kommerciel API og det forbrugerrettede Claude.ai-produkt og opretholder dybe cloud-partnerskaber med AWS (Amazon Bedrock) og Google Cloud (Vertex AI).
Anvendelsesmuligheder
Claude Opus 4.8 scorer 88 % på SWE-bench Verified — rangeret #3 af 13 modeller sporet her. Den løser reelle GitHub-problemer, skriver produktionsklar kode på tværs af flere sprog og håndterer flertrins agentiske kodningsworkflows — et stærkt valg for AI-assisterede softwareudviklingsteams.
Med 93 % på GPQA Diamond (#3 af 14 modeller) overgår Claude Opus 4.8 den ~65 % menneskelige PhD-ekspertbaseline på spørgsmål på kandidatniveau inden for biologi, kemi og fysik. Brug den til syntese af videnskabelig litteratur, hypoteseevaluering, medicinsk og juridisk spørgsmål-svar samt tværfaglige forskningsopgaver, hvor dyb fagviden er vigtig.
Med en score på 74 % på Terminal-Bench (#2 af 8 modeller) er Claude Opus 4.8 velegnet til agentisk DevOps- og infrastrukturautomatisering. Terminal-Bench måler autonom udførelse af Linux-skalopgaver — pakkehåndtering, filsystemoperationer, proceskontrol og flertrins systemadministration — uden menneskelig vejledning undervejs.
Med et kontekstvindue på 1M tokens kan Claude Opus 4.8 indlæse hele softwarelagre, lange juridiske kontrakter, bog-lange forskningsrapporter eller omfattende samtalehistorikker i en enkelt prompt — hvilket muliggør dybdegående spørgsmål-svar til dokumenter, ræsonnement på tværs af filer i kodebaser og omfattende sammenfatning uden opdelingsheuristikker eller RAG-pipelines.
Mere at sammenligne
Sammenlign alle 24 modeller på tværs af 11 benchmarks — sorterbar, med kildeangivelse og opdateret juni 2026.

Claude Opus 4.7 er en proprietær AI-model fra Anthropic, klassificeret som Frontier-niveau med et kontekstvindue på 1M tokens. Udforsk benchmark-scorer, styrker...

Claude Opus 4.6 er en proprietær AI-model fra Anthropic, klassificeret som Frontier-niveau med en kontekstvindue på 1M tokens. Den er direkte tilgængelig i Flow...

Claude Fable 5 er en proprietær AI-model fra Anthropic, klassificeret som Super-Frontier med et kontekstvindue på 1M tokens. Udforsk benchmark-scoringer, styrke...