
Claude Opus 4.7 — Referansetester, Egenskaper og Bruksområder
Claude Opus 4.7 er en proprietær AI-modell fra Anthropic, klassifisert som Frontier-nivå med et kontekstvindu på 1M tokens. Utforsk referansetestresultater, sty...
Claude Opus 4.8 er en toppmoderne AI-modell på frontlinjen, utviklet av Anthropic og utgitt i mai 2026. Det er en proprietær modell med lukkede vekter, tilgjengelig via Anthropic API. Kontekstvinduet på 1M tokens er stort nok til å romme hele kodebaser, lange tekniske dokumenter eller utvidede agentøkter uten avkorting.
På FlowHunt AI-ledertavlen er den en av 24 spores modeller, vurdert på tvers av 5 referansetester. Fremtredende skårer: 61,4 poeng på AA Intelligence Index (#1 av 9); 69,2 % på SWE-bench Pro (#2 av 9); 74,6 % på Terminal-Bench (#2 av 8).
Claude Opus 4.8 ble utgitt 28. mai 2026 som en fokusert punktutgivelse på toppen av Opus 4.7, der Anthropic beskrev den som en «beskjeden, men merkbar oppgradering til samme pris». Utgivelsen fulgte en rask kadence: Opus 4.6, 4.7 og 4.8 ble alle lansert innen samme kalenderkvartal, noe som reflekterer Anthropics skifte mot kontinuerlig, inkrementell levering. Til tross for beskjedne forbedringer på referansetester, tok Opus 4.8 førsteplassen på Artificial Analysis Intelligence Index med 61,4 poeng — den høyeste uavhengige sammensatte skåren av noen modell på utgivelsestidspunktet — noe som gjør den til den mest allsidige frontlinje-modellen ifølge uavhengig tredjepartsmåling, selv om den ble forbigått av Claude Fable 5 på rene kodingsoppgaver to uker senere.
Merknad: Beskjeden, men merkbar oppgradering fra 4.7 til samme pris. #1 AA Intelligence Index med 61,4.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.6% | 3 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 69.2% | 2 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 3 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 74.6% | 2 of 8 | SR | Agentic Linux terminal task completion |
| AA Intelligence Index | 61.4 pts | 1 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic er et KI-sikkerhetsselskap grunnlagt i 2021 av de tidligere OpenAI-forskerne Dario Amodei og Daniela Amodei, sammen med en gruppe kolleger som hadde ledet OpenAIs sikkerhets- og policyteam. Selskapets uttalte oppdrag er ansvarlig utvikling av KI til langsiktig nytte for menneskeheten, og forskningsagendaen defineres av dette engasjementet: Constitutional AI (CAI), en teknikk for å trene modeller til å være nyttige, ufarlige og ærlige gjennom selvkritikk; mekanistisk fortolkbarhet, som tar sikte på å reverskonstruere hva individuelle nevroner og kretser i store nettverk faktisk beregner; og skaleringsvitenskap, som forsøker å forutsi hvordan modellatferd endrer seg med regnekraft og data. Anthropic publiserer denne forskningen åpent og har blitt et av de mest siterte KI-sikkerhetslabene i akademisk litteratur. Claude er Anthropics offentlige modellfamilie – oppkalt etter Claude Shannon, grunnleggeren av informasjonsteori – og spenner over fire generasjoner (1 til 4.x/Fable 5). Anthropic driver et kommersielt API og det forbrukerrettede Claude.ai-produktet, og opprettholder dype skypartnerskap med AWS (Amazon Bedrock) og Google Cloud (Vertex AI).
Bruksområder
Claude Opus 4.8 skårer 88 % på SWE-bench Verified — rangert #3 av 13 modeller spores her. Den løser reelle GitHub-problemer, skriver produksjonsklar kode på tvers av flere programmeringsspråk, og håndterer flertrinns agentiske kodearbeidsflyter — et sterkt valg for AI-assisterte programvareutviklingsteam.
Med 93 % på GPQA Diamond (#3 av 14 modeller) overgår Claude Opus 4.8 den omtrentlige ~65 % menneskelige PhD-ekspertbaseline på spørsmål innen biologi, kjemi og fysikk på masternivå. Bruk den til syntese av vitenskapelig litteratur, hypoteseevaluering, medisinske og juridiske spørsmål og svar, og flerfaglige forskningsoppgaver der dyp domenekunnskap er viktig.
Med en skår på 74 % på Terminal-Bench (#2 av 8 modeller) er Claude Opus 4.8 godt egnet for agentisk DevOps- og infrastrukturautomatisering. Terminal-Bench måler autonom fullføring av Linux-skalloppgaver — pakkehåndtering, filsystemoperasjoner, prosesskontroll og flertrinns systemadministrasjon — uten menneskelig veiledning underveis.
Med et kontekstvindu på 1M tokens kan Claude Opus 4.8 innta hele programvarerepositorier, lange juridiske kontrakter, boklange forskningsrapporter eller omfattende samtalelogger i én enkelt forespørsel — noe som muliggjør dyp dokumentbasert spørsmål og svar, kodebaseresonnering på tvers av filer, og omfattende oppsummering uten oppdelingsheuristikker eller RAG-pipelines.
Mer å sammenligne
Sammenlign alle 24 modellene på tvers av 11 referansetester — sorterbar, kildebelagt og oppdatert juni 2026.

Claude Opus 4.7 er en proprietær AI-modell fra Anthropic, klassifisert som Frontier-nivå med et kontekstvindu på 1M tokens. Utforsk referansetestresultater, sty...

Claude Opus 4.6 er en proprietær AI-modell fra Anthropic, klassifisert som Frontier-nivå med et kontekstvindu på 1 M tokens. Den er tilgjengelig direkte i FlowH...

Claude Fable 5 er en proprietær AI-modell fra Anthropic, klassifisert som Super-Frontier-nivå med et kontekstvindu på 1M tokens. Utforsk referansetall, styrker ...