Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 er en toppmoderne AI-modell på frontlinjen, utviklet av Anthropic og utgitt i mai 2026. Det er en proprietær modell med lukkede vekter, tilgjengelig via Anthropic API. Kontekstvinduet på 1M tokens er stort nok til å romme hele kodebaser, lange tekniske dokumenter eller utvidede agentøkter uten avkorting.

På FlowHunt AI-ledertavlen er den en av 24 spores modeller, vurdert på tvers av 5 referansetester. Fremtredende skårer: 61,4 poeng på AA Intelligence Index (#1 av 9); 69,2 % på SWE-bench Pro (#2 av 9); 74,6 % på Terminal-Bench (#2 av 8).

Claude Opus 4.8 ble utgitt 28. mai 2026 som en fokusert punktutgivelse på toppen av Opus 4.7, der Anthropic beskrev den som en «beskjeden, men merkbar oppgradering til samme pris». Utgivelsen fulgte en rask kadence: Opus 4.6, 4.7 og 4.8 ble alle lansert innen samme kalenderkvartal, noe som reflekterer Anthropics skifte mot kontinuerlig, inkrementell levering. Til tross for beskjedne forbedringer på referansetester, tok Opus 4.8 førsteplassen på Artificial Analysis Intelligence Index med 61,4 poeng — den høyeste uavhengige sammensatte skåren av noen modell på utgivelsestidspunktet — noe som gjør den til den mest allsidige frontlinje-modellen ifølge uavhengig tredjepartsmåling, selv om den ble forbigått av Claude Fable 5 på rene kodingsoppgaver to uker senere.

Merknad: Beskjeden, men merkbar oppgradering fra 4.7 til samme pris. #1 AA Intelligence Index med 61,4.

Utgitt
Mai 2026
Kontekst
1M tokens
Vekter
Lukkede
Nivå
Frontier
Leverandør
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic er et KI-sikkerhetsselskap grunnlagt i 2021 av de tidligere OpenAI-forskerne Dario Amodei og Daniela Amodei, sammen med en gruppe kolleger som hadde ledet OpenAIs sikkerhets- og policyteam. Selskapets uttalte oppdrag er ansvarlig utvikling av KI til langsiktig nytte for menneskeheten, og forskningsagendaen defineres av dette engasjementet: Constitutional AI (CAI), en teknikk for å trene modeller til å være nyttige, ufarlige og ærlige gjennom selvkritikk; mekanistisk fortolkbarhet, som tar sikte på å reverskonstruere hva individuelle nevroner og kretser i store nettverk faktisk beregner; og skaleringsvitenskap, som forsøker å forutsi hvordan modellatferd endrer seg med regnekraft og data. Anthropic publiserer denne forskningen åpent og har blitt et av de mest siterte KI-sikkerhetslabene i akademisk litteratur. Claude er Anthropics offentlige modellfamilie – oppkalt etter Claude Shannon, grunnleggeren av informasjonsteori – og spenner over fire generasjoner (1 til 4.x/Fable 5). Anthropic driver et kommersielt API og det forbrukerrettede Claude.ai-produktet, og opprettholder dype skypartnerskap med AWS (Amazon Bedrock) og Google Cloud (Vertex AI).

Bruksområder

Hva du bør bruke Claude Opus 4.8 til

Programvareutvikling
Vitenskapelig & Teknisk Resonnering
Agentisk CLI-automatisering
Langdokument- & Kodebaseanalyse

Strengths & Limitations

Strengths

  • Sterk programvareutvikling — 88 % SWE-bench Verified
  • Vitenskapelig resonnering på masternivå — 93 % GPQA Diamond
  • Agentisk Linux/CLI-automatisering — 74 % Terminal-Bench
  • Sammensatt intelligens — 61 poeng AA Intelligence Index (uavhengig)
  • Svært lange dokumenter og store kodebaser (1M kontekst)

Limitations

  • Lukkede vekter — kan ikke selvverteres eller finjusteres på private data

Se den fullstendige AI-modell-ledertavlen

Vanlige spørsmål

Lær mer

Claude Opus 4.6 — Referansetall, egenskaper og bruksområder
Claude Opus 4.6 — Referansetall, egenskaper og bruksområder

Claude Opus 4.6 — Referansetall, egenskaper og bruksområder

Claude Opus 4.6 er en proprietær AI-modell fra Anthropic, klassifisert som Frontier-nivå med et kontekstvindu på 1 M tokens. Den er tilgjengelig direkte i FlowH...

5 min lesing
Claude Fable 5 — Referansetall, Egenskaper og Bruksområder
Claude Fable 5 — Referansetall, Egenskaper og Bruksområder

Claude Fable 5 — Referansetall, Egenskaper og Bruksområder

Claude Fable 5 er en proprietær AI-modell fra Anthropic, klassifisert som Super-Frontier-nivå med et kontekstvindu på 1M tokens. Utforsk referansetall, styrker ...

4 min lesing