Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 je špičkový frontier AI model, vyvinutý spoločnosťou Anthropic a vydaný v máji 2026. Ide o proprietárny model s uzavretými váhami, dostupný prostredníctvom Anthropic API. Kontextové okno s kapacitou 1M tokenov je dostatočne veľké na to, aby poňalo celé kódové základne, rozsiahle technické dokumenty alebo dlhé agentické relácie bez potreby skracovania.

Na FlowHunt AI Leaderboard je jedným z 24 sledovaných modelov, vyhodnotených na 5 benchmarkoch. Výrazné výsledky: 61,4 b. na AA Intelligence Index (#1 z 9); 69,2 % na SWE-bench Pro (#2 z 9); 74,6 % na Terminal-Bench (#2 z 8).

Claude Opus 4.8 bol vydaný 28. mája 2026 ako cielené bodové vydanie na základe Opus 4.7, pričom Anthropic ho opísal ako „skromné, ale hmatateľné vylepšenie za rovnakú cenu." Vydanie nasledovalo v rýchlom tempe: Opus 4.6, 4.7 a 4.8 boli vydané v rámci toho istého kalendárneho štvrťroka, čo odráža posun Anthropicu smerom k priebežnému inkrementálnemu doručovaniu. Napriek skromným zlepšeniam v benchmarkoch sa Opus 4.8 umiestnil na prvom mieste v Artificial Analysis Intelligence Index s 61,4 bodmi — čo je najvyššie nezávislé kompozitné skóre akéhokoľvek modelu v čase vydania — čím sa stal najvyváženejším frontier modelom podľa nezávislého merania tretej strany, aj keď ho o dva týždne neskôr v čisto programátorských úlohách predbehol Claude Fable 5.

Poznámka: Skromné, ale hmatateľné vylepšenie oproti 4.7 za rovnakú cenu. #1 AA Intelligence Index s 61,4.

Vydaný
Máj 2026
Kontext
1M tokenov
Váhy
Uzavreté
Úroveň
Frontier
Poskytovateľ
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic je spoločnosť zaoberajúca sa bezpečnosťou umelej inteligencie, založená v roku 2021 bývalými výskumníkmi OpenAI Dario Amodeiom a Danielou Amodeiovou spolu so skupinou kolegov, ktorí viedli tímy pre bezpečnosť a politiku v OpenAI. Deklarovaným poslaním spoločnosti je zodpovedný vývoj AI v prospech ľudstva z dlhodobého hľadiska a jej výskumná agenda je definovaná týmto záväzkom: Konštitučná AI (CAI), technika na trénovanie modelov, aby boli užitočné, neškodné a čestné prostredníctvom sebareflexie; mechanistická interpretovateľnosť, ktorá sa zameriava na spätné inžinierstvo toho, čo jednotlivé neuróny a okruhy vo veľkých sieťach skutočne vypočítavajú; a veda o škálovaní, ktorá sa snaží predpovedať, ako sa mení správanie modelov s výpočtovým výkonom a dátami. Anthropic zverejňuje tento výskum otvorene a stal sa jedným z najcitovanejších laboratórií bezpečnosti AI v akademickej literatúre. Claude je verejná modelová rodina Anthropicu – pomenovaná po Claudovi Shannonovi, zakladateľovi teórie informácie – a zahŕňa štyri generácie (1 až 4.x/Fable 5). Anthropic prevádzkuje komerčné API a spotrebiteľský produkt Claude.ai a udržiava hlboké cloudové partnerstvá s AWS (Amazon Bedrock) a Google Cloud (Vertex AI).

Prípady použitia

Na čo používať Claude Opus 4.8

Softvérové inžinierstvo
Vedecké a technické uvažovanie
Agentická automatizácia CLI
Analýza dlhých dokumentov a kódových základní

Strengths & Limitations

Strengths

  • Silné softvérové inžinierstvo — 88 % SWE-bench Verified
  • Vedecké uvažovanie na úrovni postgraduálu — 93 % GPQA Diamond
  • Agentická automatizácia Linux / CLI — 74 % Terminal-Bench
  • Kompozitná inteligencia — 61 b. AA Intelligence Index (nezávislý)
  • Veľmi dlhé dokumenty a rozsiahle kódové základne (1M kontext)

Limitations

  • Uzavreté váhy — nie je možné vlastné hosťovanie ani jemné ladenie na súkromných dátach

Prezrite si celý AI Model Leaderboard

Najčastejšie kladené otázky

Zistiť viac

Claude Opus 4.7 — Benchmarky, schopnosti a prípady použitia
Claude Opus 4.7 — Benchmarky, schopnosti a prípady použitia

Claude Opus 4.7 — Benchmarky, schopnosti a prípady použitia

Claude Opus 4.7 je proprietárny AI model od Anthropicu, klasifikovaný ako Frontier úroveň s kontextovým oknom 1M tokenov. Preskúmajte benchmarkové skóre, silné ...

5 min čítania
Claude Opus 4.6 — Benchmarky, schopnosti a prípady použitia
Claude Opus 4.6 — Benchmarky, schopnosti a prípady použitia

Claude Opus 4.6 — Benchmarky, schopnosti a prípady použitia

Claude Opus 4.6 je proprietárny AI model od spoločnosti Anthropic, zaradený do kategórie Frontier s kontextovým oknom 1 milión tokenov. Je priamo dostupný v nás...

5 min čítania