
Claude Opus 4.7 — Benchmarky, schopnosti a prípady použitia
Claude Opus 4.7 je proprietárny AI model od Anthropicu, klasifikovaný ako Frontier úroveň s kontextovým oknom 1M tokenov. Preskúmajte benchmarkové skóre, silné ...
Claude Opus 4.8 je špičkový frontier AI model, vyvinutý spoločnosťou Anthropic a vydaný v máji 2026. Ide o proprietárny model s uzavretými váhami, dostupný prostredníctvom Anthropic API. Kontextové okno s kapacitou 1M tokenov je dostatočne veľké na to, aby poňalo celé kódové základne, rozsiahle technické dokumenty alebo dlhé agentické relácie bez potreby skracovania.
Na FlowHunt AI Leaderboard je jedným z 24 sledovaných modelov, vyhodnotených na 5 benchmarkoch. Výrazné výsledky: 61,4 b. na AA Intelligence Index (#1 z 9); 69,2 % na SWE-bench Pro (#2 z 9); 74,6 % na Terminal-Bench (#2 z 8).
Claude Opus 4.8 bol vydaný 28. mája 2026 ako cielené bodové vydanie na základe Opus 4.7, pričom Anthropic ho opísal ako „skromné, ale hmatateľné vylepšenie za rovnakú cenu." Vydanie nasledovalo v rýchlom tempe: Opus 4.6, 4.7 a 4.8 boli vydané v rámci toho istého kalendárneho štvrťroka, čo odráža posun Anthropicu smerom k priebežnému inkrementálnemu doručovaniu. Napriek skromným zlepšeniam v benchmarkoch sa Opus 4.8 umiestnil na prvom mieste v Artificial Analysis Intelligence Index s 61,4 bodmi — čo je najvyššie nezávislé kompozitné skóre akéhokoľvek modelu v čase vydania — čím sa stal najvyváženejším frontier modelom podľa nezávislého merania tretej strany, aj keď ho o dva týždne neskôr v čisto programátorských úlohách predbehol Claude Fable 5.
Poznámka: Skromné, ale hmatateľné vylepšenie oproti 4.7 za rovnakú cenu. #1 AA Intelligence Index s 61,4.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.6% | 3 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 69.2% | 2 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 3 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 74.6% | 2 of 8 | SR | Agentic Linux terminal task completion |
| AA Intelligence Index | 61.4 pts | 1 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic je spoločnosť zaoberajúca sa bezpečnosťou umelej inteligencie, založená v roku 2021 bývalými výskumníkmi OpenAI Dario Amodeiom a Danielou Amodeiovou spolu so skupinou kolegov, ktorí viedli tímy pre bezpečnosť a politiku v OpenAI. Deklarovaným poslaním spoločnosti je zodpovedný vývoj AI v prospech ľudstva z dlhodobého hľadiska a jej výskumná agenda je definovaná týmto záväzkom: Konštitučná AI (CAI), technika na trénovanie modelov, aby boli užitočné, neškodné a čestné prostredníctvom sebareflexie; mechanistická interpretovateľnosť, ktorá sa zameriava na spätné inžinierstvo toho, čo jednotlivé neuróny a okruhy vo veľkých sieťach skutočne vypočítavajú; a veda o škálovaní, ktorá sa snaží predpovedať, ako sa mení správanie modelov s výpočtovým výkonom a dátami. Anthropic zverejňuje tento výskum otvorene a stal sa jedným z najcitovanejších laboratórií bezpečnosti AI v akademickej literatúre. Claude je verejná modelová rodina Anthropicu – pomenovaná po Claudovi Shannonovi, zakladateľovi teórie informácie – a zahŕňa štyri generácie (1 až 4.x/Fable 5). Anthropic prevádzkuje komerčné API a spotrebiteľský produkt Claude.ai a udržiava hlboké cloudové partnerstvá s AWS (Amazon Bedrock) a Google Cloud (Vertex AI).
Prípady použitia
Claude Opus 4.8 dosahuje 88 % na SWE-bench Verified — umiestnenie #3 z 13 modelov sledovaných tu. Rieši reálne GitHub problémy, píše produkčný kód vo viacerých jazykoch a zvláda viackrokové agentické programátorské workflows — je silnou voľbou pre tímy využívajúce AI pri vývoji softvéru.
S výsledkom 93 % na GPQA Diamond (#3 zo 14 modelov) presahuje Claude Opus 4.8 hranicu ~65 % ľudských PhD-expertov v otázkach z biológie, chémie a fyziky na postgraduálnej úrovni. Využite ho na syntézu vedeckej literatúry, vyhodnocovanie hypotéz, medicínske a právne Q&A a viacodborové výskumné úlohy, kde záleží na hlbokej doménovej znalosti.
So skóre 74 % na Terminal-Bench (#2 z 8 modelov) je Claude Opus 4.8 vhodný pre agentické DevOps a automatizáciu infraštruktúry. Terminal-Bench meria autonómne vykonávanie úloh v Linux shelli — správu balíkov, operácie so súborovým systémom, riadenie procesov a viackrokovú správu systému — bez ľudského vedenia počas úlohy.
S kontextovým oknom 1M tokenov dokáže Claude Opus 4.8 spracovať celé softvérové repozitáre, dlhé právne zmluvy, výskumné správy v rozsahu kníh alebo rozsiahle konverzačné histórie v jedinom prompte — čo umožňuje hĺbkové Q&A nad dokumentmi, uvažovanie naprieč súbormi v kódovej základni a komplexné sumarizácie bez potreby chunkovacích heuristík alebo RAG pipeline.
Viac na porovnanie
Porovnajte všetkých 24 modelov naprieč 11 benchmarkmi — zoraditeľné, so zdrojmi, aktualizované jún 2026.

Claude Opus 4.7 je proprietárny AI model od Anthropicu, klasifikovaný ako Frontier úroveň s kontextovým oknom 1M tokenov. Preskúmajte benchmarkové skóre, silné ...

Claude Opus 4.6 je proprietárny AI model od spoločnosti Anthropic, zaradený do kategórie Frontier s kontextovým oknom 1 milión tokenov. Je priamo dostupný v nás...

Claude Fable 5 je proprietárny AI model od spoločnosti Anthropic, klasifikovaný ako Super-Frontier úroveň s kontextovým oknom 1M tokenov. Preskúmajte skóre refe...
Súhlas s cookies
Používame cookies na vylepšenie vášho prehliadania a analýzu našej návštevnosti. See our privacy policy.