Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 este un model AI de tip frontier de top, dezvoltat de Anthropic și lansat în mai 2026. Este un model proprietar cu greutăți închise, disponibil prin API-ul Anthropic. Fereastra de context de 1 milion de tokeni este suficient de mare pentru a cuprinde baze de cod întregi, documente tehnice voluminoase sau sesiuni agentice extinse, fără trunchiere.

În clasamentul FlowHunt AI Leaderboard, este unul dintre cele 24 de modele urmărite, evaluat pe 5 benchmark-uri. Scoruri remarcabile: 61,4 pts pe AA Intelligence Index (#1 din 9); 69,2% pe SWE-bench Pro (#2 din 9); 74,6% pe Terminal-Bench (#2 din 8).

Claude Opus 4.8 a fost lansat pe 28 mai 2026 ca o versiune punctuală concentrată, construită pe Opus 4.7, Anthropic descriindu-l ca fiind „o îmbunătățire modestă, dar tangibilă, la același preț." Lansarea a urmat un ritm rapid: Opus 4.6, 4.7 și 4.8 au fost livrate toate în același trimestru calendaristic, reflectând orientarea Anthropic către livrarea continuă incrementală. În ciuda îmbunătățirilor modeste ale scorurilor de performanță, Opus 4.8 a ocupat prima poziție în Artificial Analysis Intelligence Index cu 61,4 puncte — cel mai mare scor compozit independent al oricărui model la momentul lansării — devenind astfel cel mai echilibrat model frontier, conform măsurătorilor independente ale terțelor părți, chiar dacă a fost depășit de Claude Fable 5 în sarcinile pure de programare două săptămâni mai târziu.

Notă: Îmbunătățire modestă, dar tangibilă față de 4.7, la același preț. Locul #1 în AA Intelligence Index cu 61,4.

Lansat
Mai 2026
Context
1M tokeni
Greutăți
Închise
Categorie
Frontier
Furnizor
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic este o companie de siguranță AI fondată în 2021 de foștii cercetători OpenAI Dario Amodei și Daniela Amodei, împreună cu un grup de colegi care conduseseră echipele de siguranță și politici ale OpenAI. Misiunea declarată a companiei este dezvoltarea responsabilă a inteligenței artificiale pentru beneficiul pe termen lung al umanității, iar agenda sa de cercetare este definită de acest angajament: AI Constituțional (CAI), o tehnică de instruire a modelelor pentru a fi utile, inofensive și sincere prin autoevaluare critică; interpretabilitatea mecanicistă, care își propune să reconstituie inginerește ceea ce neuronii și circuitele individuale din rețelele mari calculează de fapt; și știința scalării, care încearcă să prezică modul în care comportamentul modelului se schimbă odată cu puterea de calcul și datele. Anthropic publică această cercetare în mod deschis și a devenit unul dintre cele mai citate laboratoare de siguranță AI din literatura academică. Claude este familia de modele publice Anthropic — numită după Claude Shannon, fondatorul teoriei informației — și acoperă patru generații (1 până la 4.x/Fable 5). Anthropic operează un API comercial și produsul consumer-facing Claude.ai, și menține parteneriate cloud profunde cu AWS (Amazon Bedrock) și Google Cloud (Vertex AI).

Cazuri de Utilizare

Pentru Ce Să Folosești Claude Opus 4.8

Inginerie Software
Raționament Științific și Tehnic
Automatizare CLI Agentică
Analiză de Documente Lungi și Baze de Cod

Strengths & Limitations

Strengths

  • Inginerie software puternică — 88% SWE-bench Verified
  • Raționament științific de nivel universitar — 93% GPQA Diamond
  • Automatizare agentică Linux / CLI — 74% Terminal-Bench
  • Inteligență compozită — 61 pts AA Intelligence Index (independent)
  • Documente foarte lungi și baze de cod mari (1M context)

Limitations

  • Greutăți închise — nu poate fi găzduit sau fine-tuat pe date private

Vezi Clasamentul Complet al Modelelor AI

Întrebări frecvente

Află mai multe