Logotipo da Anthropic

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 é um modelo de IA de fronteira de alto nível, desenvolvido pela Anthropic e lançado em maio de 2026. É um modelo proprietário de pesos fechados, disponível através da API da Anthropic. A janela de contexto de 1 milhão de tokens é grande o suficiente para conter bases de código inteiras, documentos técnicos extensos ou sessões agênticas prolongadas sem truncamento.

No FlowHunt AI Leaderboard, é um dos 24 modelos monitorados, avaliados em 5 benchmarks. Pontuações de destaque: 61,4 pts no AA Intelligence Index (#1 de 9); 69,2% no SWE-bench Pro (#2 de 9); 74,6% no Terminal-Bench (#2 de 8).

Claude Opus 4.8 foi lançado em 28 de maio de 2026 como uma atualização pontual focada sobre o Opus 4.7, com a Anthropic descrevendo-o como uma ‘melhoria modesta, mas tangível, pelo mesmo preço.’ O lançamento seguiu um ritmo acelerado: Opus 4.6, 4.7 e 4.8 foram todos lançados no mesmo trimestre calendário, refletindo a mudança da Anthropic em direção à entrega incremental contínua. Apesar de melhorias modestas nos benchmarks, o Opus 4.8 assumiu a primeira posição no Artificial Analysis Intelligence Index com 61,4 pontos — a maior pontuação composta independente de qualquer modelo no momento do lançamento — tornando-se o modelo de fronteira mais completo por medição independente de terceiros, mesmo tendo sido superado pelo Claude Fable 5 em tarefas de codificação pura duas semanas depois.

Nota: Melhoria modesta, mas tangível, sobre o 4.7 pelo mesmo preço. #1 no AA Intelligence Index com 61,4.

Lançamento
Maio de 2026
Contexto
1M de tokens
Pesos
Fechados
Nível
Frontier
Provedor
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

A Anthropic é uma empresa de segurança de IA fundada em 2021 pelos antigos pesquisadores da OpenAI Dario Amodei e Daniela Amodei, juntamente com um grupo de colegas que lideravam as equipas de segurança e políticas da OpenAI. A missão declarada da empresa é o desenvolvimento responsável de IA para o benefício a longo prazo da humanidade, e a sua agenda de investigação é definida por esse compromisso: IA Constitucional (CAI), uma técnica para treinar modelos a serem úteis, inofensivos e honestos através da autocrítica; interpretabilidade mecanicista, que visa reverter a engenharia do que neurónios e circuitos individuais dentro de grandes redes realmente calculam; e ciência de escalabilidade, que tenta prever como o comportamento do modelo muda com computação e dados. A Anthropic publica esta investigação abertamente e tornou-se um dos laboratórios de segurança de IA mais citados na literatura académica. Claude é a família de modelos públicos da Anthropic — nomeada em homenagem a Claude Shannon, o fundador da teoria da informação — e abrange quatro gerações (1 a 4.x/Fable 5). A Anthropic opera uma API comercial e o produto Claude.ai voltado para o consumidor, e mantém parcerias profundas de cloud com a AWS (Amazon Bedrock) e o Google Cloud (Vertex AI).

Casos de Uso

Para Que Usar o Claude Opus 4.8

Engenharia de Software
Raciocínio Científico e Técnico
Automação Agêntica de CLI
Análise de Documentos Longos e Bases de Código

Strengths & Limitations

Strengths

  • Forte engenharia de software — 88% SWE-bench Verified
  • Raciocínio científico de nível de pós-graduação — 93% GPQA Diamond
  • Automação agêntica de Linux / CLI — 74% Terminal-Bench
  • Inteligência composta — 61 pts AA Intelligence Index (independente)
  • Documentos muito longos e grandes bases de código (contexto de 1M)

Limitations

  • Pesos fechados — não pode ser auto-hospedado ou ajustado em dados privados

Explore o Painel Completo de Modelos de IA

Perguntas frequentes

Saiba mais

Claude Opus 4.7 — Benchmarks, Capacidades e Casos de Uso
Claude Opus 4.7 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.7 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.7 é um modelo de IA proprietário da Anthropic, classificado como nível Frontier com janela de contexto de 1M de tokens. Explore pontuações de benc...

5 min de leitura
Claude Opus 4.6 — Benchmarks, Capacidades e Casos de Uso
Claude Opus 4.6 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.6 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.6 é um modelo de IA proprietário da Anthropic, classificado como nível Frontier com janela de contexto de 1M de tokens. Está disponível diretament...

5 min de leitura
Claude Fable 5 — Benchmarks, Capacidades e Casos de Uso
Claude Fable 5 — Benchmarks, Capacidades e Casos de Uso

Claude Fable 5 — Benchmarks, Capacidades e Casos de Uso

Claude Fable 5 é um modelo de IA proprietário da Anthropic, classificado como nível Super-Frontier, com janela de contexto de 1M de tokens. Explore pontuações e...

4 min de leitura