Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 es un modelo de IA fronterizo de primer nivel, desarrollado por Anthropic y lanzado en mayo de 2026. Es un modelo propietario de pesos cerrados, disponible a través de la API de Anthropic. La ventana de contexto de 1M de tokens es lo suficientemente grande como para contener bases de código completas, documentos técnicos extensos o sesiones agénticas prolongadas sin truncamiento.

En el FlowHunt AI Leaderboard es uno de los 24 modelos rastreados, evaluados en 5 benchmarks. Puntuaciones destacadas: 61.4 pts en AA Intelligence Index (#1 de 9); 69.2% en SWE-bench Pro (#2 de 9); 74.6% en Terminal-Bench (#2 de 8).

Claude Opus 4.8 fue lanzado el 28 de mayo de 2026 como una versión puntual centrada sobre Opus 4.7, describiendo Anthropic que es una «mejora modesta pero tangible al mismo precio». El lanzamiento siguió un ritmo rápido: Opus 4.6, 4.7 y 4.8 se lanzaron todos dentro del mismo trimestre calendario, reflejando el cambio de Anthropic hacia una entrega incremental continua. A pesar de las modestas mejoras en los benchmarks, Opus 4.8 ocupó la primera posición en el Artificial Analysis Intelligence Index con 61.4 puntos — la puntuación compuesta independiente más alta de cualquier modelo en el momento de su lanzamiento — convirtiéndolo en el modelo fronterizo más completo según mediciones independientes de terceros, incluso siendo superado por Claude Fable 5 en tareas de codificación puras dos semanas después.

Nota: Mejora modesta pero tangible sobre 4.7 al mismo precio. #1 AA Intelligence Index con 61.4.

Lanzamiento
Mayo 2026
Contexto
1M tokens
Pesos
Cerrados
Nivel
Frontier
Proveedor
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic es una empresa de seguridad de IA fundada en 2021 por los expositores de OpenAI Dario Amodei y Daniela Amodei, junto con un grupo de colegas que habían liderado los equipos de seguridad y políticas de OpenAI. La misión declarada de la empresa es el desarrollo responsable de la IA para el beneficio a largo plazo de la humanidad, y su agenda de investigación está definida por ese compromiso: IA Constitucional (CAI), una técnica para entrenar modelos para que sean útiles, inofensivos y honestos mediante la autocrítica; interpretabilidad mecanicista, que busca realizar ingeniería inversa de lo que las neuronas y circuitos individuales dentro de las grandes redes realmente computan; y ciencia de escalado, que intenta predecir cómo cambia el comportamiento del modelo con la computación y los datos. Anthropic publica esta investigación de forma abierta y se ha convertido en uno de los laboratorios de seguridad de IA más citados en la literatura académica. Claude es la familia de modelos públicos de Anthropic — nombrada en honor a Claude Shannon, el fundador de la teoría de la información — y abarca cuatro generaciones (1 a 4.x/Fable 5). Anthropic opera una API comercial y el producto consumer-facing Claude.ai, y mantiene profundas alianzas en la nube con AWS (Amazon Bedrock) y Google Cloud (Vertex AI).

Casos de Uso

Para Qué Usar Claude Opus 4.8

Ingeniería de Software
Razonamiento Científico y Técnico
Automatización Agéntica de CLI
Análisis de Documentos Extensos y Bases de Código

Strengths & Limitations

Strengths

  • Fuerte ingeniería de software — 88% SWE-bench Verified
  • Razonamiento científico de nivel de posgrado — 93% GPQA Diamond
  • Automatización agéntica de Linux / CLI — 74% Terminal-Bench
  • Inteligencia compuesta — 61 pts AA Intelligence Index (independiente)
  • Documentos muy extensos y grandes bases de código (1M de contexto)

Limitations

  • Pesos cerrados — no puede alojarse ni ajustarse con datos privados

Explora el AI Model Leaderboard Completo

Preguntas frecuentes

Saber más