Logotipo de Anthropic

Anthropic

Claude Sonnet 4.6

AvanzadoAvailable in FlowHunt

Claude Sonnet 4.6 es un modelo de IA avanzado adecuado para cargas de trabajo de producción exigentes, desarrollado por Anthropic y lanzado en febrero de 2026. Es un modelo propietario de pesos cerrados, disponible a través de la API de Anthropic. La ventana de contexto de 1M de tokens es lo suficientemente grande como para contener repositorios de código completos, documentos técnicos extensos o sesiones de agentes prolongadas sin truncamiento.

En el AI Leaderboard de FlowHunt es uno de los 24 modelos registrados, evaluado en 4 benchmarks. Puntuaciones destacadas: 89.0% en MATH-500 (#2 de 4); 58.3% en ARC-AGI-2 (#2 de 3); 79.6% en SWE-bench Verified (#8 de 13).

Claude Sonnet 4.6 fue lanzado el 17 de febrero de 2026 como el modelo de nivel medio de la generación Claude 4, posicionado entre la serie Opus y la línea Haiku tanto en capacidad como en precio. El nivel Sonnet ha ofrecido históricamente la mejor relación calidad-precio en la línea de Anthropic — lo suficientemente capaz para la gran mayoría de tareas de codificación y razonamiento por aproximadamente una quinta parte del precio de Opus. Sonnet 4.6 obtuvo un 58.3% en ARC-AGI-2 (verificado de forma independiente por la ARC Prize Foundation), lo que le otorgó la segunda puntuación más alta a nivel mundial en ese benchmark en el momento de su lanzamiento. Es compatible con la misma ventana de contexto de 1M de tokens que los modelos Opus.

Nota: Mejor agente financiero (63.3%) y MCP-Atlas (61.3%). Pensamiento adaptativo.

Lanzamiento
Febrero 2026
Contexto
1M tokens
Pesos
Cerrados
Nivel
Avanzado
Proveedor
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic es una empresa de seguridad de IA fundada en 2021 por los expositores de OpenAI Dario Amodei y Daniela Amodei, junto con un grupo de colegas que habían liderado los equipos de seguridad y políticas de OpenAI. La misión declarada de la empresa es el desarrollo responsable de la IA para el beneficio a largo plazo de la humanidad, y su agenda de investigación está definida por ese compromiso: IA Constitucional (CAI), una técnica para entrenar modelos para que sean útiles, inofensivos y honestos mediante la autocrítica; interpretabilidad mecanicista, que busca realizar ingeniería inversa de lo que las neuronas y circuitos individuales dentro de las grandes redes realmente computan; y ciencia de escalado, que intenta predecir cómo cambia el comportamiento del modelo con la computación y los datos. Anthropic publica esta investigación de forma abierta y se ha convertido en uno de los laboratorios de seguridad de IA más citados en la literatura académica. Claude es la familia de modelos públicos de Anthropic — nombrada en honor a Claude Shannon, el fundador de la teoría de la información — y abarca cuatro generaciones (1 a 4.x/Fable 5). Anthropic opera una API comercial y el producto consumer-facing Claude.ai, y mantiene profundas alianzas en la nube con AWS (Amazon Bedrock) y Google Cloud (Vertex AI).

Casos de Uso

Para Qué Usar Claude Sonnet 4.6

Ingeniería de Software
Automatización CLI Agéntica
Análisis de Documentos Extensos y Código Fuente

Strengths & Limitations

Strengths

  • Sólida ingeniería de software — 79% SWE-bench Verified
  • Razonamiento visual novedoso — 58% ARC-AGI-2 (verificado de forma independiente)
  • Matemáticas avanzadas — 89% MATH-500
  • Documentos muy extensos y bases de código grandes (contexto de 1M)

Limitations

  • Pesos cerrados — no puede alojarse por sí mismo ni ajustarse con datos privados

Explora el AI Leaderboard Completo

Preguntas frecuentes

Saber más

Claude Opus 4.8 — Benchmarks, Capacidades y Casos de Uso
Claude Opus 4.8 — Benchmarks, Capacidades y Casos de Uso

Claude Opus 4.8 — Benchmarks, Capacidades y Casos de Uso

Claude Opus 4.8 es un modelo de IA propietario de Anthropic, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Explora puntuaciones d...

6 min de lectura