
Claude Opus 4.6 — Puntos de referencia, capacidades y casos de uso
Claude Opus 4.6 es un modelo de IA propietario de Anthropic, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Está disponible direct...
Claude Sonnet 4.6 es un modelo de IA avanzado adecuado para cargas de trabajo de producción exigentes, desarrollado por Anthropic y lanzado en febrero de 2026. Es un modelo propietario de pesos cerrados, disponible a través de la API de Anthropic. La ventana de contexto de 1M de tokens es lo suficientemente grande como para contener repositorios de código completos, documentos técnicos extensos o sesiones de agentes prolongadas sin truncamiento.
En el AI Leaderboard de FlowHunt es uno de los 24 modelos registrados, evaluado en 4 benchmarks. Puntuaciones destacadas: 89.0% en MATH-500 (#2 de 4); 58.3% en ARC-AGI-2 (#2 de 3); 79.6% en SWE-bench Verified (#8 de 13).
Claude Sonnet 4.6 fue lanzado el 17 de febrero de 2026 como el modelo de nivel medio de la generación Claude 4, posicionado entre la serie Opus y la línea Haiku tanto en capacidad como en precio. El nivel Sonnet ha ofrecido históricamente la mejor relación calidad-precio en la línea de Anthropic — lo suficientemente capaz para la gran mayoría de tareas de codificación y razonamiento por aproximadamente una quinta parte del precio de Opus. Sonnet 4.6 obtuvo un 58.3% en ARC-AGI-2 (verificado de forma independiente por la ARC Prize Foundation), lo que le otorgó la segunda puntuación más alta a nivel mundial en ese benchmark en el momento de su lanzamiento. Es compatible con la misma ventana de contexto de 1M de tokens que los modelos Opus.
Nota: Mejor agente financiero (63.3%) y MCP-Atlas (61.3%). Pensamiento adaptativo.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 79.6% | 8 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| Terminal-Bench | 59.1% | 8 of 8 | SR | Agentic Linux terminal task completion |
| MATH-500 | 89.0% | 2 of 4 | SR | Hendrycks math (500 problems) |
| ARC-AGI-2 | 58.3% | 2 of 3 | 3P | Novel visual reasoning, no memorisation |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Claude Sonnet 4.6 | GPT-4.1 | DeepSeek V4-Flash |
|---|---|---|---|
| SWE-V | 79.6% | 54.6% | 79.0% |
| Terminal | 59.1% | — | — |
| MATH | 89.0% | — | — |
| ARC-2 | 58.3% | — | — |
Anthropic es una empresa de seguridad de IA fundada en 2021 por los expositores de OpenAI Dario Amodei y Daniela Amodei, junto con un grupo de colegas que habían liderado los equipos de seguridad y políticas de OpenAI. La misión declarada de la empresa es el desarrollo responsable de la IA para el beneficio a largo plazo de la humanidad, y su agenda de investigación está definida por ese compromiso: IA Constitucional (CAI), una técnica para entrenar modelos para que sean útiles, inofensivos y honestos mediante la autocrítica; interpretabilidad mecanicista, que busca realizar ingeniería inversa de lo que las neuronas y circuitos individuales dentro de las grandes redes realmente computan; y ciencia de escalado, que intenta predecir cómo cambia el comportamiento del modelo con la computación y los datos. Anthropic publica esta investigación de forma abierta y se ha convertido en uno de los laboratorios de seguridad de IA más citados en la literatura académica. Claude es la familia de modelos públicos de Anthropic — nombrada en honor a Claude Shannon, el fundador de la teoría de la información — y abarca cuatro generaciones (1 a 4.x/Fable 5). Anthropic opera una API comercial y el producto consumer-facing Claude.ai, y mantiene profundas alianzas en la nube con AWS (Amazon Bedrock) y Google Cloud (Vertex AI).
Casos de Uso
Claude Sonnet 4.6 obtiene un 79% en SWE-bench Verified — clasificado #8 de 13 modelos registrados aquí. Resuelve issues reales de GitHub, escribe código de calidad de producción en múltiples lenguajes y maneja flujos de trabajo de codificación agéntica de múltiples pasos — una opción sólida para equipos de desarrollo de software asistidos por IA.
Claude Sonnet 4.6 alcanza un 59% en Terminal-Bench (#8 de 8 modelos), siendo competente para scripts de shell, flujos de trabajo de línea de comandos y tareas ligeras de administración de sistemas dentro de pipelines agénticos.
Con una ventana de contexto de 1M de tokens, Claude Sonnet 4.6 puede procesar repositorios de software completos, contratos legales extensos, informes de investigación del tamaño de un libro o historiales de conversaciones extensos en una sola consulta — permitiendo preguntas y respuestas profundas sobre documentos, razonamiento entre archivos de código y resúmenes completos sin necesidad de heurísticas de fragmentación ni pipelines de RAG.
Más para Comparar
Compara los 24 modelos en 11 benchmarks — ordenable, con fuentes y actualizado a junio de 2026.

Claude Opus 4.6 es un modelo de IA propietario de Anthropic, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Está disponible direct...

Claude Opus 4.7 es un modelo de IA propietario de Anthropic, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Explora sus puntuacion...

Claude Opus 4.8 es un modelo de IA propietario de Anthropic, clasificado como nivel Frontier con una ventana de contexto de 1M de tokens. Explora puntuaciones d...
Consentimiento de Cookies
Usamos cookies para mejorar tu experiencia de navegación y analizar nuestro tráfico. See our privacy policy.