Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 est un modèle d’IA avancé conçu pour les charges de travail de production exigeantes, développé par Anthropic et publié en février 2026. Il s’agit d’un modèle propriétaire à poids fermés, disponible via l’API d’Anthropic. La fenêtre de contexte de 1 million de tokens est suffisamment grande pour contenir des bases de code entières, de longs documents techniques ou des sessions agentiques étendues sans troncature.

Sur le FlowHunt AI Leaderboard, il fait partie des 24 modèles suivis, évalués sur 4 benchmarks. Scores remarquables : 89,0 % sur MATH-500 (#2 sur 4) ; 58,3 % sur ARC-AGI-2 (#2 sur 3) ; 79,6 % sur SWE-bench Verified (#8 sur 13).

Claude Sonnet 4.6 a été publié le 17 février 2026 en tant que modèle de milieu de gamme de la génération Claude 4, positionné entre la série Opus et la ligne Haiku, à la fois en termes de capacités et de prix. Le niveau Sonnet a historiquement offert le meilleur rapport qualité-prix dans la gamme d’Anthropic — suffisamment performant pour la grande majorité des tâches de codage et de raisonnement pour environ un cinquième du prix d’Opus. Sonnet 4.6 a obtenu un score de 58,3 % sur ARC-AGI-2 (vérifié indépendamment par la Fondation ARC Prize), ce qui lui confère le deuxième meilleur score mondial sur ce benchmark au moment de sa publication. Il prend en charge la même fenêtre de contexte de 1 million de tokens que les modèles Opus.

Note : Meilleur agent financier de sa catégorie (63,3 %) et MCP-Atlas (61,3 %). Pensée adaptative.

Date de sortie
Février 2026
Contexte
1M tokens
Poids
Fermés
Niveau
Advanced
Fournisseur
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic est une entreprise de sécurité de l'IA fondée en 2021 par d'anciens chercheurs d'OpenAI, Dario Amodei et Daniela Amodei, ainsi qu'un groupe de collègues ayant dirigé les équipes de sécurité et de politique d'OpenAI. La mission déclarée de l'entreprise est le développement responsable de l'IA pour le bien à long terme de l'humanité, et son programme de recherche est défini par cet engagement : l'IA Constitutionnelle (CAI), une technique d'entraînement des modèles à être utiles, inoffensifs et honnêtes par l'auto-critique ; l'interprétabilité mécaniste, qui vise à rétro-ingénier ce que les neurones et circuits individuels au sein des grands réseaux calculent réellement ; et la science de la mise à l'échelle, qui tente de prédire comment le comportement des modèles évolue avec la puissance de calcul et les données. Anthropic publie cette recherche ouvertement et est devenu l'un des laboratoires de sécurité de l'IA les plus cités dans la littérature académique. Claude est la famille de modèles publique d'Anthropic — nommée d'après Claude Shannon, le fondateur de la théorie de l'information — et couvre quatre générations (1 à 4.x/Fable 5). Anthropic exploite une API commerciale et un produit grand public Claude.ai, et entretient des partenariats cloud profonds avec AWS (Amazon Bedrock) et Google Cloud (Vertex AI).

Cas d'utilisation

Pourquoi utiliser Claude Sonnet 4.6

Génie logiciel
Automatisation agentique en ligne de commande
Analyse de longs documents et de bases de code

Strengths & Limitations

Strengths

  • Solide en génie logiciel — 79 % SWE-bench Verified
  • Raisonnement visuel novateur — 58 % ARC-AGI-2 (vérifié indépendamment)
  • Mathématiques avancées — 89 % MATH-500
  • Très longs documents et grandes bases de code (1M de contexte)

Limitations

  • Poids fermés — ne peut pas être auto-hébergé ni affiné sur des données privées

Parcourir le classement complet des modèles d'IA

Questions fréquemment posées

En savoir plus

Claude Opus 4.6 — Benchmarks, Capacités et Cas d'Usage
Claude Opus 4.6 — Benchmarks, Capacités et Cas d'Usage

Claude Opus 4.6 — Benchmarks, Capacités et Cas d'Usage

Claude Opus 4.6 est un modèle d'IA propriétaire d'Anthropic, classé au niveau Frontière avec une fenêtre de contexte de 1 million de tokens. Il est disponible d...

5 min de lecture
Claude Opus 4.7 — Références, Capacités et Cas d'Usage
Claude Opus 4.7 — Références, Capacités et Cas d'Usage

Claude Opus 4.7 — Références, Capacités et Cas d'Usage

Claude Opus 4.7 est un modèle d'IA propriétaire d'Anthropic, classé au niveau Frontier avec une fenêtre de contexte de 1M de tokens. Découvrez ses scores de réf...

5 min de lecture
Claude Opus 4.8 — Benchmarks, capacités et cas d'usage
Claude Opus 4.8 — Benchmarks, capacités et cas d'usage

Claude Opus 4.8 — Benchmarks, capacités et cas d'usage

Claude Opus 4.8 est un modèle d'IA propriétaire d'Anthropic, classé au niveau Frontier avec une fenêtre de contexte de 1 million de tokens. Explorez les scores ...

6 min de lecture