Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 è un modello AI avanzato adatto a carichi di lavoro di produzione impegnativi, sviluppato da Anthropic e rilasciato a febbraio 2026. È un modello proprietario a pesi chiusi, disponibile tramite l’API di Anthropic. La finestra di contesto di 1 milione di token è sufficientemente grande da contenere interi codebase, lunghi documenti tecnici o sessioni agentiche estese senza troncamenti.

Nella FlowHunt AI Leaderboard è uno dei 24 modelli monitorati, valutato su 4 benchmark. Punteggi di spicco: 89,0% su MATH-500 (#2 di 4); 58,3% su ARC-AGI-2 (#2 di 3); 79,6% su SWE-bench Verified (#8 di 13).

Claude Sonnet 4.6 è stato rilasciato il 17 febbraio 2026 come modello di fascia media della generazione Claude 4, posizionato tra la serie Opus e la linea Haiku sia per capacità che per prezzo. Il livello Sonnet ha storicamente offerto il miglior rapporto qualità-prezzo nella lineup di Anthropic — sufficientemente potente per la stragrande maggioranza delle attività di codifica e ragionamento a circa un quinto del prezzo di Opus. Sonnet 4.6 ha ottenuto il 58,3% su ARC-AGI-2 (verificato in modo indipendente dalla ARC Prize Foundation), posizionandosi al secondo posto a livello globale in quel benchmark al momento del rilascio. Supporta la stessa finestra di contesto di 1 milione di token dei modelli Opus.

Nota: Agente finanziario leader di categoria (63,3%) e MCP-Atlas (61,3%). Pensiero adattivo.

Rilasciato
Febbraio 2026
Contesto
1 milione di token
Pesi
Chiusi
Livello
Advanced
Fornitore
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic è un'azienda di sicurezza dell'IA fondata nel 2021 dagli ex ricercatori di OpenAI Dario Amodei e Daniela Amodei, insieme a un gruppo di colleghi che avevano guidato i team di sicurezza e policy di OpenAI. La missione dichiarata dell'azienda è lo sviluppo responsabile dell'IA per il beneficio a lungo termine dell'umanità, e la sua agenda di ricerca è definita da questo impegno: IA Costituzionale (CAI), una tecnica per addestrare modelli a essere utili, innocui e onesti attraverso l'autocritica; interpretabilità meccanicistica, che mira a fare reverse-engineering di ciò che i singoli neuroni e circuiti all'interno di grandi reti effettivamente calcolano; e scienza della scalabilità, che cerca di prevedere come il comportamento dei modelli cambi con la potenza di calcolo e i dati. Anthropic pubblica questa ricerca apertamente ed è diventato uno dei laboratori di sicurezza dell'IA più citati nella letteratura accademica. Claude è la famiglia di modelli pubblici di Anthropic — dal nome di Claude Shannon, il fondatore della teoria dell'informazione — e copre quattro generazioni (dalla 1 alla 4.x/Fable 5). Anthropic gestisce un'API commerciale e il prodotto consumer Claude.ai, e mantiene profonde partnership cloud con AWS (Amazon Bedrock) e Google Cloud (Vertex AI).

Casi d'Uso

Per Cosa Utilizzare Claude Sonnet 4.6

Ingegneria del Software
Automazione CLI Agentica
Analisi di Documenti Lunghi e Codebase

Strengths & Limitations

Strengths

  • Forte ingegneria del software — 79% SWE-bench Verified
  • Nuovo ragionamento visivo — 58% ARC-AGI-2 (verificato indipendentemente)
  • Matematica avanzata — 89% MATH-500
  • Documenti molto lunghi e grandi codebase (contesto 1 milione)

Limitations

  • Pesi chiusi — non può essere auto-ospitato o messo a punto su dati privati

Sfoglia la Classifica Completa dei Modelli AI

Domande frequenti

Scopri di più

Claude Opus 4.6 — Benchmark, Capacità e Casi d'Uso
Claude Opus 4.6 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.6 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.6 è un modello di IA proprietario di Anthropic, classificato come Frontier con una finestra di contesto di 1 milione di token. È disponibile diret...

5 min di lettura
Claude Opus 4.8 — Benchmark, Capacità e Casi d'Uso
Claude Opus 4.8 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.8 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.8 è un modello AI proprietario di Anthropic, classificato di livello Frontier con una finestra di contesto di 1 milione di token. Esplora punteggi...

5 min di lettura
Claude Opus 4.7 — Benchmark, Capacità e Casi d'Uso
Claude Opus 4.7 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.7 — Benchmark, Capacità e Casi d'Uso

Claude Opus 4.7 è un modello AI proprietario di Anthropic, classificato come livello Frontier con una finestra di contesto di 1 milione di token. Esplora punteg...

5 min di lettura