Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 este un model AI avansat, potrivit pentru sarcini de producție solicitante, dezvoltat de Anthropic și lansat în februarie 2026. Este un model proprietar cu greutăți închise, disponibil prin API-ul Anthropic. Fereastra de context de 1M tokeni este suficient de mare pentru a cuprinde baze de cod întregi, documente tehnice lungi sau sesiuni agentice extinse fără trunchiere.

Pe Clasamentul AI FlowHunt este unul dintre cele 24 de modele urmărite, evaluat pe 4 criterii. Scoruri remarcabile: 89,0% pe MATH-500 (#2 din 4); 58,3% pe ARC-AGI-2 (#2 din 3); 79,6% pe SWE-bench Verified (#8 din 13).

Claude Sonnet 4.6 a fost lansat pe 17 februarie 2026 ca model de nivel mediu din generația Claude 4, poziționat între seria Opus și linia Haiku, atât ca și capabilități, cât și ca preț. Nivelul Sonnet a oferit istoric cel mai bun raport calitate-preț din gama Anthropic — suficient de capabil pentru marea majoritate a sarcinilor de codare și raționament la aproximativ o cincime din prețul Opus. Sonnet 4.6 a obținut 58,3% pe ARC-AGI-2 (verificat independent de ARC Prize Foundation), având astfel al doilea cel mai mare scor la nivel global pe acest criteriu la lansare. Suportă aceeași fereastră de context de 1M tokeni ca și modelele Opus.

Notă: Cel mai bun agent financiar (63,3%) și MCP-Atlas (61,3%). Gândire adaptivă.

Lansat
Februarie 2026
Context
1M tokeni
Greutăți
Închise
Nivel
Avansat
Furnizor
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic este o companie de siguranță AI fondată în 2021 de foștii cercetători OpenAI Dario Amodei și Daniela Amodei, împreună cu un grup de colegi care conduseseră echipele de siguranță și politici ale OpenAI. Misiunea declarată a companiei este dezvoltarea responsabilă a inteligenței artificiale pentru beneficiul pe termen lung al umanității, iar agenda sa de cercetare este definită de acest angajament: AI Constituțional (CAI), o tehnică de instruire a modelelor pentru a fi utile, inofensive și sincere prin autoevaluare critică; interpretabilitatea mecanicistă, care își propune să reconstituie inginerește ceea ce neuronii și circuitele individuale din rețelele mari calculează de fapt; și știința scalării, care încearcă să prezică modul în care comportamentul modelului se schimbă odată cu puterea de calcul și datele. Anthropic publică această cercetare în mod deschis și a devenit unul dintre cele mai citate laboratoare de siguranță AI din literatura academică. Claude este familia de modele publice Anthropic — numită după Claude Shannon, fondatorul teoriei informației — și acoperă patru generații (1 până la 4.x/Fable 5). Anthropic operează un API comercial și produsul consumer-facing Claude.ai, și menține parteneriate cloud profunde cu AWS (Amazon Bedrock) și Google Cloud (Vertex AI).

Cazuri de Utilizare

Pentru Ce să Folosești Claude Sonnet 4.6

Inginerie Software
Automatizare CLI Agentică
Analiză Documente Lungi și Baze de Cod

Strengths & Limitations

Strengths

  • Inginerie software solidă — 79% SWE-bench Verified
  • Raționament vizual inovator — 58% ARC-AGI-2 (verificat independent)
  • Matematică avansată — 89% MATH-500
  • Documente foarte lungi și baze de cod mari (context de 1M)

Limitations

  • Greutăți închise — nu poate fi auto-găzduit sau fine-tuned pe date private

Vezi Clasamentul Complet al Modelelor AI

Întrebări frecvente

Află mai multe