Logotipo da Anthropic

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

O Claude Sonnet 4.6 é um modelo de IA avançado, adequado para cargas de trabalho de produção exigentes, desenvolvido pela Anthropic e lançado em fevereiro de 2026. É um modelo proprietário de pesos fechados, disponível através da API da Anthropic. A janela de contexto de 1M de tokens é grande o suficiente para armazenar bases de código inteiras, documentos técnicos extensos ou sessões agênticas prolongadas sem truncamento.

No Ranking de IA do FlowHunt, é um dos 24 modelos monitorados, avaliado em 4 benchmarks. Pontuações de destaque: 89,0% no MATH-500 (#2 de 4); 58,3% no ARC-AGI-2 (#2 de 3); 79,6% no SWE-bench Verified (#8 de 13).

O Claude Sonnet 4.6 foi lançado em 17 de fevereiro de 2026 como o modelo intermediário da geração Claude 4, posicionado entre a série Opus e a linha Haiku tanto em capacidade quanto em preço. O nível Sonnet tem oferecido historicamente a melhor relação custo-benefício no portfólio da Anthropic — capaz o suficiente para a grande maioria das tarefas de codificação e raciocínio por aproximadamente um quinto do preço do Opus. O Sonnet 4.6 obteve 58,3% no ARC-AGI-2 (verificado de forma independente pela ARC Prize Foundation), garantindo a segunda maior pontuação global nesse benchmark no momento do lançamento. Ele suporta a mesma janela de contexto de 1M de tokens que os modelos Opus.

Nota: Melhor agente financeiro da categoria (63,3%) e MCP-Atlas (61,3%). Pensamento adaptativo.

Lançamento
Fevereiro de 2026
Contexto
1M de tokens
Pesos
Fechados
Nível
Advanced
Provedor
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

A Anthropic é uma empresa de segurança de IA fundada em 2021 pelos antigos pesquisadores da OpenAI Dario Amodei e Daniela Amodei, juntamente com um grupo de colegas que lideravam as equipas de segurança e políticas da OpenAI. A missão declarada da empresa é o desenvolvimento responsável de IA para o benefício a longo prazo da humanidade, e a sua agenda de investigação é definida por esse compromisso: IA Constitucional (CAI), uma técnica para treinar modelos a serem úteis, inofensivos e honestos através da autocrítica; interpretabilidade mecanicista, que visa reverter a engenharia do que neurónios e circuitos individuais dentro de grandes redes realmente calculam; e ciência de escalabilidade, que tenta prever como o comportamento do modelo muda com computação e dados. A Anthropic publica esta investigação abertamente e tornou-se um dos laboratórios de segurança de IA mais citados na literatura académica. Claude é a família de modelos públicos da Anthropic — nomeada em homenagem a Claude Shannon, o fundador da teoria da informação — e abrange quatro gerações (1 a 4.x/Fable 5). A Anthropic opera uma API comercial e o produto Claude.ai voltado para o consumidor, e mantém parcerias profundas de cloud com a AWS (Amazon Bedrock) e o Google Cloud (Vertex AI).

Casos de Uso

Para Que Usar o Claude Sonnet 4.6

Engenharia de Software
Automação Agêntica de CLI
Análise de Documentos Longos e Bases de Código

Strengths & Limitations

Strengths

  • Forte engenharia de software — 79% SWE-bench Verified
  • Raciocínio visual inovador — 58% ARC-AGI-2 (verificado de forma independente)
  • Matemática avançada — 89% MATH-500
  • Documentos muito longos e grandes bases de código (contexto de 1M)

Limitations

  • Pesos fechados — não pode ser auto-hospedado ou ajustado com dados privados

Explore o Ranking Completo de Modelos de IA

Perguntas frequentes

Saiba mais

Claude Opus 4.6 — Benchmarks, Capacidades e Casos de Uso
Claude Opus 4.6 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.6 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.6 é um modelo de IA proprietário da Anthropic, classificado como nível Frontier com janela de contexto de 1M de tokens. Está disponível diretament...

5 min de leitura
Claude Opus 4.7 — Benchmarks, Capacidades e Casos de Uso
Claude Opus 4.7 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.7 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.7 é um modelo de IA proprietário da Anthropic, classificado como nível Frontier com janela de contexto de 1M de tokens. Explore pontuações de benc...

5 min de leitura
Claude Opus 4.8 — Benchmarks, Capacidades e Casos de Uso
Claude Opus 4.8 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.8 — Benchmarks, Capacidades e Casos de Uso

Claude Opus 4.8 é um modelo de IA proprietário da Anthropic, classificado como nível Frontier com janela de contexto de 1M de tokens. Explore pontuações de benc...

5 min de leitura