Anthropic logo

Anthropic

Claude Sonnet 4.6

AdvancedAvailable in FlowHunt

Claude Sonnet 4.6 là mô hình AI tiên tiến phù hợp cho các khối lượng công việc sản xuất đòi hỏi cao, được phát triển bởi Anthropic và phát hành vào tháng 2 năm 2026. Đây là mô hình trọng số đóng độc quyền, có sẵn thông qua API của Anthropic. Cửa sổ ngữ cảnh 1 triệu token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác nhân mở rộng mà không bị cắt ngắn.

Trên Bảng xếp hạng AI của FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 4 điểm chuẩn. Các điểm số nổi bật: 89,0% trên MATH-500 (#2/4); 58,3% trên ARC-AGI-2 (#2/3); 79,6% trên SWE-bench Verified (#8/13).

Claude Sonnet 4.6 được phát hành vào ngày 17 tháng 2 năm 2026 với tư cách là mô hình tầm trung trong thế hệ Claude 4, nằm giữa dòng Opus và dòng Haiku cả về khả năng lẫn giá cả. Dòng Sonnet trong lịch sử luôn mang lại tỷ lệ giá cả-hiệu suất tốt nhất trong các dòng sản phẩm của Anthropic — đủ khả năng cho đại đa số các tác vụ lập trình và suy luận với mức giá khoảng một phần năm so với Opus. Sonnet 4.6 đạt 58,3% trên ARC-AGI-2 (được xác minh độc lập bởi ARC Prize Foundation), mang lại điểm số cao thứ hai toàn cầu trên điểm chuẩn đó tại thời điểm phát hành. Mô hình này hỗ trợ cùng cửa sổ ngữ cảnh 1 triệu token như các mô hình Opus.

Ghi chú: Tác nhân tài chính tốt nhất (63,3%) và MCP-Atlas (61,3%). Tư duy thích ứng.

Phát hành
Tháng 2 năm 2026
Ngữ cảnh
1 triệu token
Trọng số
Đóng
Phân khúc
Advanced
Nhà cung cấp
Anthropic

Claude Sonnet 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified79.6%8 of 13SRReal GitHub issue resolution (500 verified issues)
Terminal-Bench59.1%8 of 8SRAgentic Linux terminal task completion
MATH-50089.0%2 of 4SRHendrycks math (500 problems)
ARC-AGI-258.3%2 of 33PNovel visual reasoning, no memorisation

Detailed Benchmark Scores

SWE-V SR
79.6%
Real GitHub issue resolution (500 verified issues)
Terminal SR
59.1%
Agentic Linux terminal task completion
MATH SR
89.0%
Hendrycks math (500 problems)
ARC-2 3P
58.3%
Novel visual reasoning, no memorisation

Claude Sonnet 4.6 vs. Advanced Peers

Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.

BenchmarkClaude Sonnet 4.6GPT-4.1DeepSeek V4-Flash
SWE-V79.6%54.6%79.0%
Terminal59.1%
MATH89.0%
ARC-258.3%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic là một công ty an toàn AI được thành lập vào năm 2021 bởi các cựu nhà nghiên cứu OpenAI Dario Amodei và Daniela Amodei, cùng với một nhóm đồng nghiệp từng dẫn dắt các nhóm an toàn và chính sách của OpenAI. Sứ mệnh đã nêu của công ty là phát triển AI một cách có trách nhiệm vì lợi ích lâu dài của nhân loại, và chương trình nghiên cứu của công ty được xác định bởi cam kết đó: Constitutional AI (CAI), một kỹ thuật huấn luyện mô hình trở nên hữu ích, vô hại và trung thực thông qua tự phê bình; khả năng giải thích cơ học (mechanistic interpretability), nhằm mục đích dịch ngược những gì các nơ-ron và mạch riêng lẻ bên trong các mạng lớn thực sự tính toán; và khoa học mở rộng quy mô (scaling science), cố gắng dự đoán hành vi của mô hình thay đổi như thế nào với sức mạnh tính toán và dữ liệu. Anthropic công bố nghiên cứu này một cách công khai và đã trở thành một trong những phòng thí nghiệm an toàn AI được trích dẫn nhiều nhất trong tài liệu học thuật. Claude là dòng mô hình công khai của Anthropic — được đặt theo tên Claude Shannon, người sáng lập lý thuyết thông tin — và trải qua bốn thế hệ (1 đến 4.x/Fable 5). Anthropic vận hành một API thương mại và sản phẩm Claude.ai hướng đến người tiêu dùng, đồng thời duy trì quan hệ đối tác đám mây sâu rộng với AWS (Amazon Bedrock) và Google Cloud (Vertex AI).

Trường hợp sử dụng

Nên dùng Claude Sonnet 4.6 để làm gì

Kỹ thuật phần mềm
Tự động hóa CLI tác nhân
Phân tích tài liệu dài & mã nguồn

Strengths & Limitations

Strengths

  • Kỹ thuật phần mềm mạnh mẽ — 79% SWE-bench Verified
  • Suy luận trực quan mới lạ — 58% ARC-AGI-2 (được xác minh độc lập)
  • Toán học nâng cao — 89% MATH-500
  • Tài liệu rất dài và mã nguồn lớn (ngữ cảnh 1 triệu token)

Limitations

  • Trọng số đóng — không thể tự lưu trữ hoặc tinh chỉnh trên dữ liệu riêng tư

Xem toàn bộ Bảng xếp hạng mô hình AI

Câu hỏi thường gặp

Tìm hiểu thêm