Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 là mô hình AI tiên tiến hàng đầu, được phát triển bởi Anthropic và phát hành vào tháng 5 năm 2026. Đây là mô hình trọng số đóng độc quyền, có thể truy cập thông qua API của Anthropic. Cửa sổ ngữ cảnh 1M token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác nhân mở rộng mà không bị cắt ngắn.

Trên Bảng xếp hạng AI của FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 5 điểm chuẩn. Các điểm số nổi bật: 61,4 điểm trên AA Intelligence Index (hạng 1/9); 69,2% trên SWE-bench Pro (hạng 2/9); 74,6% trên Terminal-Bench (hạng 2/8).

Claude Opus 4.8 được phát hành vào ngày 28 tháng 5 năm 2026 như một bản phát hành điểm tập trung trên nền tảng Opus 4.7, với Anthropic mô tả đây là ‘bản nâng cấp khiêm tốn nhưng hữu hình với cùng mức giá.’ Bản phát hành diễn ra theo nhịp độ nhanh: Opus 4.6, 4.7 và 4.8 đều được ra mắt trong cùng một quý lịch, phản ánh sự chuyển dịch của Anthropic sang phân phối gia tăng liên tục. Mặc dù cải thiện điểm chuẩn khiêm tốn, Opus 4.8 đã chiếm vị trí cao nhất trên Chỉ số Trí tuệ Phân tích Nhân tạo (Artificial Analysis Intelligence Index) với 61,4 điểm — điểm tổng hợp độc lập cao nhất của bất kỳ mô hình nào tại thời điểm phát hành — khiến nó trở thành mô hình tiên tiến toàn diện nhất theo đo lường độc lập của bên thứ ba, ngay cả khi nó bị Claude Fable 5 vượt qua về các tác vụ lập trình thuần túy hai tuần sau đó.

Lưu ý: Bản nâng cấp khiêm tốn nhưng hữu hình so với 4.7 với cùng mức giá. Đứng #1 AA Intelligence Index với 61,4 điểm.

Phát hành
Tháng 5 năm 2026
Ngữ cảnh
1M token
Trọng số
Đóng
Phân hạng
Frontier
Nhà cung cấp
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic là một công ty an toàn AI được thành lập vào năm 2021 bởi các cựu nhà nghiên cứu OpenAI Dario Amodei và Daniela Amodei, cùng với một nhóm đồng nghiệp từng dẫn dắt các nhóm an toàn và chính sách của OpenAI. Sứ mệnh đã nêu của công ty là phát triển AI một cách có trách nhiệm vì lợi ích lâu dài của nhân loại, và chương trình nghiên cứu của công ty được xác định bởi cam kết đó: Constitutional AI (CAI), một kỹ thuật huấn luyện mô hình trở nên hữu ích, vô hại và trung thực thông qua tự phê bình; khả năng giải thích cơ học (mechanistic interpretability), nhằm mục đích dịch ngược những gì các nơ-ron và mạch riêng lẻ bên trong các mạng lớn thực sự tính toán; và khoa học mở rộng quy mô (scaling science), cố gắng dự đoán hành vi của mô hình thay đổi như thế nào với sức mạnh tính toán và dữ liệu. Anthropic công bố nghiên cứu này một cách công khai và đã trở thành một trong những phòng thí nghiệm an toàn AI được trích dẫn nhiều nhất trong tài liệu học thuật. Claude là dòng mô hình công khai của Anthropic — được đặt theo tên Claude Shannon, người sáng lập lý thuyết thông tin — và trải qua bốn thế hệ (1 đến 4.x/Fable 5). Anthropic vận hành một API thương mại và sản phẩm Claude.ai hướng đến người tiêu dùng, đồng thời duy trì quan hệ đối tác đám mây sâu rộng với AWS (Amazon Bedrock) và Google Cloud (Vertex AI).

Trường hợp Sử dụng

Nên Sử dụng Claude Opus 4.8 Cho Việc Gì

Kỹ thuật Phần mềm
Suy luận Khoa học & Kỹ thuật
Tự động hóa CLI Tác nhân
Phân tích Tài liệu Dài & Mã nguồn

Strengths & Limitations

Strengths

  • Kỹ thuật phần mềm mạnh mẽ — 88% SWE-bench Verified
  • Suy luận khoa học trình độ sau đại học — 93% GPQA Diamond
  • Tự động hóa Linux / CLI tác nhân — 74% Terminal-Bench
  • Trí tuệ tổng hợp — 61 điểm AA Intelligence Index (độc lập)
  • Tài liệu rất dài và mã nguồn lớn (1M ngữ cảnh)

Limitations

  • Trọng số đóng — không thể tự lưu trữ hoặc tinh chỉnh trên dữ liệu riêng tư

Xem Toàn bộ Bảng xếp hạng Mô hình AI

Câu hỏi thường gặp

Tìm hiểu thêm