
Claude Opus 4.7 — Điểm chuẩn, Khả năng và Trường hợp Sử dụng
Claude Opus 4.7 là mô hình AI độc quyền từ Anthropic, được xếp hạng Frontier với ngữ cảnh 1 triệu token. Khám phá điểm chuẩn, điểm mạnh và các trường hợp sử dụn...
Claude Opus 4.8 là mô hình AI tiên tiến hàng đầu, được phát triển bởi Anthropic và phát hành vào tháng 5 năm 2026. Đây là mô hình trọng số đóng độc quyền, có thể truy cập thông qua API của Anthropic. Cửa sổ ngữ cảnh 1M token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác nhân mở rộng mà không bị cắt ngắn.
Trên Bảng xếp hạng AI của FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 5 điểm chuẩn. Các điểm số nổi bật: 61,4 điểm trên AA Intelligence Index (hạng 1/9); 69,2% trên SWE-bench Pro (hạng 2/9); 74,6% trên Terminal-Bench (hạng 2/8).
Claude Opus 4.8 được phát hành vào ngày 28 tháng 5 năm 2026 như một bản phát hành điểm tập trung trên nền tảng Opus 4.7, với Anthropic mô tả đây là ‘bản nâng cấp khiêm tốn nhưng hữu hình với cùng mức giá.’ Bản phát hành diễn ra theo nhịp độ nhanh: Opus 4.6, 4.7 và 4.8 đều được ra mắt trong cùng một quý lịch, phản ánh sự chuyển dịch của Anthropic sang phân phối gia tăng liên tục. Mặc dù cải thiện điểm chuẩn khiêm tốn, Opus 4.8 đã chiếm vị trí cao nhất trên Chỉ số Trí tuệ Phân tích Nhân tạo (Artificial Analysis Intelligence Index) với 61,4 điểm — điểm tổng hợp độc lập cao nhất của bất kỳ mô hình nào tại thời điểm phát hành — khiến nó trở thành mô hình tiên tiến toàn diện nhất theo đo lường độc lập của bên thứ ba, ngay cả khi nó bị Claude Fable 5 vượt qua về các tác vụ lập trình thuần túy hai tuần sau đó.
Lưu ý: Bản nâng cấp khiêm tốn nhưng hữu hình so với 4.7 với cùng mức giá. Đứng #1 AA Intelligence Index với 61,4 điểm.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.6% | 3 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 69.2% | 2 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 3 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 74.6% | 2 of 8 | SR | Agentic Linux terminal task completion |
| AA Intelligence Index | 61.4 pts | 1 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic là một công ty an toàn AI được thành lập vào năm 2021 bởi các cựu nhà nghiên cứu OpenAI Dario Amodei và Daniela Amodei, cùng với một nhóm đồng nghiệp từng dẫn dắt các nhóm an toàn và chính sách của OpenAI. Sứ mệnh đã nêu của công ty là phát triển AI một cách có trách nhiệm vì lợi ích lâu dài của nhân loại, và chương trình nghiên cứu của công ty được xác định bởi cam kết đó: Constitutional AI (CAI), một kỹ thuật huấn luyện mô hình trở nên hữu ích, vô hại và trung thực thông qua tự phê bình; khả năng giải thích cơ học (mechanistic interpretability), nhằm mục đích dịch ngược những gì các nơ-ron và mạch riêng lẻ bên trong các mạng lớn thực sự tính toán; và khoa học mở rộng quy mô (scaling science), cố gắng dự đoán hành vi của mô hình thay đổi như thế nào với sức mạnh tính toán và dữ liệu. Anthropic công bố nghiên cứu này một cách công khai và đã trở thành một trong những phòng thí nghiệm an toàn AI được trích dẫn nhiều nhất trong tài liệu học thuật. Claude là dòng mô hình công khai của Anthropic — được đặt theo tên Claude Shannon, người sáng lập lý thuyết thông tin — và trải qua bốn thế hệ (1 đến 4.x/Fable 5). Anthropic vận hành một API thương mại và sản phẩm Claude.ai hướng đến người tiêu dùng, đồng thời duy trì quan hệ đối tác đám mây sâu rộng với AWS (Amazon Bedrock) và Google Cloud (Vertex AI).
Trường hợp Sử dụng
Claude Opus 4.8 đạt 88% trên SWE-bench Verified — xếp hạng #3 trong số 13 mô hình được theo dõi tại đây. Mô hình giải quyết các vấn đề GitHub thực tế, viết mã chất lượng sản xuất bằng nhiều ngôn ngữ và xử lý các quy trình làm việc lập trình tác nhân đa bước — một lựa chọn mạnh mẽ cho các nhóm phát triển phần mềm hỗ trợ AI.
Với 93% trên GPQA Diamond (hạng #3/14 mô hình), Claude Opus 4.8 vượt qua mức cơ sở ~65% của chuyên gia tiến sĩ về các câu hỏi sinh học, hóa học và vật lý trình độ sau đại học. Sử dụng mô hình này để tổng hợp tài liệu khoa học, đánh giá giả thuyết, hỏi đáp y tế và pháp lý, và các nhiệm vụ nghiên cứu đa lĩnh vực nơi kiến thức chuyên sâu về lĩnh vực là quan trọng.
Đạt 74% trên Terminal-Bench (hạng #2/8 mô hình), Claude Opus 4.8 rất phù hợp cho tự động hóa DevOps và hạ tầng dạng tác nhân. Terminal-Bench đo lường khả năng hoàn thành tự động các tác vụ shell Linux — quản lý gói, thao tác hệ thống tệp, kiểm soát tiến trình và quản trị hệ thống đa bước — mà không cần sự hướng dẫn của con người trong quá trình thực hiện.
Với cửa sổ ngữ cảnh 1M token, Claude Opus 4.8 có thể tiếp nhận toàn bộ kho lưu trữ phần mềm, hợp đồng pháp lý dài, báo cáo nghiên cứu dài như sách hoặc lịch sử hội thoại mở rộng trong một lời nhắc duy nhất — cho phép hỏi đáp tài liệu chuyên sâu, suy luận mã nguồn đa tệp và tóm tắt toàn diện mà không cần phân đoạn heuristic hoặc pipeline RAG.
Thêm để So sánh
So sánh tất cả 24 mô hình qua 11 điểm chuẩn — có thể sắp xếp, có nguồn gốc và cập nhật tháng 6 năm 2026.

Claude Opus 4.7 là mô hình AI độc quyền từ Anthropic, được xếp hạng Frontier với ngữ cảnh 1 triệu token. Khám phá điểm chuẩn, điểm mạnh và các trường hợp sử dụn...

Claude Opus 4.6 là mô hình AI độc quyền từ Anthropic, được xếp hạng Frontier với cửa sổ ngữ cảnh 1 triệu token. Mô hình có sẵn trực tiếp trong FlowHunt. Khám ph...

Claude Fable 5 là mô hình AI độc quyền của Anthropic, được xếp hạng Siêu-Tiên phong với khung ngữ cảnh 1 triệu token. Khám phá điểm chuẩn, thế mạnh và các trườn...
Đồng Ý Cookie
Chúng tôi sử dụng cookie để cải thiện trải nghiệm duyệt web của bạn và phân tích lưu lượng truy cập của mình. See our privacy policy.