
GPT-5 — Điểm Chuẩn, Khả Năng và Các Trường Hợp Sử Dụng
GPT-5 là mô hình AI độc quyền từ OpenAI, được xếp hạng Frontier với ngữ cảnh 400K token. Mô hình có sẵn trực tiếp trong FlowHunt. Khám phá điểm chuẩn, điểm mạnh...
GPT-5.5 là mô hình AI tiên tiến hàng đầu, được phát triển bởi OpenAI và phát hành vào tháng 4 năm 2026. Đây là mô hình trọng số đóng độc quyền, có sẵn thông qua API OpenAI. Cửa sổ ngữ cảnh 1M token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài, hoặc các phiên tác nhân mở rộng mà không bị cắt bớt.
Trên Bảng xếp hạng AI FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 6 điểm chuẩn. Các điểm số nổi bật: 82,7% trên Terminal-Bench (#1 trên 8); 88,7% trên SWE-bench Verified (#2 trên 13); 93,6% trên GPQA Diamond (#2 trên 14).
GPT-5.5 được OpenAI phát hành vào ngày 23 tháng 4 năm 2026 như một bản cải tiến lặp lại của GPT-5. Khi ra mắt, mô hình này đã ngang bằng Claude Opus 4.6 trên GPQA Diamond ở mức 93,6% và ghi nhận điểm Terminal-Bench cao nhất từ trước đến nay — 82,7% — phản ánh sức mạnh đặc biệt trong quản trị hệ thống tự động, viết tập lệnh shell và tự động hóa DevOps. OpenAI đã định vị GPT-5.5 là mô hình đa năng chính trong API của mình và nó trở thành mô hình mặc định hỗ trợ ChatGPT cho hầu hết người dùng. Mô hình cũng ghi nhận 68,4% trên SWE-bench Pro và 88,7% trên SWE-bench Verified, đưa nó vào nhóm ba mô hình lập trình hàng đầu toàn cầu.
Ghi chú: SWE-bench Verified cao nhất trước Fable 5. Điểm Terminal-Bench tốt nhất của OpenAI.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
OpenAI được thành lập vào tháng 12 năm 2015 với tư cách là một phòng thí nghiệm nghiên cứu AI phi lợi nhuận bởi Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman và Wojciech Zaremba, với sứ mệnh phát triển trí tuệ nhân tạo tổng quát (AGI) mang lại lợi ích cho toàn nhân loại. Vào năm 2019, công ty đã thành lập một công ty con có lợi nhuận giới hạn, OpenAI LP, để huy động vốn tổ chức và mở rộng quy mô huấn luyện mô hình. Công ty nổi tiếng với dòng mô hình ngôn ngữ GPT (GPT-1 đến GPT-5.5), dòng tạo hình ảnh DALL-E, nhận dạng giọng nói Whisper và tạo video Sora. OpenAI vận hành ứng dụng tiêu dùng ChatGPT, API dành cho nhà phát triển và dịch vụ doanh nghiệp thông qua Microsoft Azure. Tính đến năm 2026, công ty duy trì quan hệ đối tác chiến lược chặt chẽ với Microsoft, là nhà đầu tư và nhà cung cấp đám mây lớn nhất của công ty.
Trường hợp sử dụng
GPT-5.5 đạt 88% trên SWE-bench Verified — xếp hạng #2 trên 13 mô hình được theo dõi tại đây. Mô hình giải quyết các vấn đề GitHub thực tế, viết mã chất lượng sản xuất bằng nhiều ngôn ngữ và xử lý các quy trình lập trình tác nhân đa bước — một lựa chọn mạnh mẽ cho các nhóm phát triển phần mềm được hỗ trợ bởi AI.
Với 93% trên GPQA Diamond (#2 trên 14 mô hình), GPT-5.5 vượt qua mức cơ bản ~65% của chuyên gia PhD về các câu hỏi sinh học, hóa học và vật lý trình độ sau đại học. Sử dụng cho tổng hợp tài liệu khoa học, đánh giá giả thuyết, hỏi đáp y tế và pháp lý, và các tác vụ nghiên cứu đa lĩnh vực nơi kiến thức chuyên sâu về lĩnh vực là quan trọng.
Đạt 82% trên Terminal-Bench (#1 trên 8 mô hình), GPT-5.5 rất phù hợp cho DevOps tác nhân và tự động hóa hạ tầng. Terminal-Bench đo lường khả năng hoàn thành tự động các tác vụ Linux shell — quản lý gói, thao tác hệ thống tệp, kiểm soát tiến trình và quản trị hệ thống đa bước — mà không cần sự hướng dẫn của con người giữa tác vụ.
Với cửa sổ ngữ cảnh 1M token, GPT-5.5 có thể tiếp nhận toàn bộ kho mã nguồn, hợp đồng pháp lý dài, báo cáo nghiên cứu dài như sách, hoặc lịch sử hội thoại mở rộng trong một lần nhắc duy nhất — cho phép hỏi đáp tài liệu chuyên sâu, suy luận mã nguồn đa tệp, và tóm tắt toàn diện mà không cần phân đoạn heuristic hay quy trình RAG.
Thêm để so sánh
So sánh tất cả 24 mô hình qua 11 điểm chuẩn — có thể sắp xếp, có nguồn gốc, cập nhật tháng 6 năm 2026.

GPT-5 là mô hình AI độc quyền từ OpenAI, được xếp hạng Frontier với ngữ cảnh 400K token. Mô hình có sẵn trực tiếp trong FlowHunt. Khám phá điểm chuẩn, điểm mạnh...

GPT-5.4 là mô hình AI độc quyền từ OpenAI, được phân loại cấp Frontier với cửa sổ ngữ cảnh 1 triệu token. Mô hình có sẵn trực tiếp trong FlowHunt. Khám phá điểm...

Khám phá ngày ra mắt chính thức của GPT-5 bởi OpenAI, cách nó phát triển từ o1 và GPT-4o, cũng như ý nghĩa của thế hệ AI mới cho các nhà phát triển và doanh ngh...
Đồng Ý Cookie
Chúng tôi sử dụng cookie để cải thiện trải nghiệm duyệt web của bạn và phân tích lưu lượng truy cập của mình. See our privacy policy.