
Qwen 3.7-Plus — Điểm chuẩn, Khả năng và Trường hợp sử dụng
Qwen 3.7-Plus là mô hình AI độc quyền từ Alibaba, được xếp hạng Advanced với cửa sổ ngữ cảnh 1 triệu token. Mô hình có sẵn trực tiếp trong FlowHunt. Khám phá đi...
Qwen 3.7-Max là mô hình AI frontier hàng đầu, được phát triển bởi Alibaba và phát hành vào tháng 5 năm 2026. Đây là mô hình độc quyền với trọng số đóng, có sẵn thông qua API của Alibaba. Cửa sổ ngữ cảnh 1 triệu token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác nhân mở rộng mà không bị cắt bớt.
Trên Bảng xếp hạng AI FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 8 điểm chuẩn. Các điểm số nổi bật: 89,6% trên MMLU-Pro (#1/8); 91,6% trên LiveCodeBench (#2/5); 41,4% trên HLE (#2/6).
Qwen 3.7-Max được phát hành vào ngày 20 tháng 5 năm 2026 với tư cách là mô hình hàng đầu trong thế hệ Qwen 3 của Alibaba, giới thiệu thứ mà Alibaba gọi là ‘chế độ suy luận’ — khả năng suy luận chuỗi tư duy mở rộng có thể bật/tắt cho từng truy vấn. Ở chế độ suy luận, mô hình thực hiện bước cân nhắc nội bộ trước khi đưa ra câu trả lời cuối cùng, cải thiện đáng kể hiệu suất trên các tác vụ suy luận đa bước. Khi ra mắt, Qwen 3.7-Max đạt 92,4% trên GPQA Diamond (thứ ba toàn cầu), 91,6% trên LiveCodeBench và 60,6% trên SWE-bench Pro — điểm số API mở cao nhất trên điểm chuẩn đó. Kết hợp với cửa sổ ngữ cảnh 1 triệu token và giá API cạnh tranh, mô hình đã khẳng định mình là lựa chọn thay thế Frontier hàng đầu cho các nhóm doanh nghiệp quan tâm đến chi phí.
Lưu ý: Dẫn đầu GPQA Diamond (92,4%). Dẫn đầu SWE-Pro (60,6%). AA Index 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Tập đoàn Alibaba là một trong những tập đoàn công nghệ lớn nhất và đa dạng nhất của Trung Quốc, được thành lập vào năm 1999 bởi Jack Ma và có trụ sở chính tại Hàng Châu. Thông qua Học viện DAMO và Phòng thí nghiệm Tongyi, Alibaba đã trở thành một lực lượng lớn trong việc phát triển mô hình ngôn ngữ lớn với dòng Qwen (Thông Nghĩa Thiên Vấn). Thế hệ Qwen 3.7, được phát hành vào giữa năm 2026, đánh dấu sự chuyển đổi của Alibaba từ triển khai nội địa sang cạnh tranh chuẩn quốc tế, với Qwen 3.7-Max đạt 92,4% trên GPQA Diamond và 91,6% trên LiveCodeBench. Chiến lược AI của Alibaba được xác định bởi việc phát hành trọng số mở như một đối trọng với các mô hình chỉ có API của Mỹ, tích hợp AI tạo sinh trên các mảng kinh doanh đám mây và thương mại điện tử của mình, và đầu tư mạnh vào cơ sở hạ tầng AI trên toàn bộ bộ phận Alibaba Cloud.
Trường hợp sử dụng
Qwen 3.7-Max đạt 80% trên SWE-bench Verified — xếp hạng #7/13 mô hình được theo dõi tại đây. Mô hình giải quyết các vấn đề GitHub thực tế, viết mã chất lượng sản xuất trên nhiều ngôn ngữ và xử lý các quy trình mã hóa tác nhân đa bước — một lựa chọn mạnh mẽ cho các nhóm phát triển phần mềm hỗ trợ AI.
Với 92% trên GPQA Diamond (#4/14 mô hình), Qwen 3.7-Max vượt qua mức cơ bản ~65% của chuyên gia có trình độ tiến sĩ về các câu hỏi sinh học, hóa học và vật lý ở cấp độ sau đại học. Sử dụng để tổng hợp tài liệu khoa học, đánh giá giả thuyết, hỏi đáp y tế và pháp lý, cũng như các tác vụ nghiên cứu đa lĩnh vực nơi kiến thức chuyên sâu về lĩnh vực là quan trọng.
Qwen 3.7-Max đạt 69% trên Terminal-Bench (#3/8 mô hình), cho thấy năng lực tốt trong việc viết kịch bản shell thông thường, quy trình dòng lệnh và các tác vụ quản trị hệ thống nhẹ trong các pipeline tác nhân.
Với cửa sổ ngữ cảnh 1 triệu token, Qwen 3.7-Max có thể tiếp nhận toàn bộ kho mã nguồn, hợp đồng pháp lý dài, báo cáo nghiên cứu dài như sách hoặc lịch sử hội thoại mở rộng trong một lời nhắc duy nhất — cho phép hỏi đáp tài liệu chuyên sâu, suy luận mã nguồn đa tệp và tóm tắt toàn diện mà không cần các phương pháp heuristic chia nhỏ hoặc pipeline RAG.
Qwen 3.7-Max đạt 91% trên LiveCodeBench (#2/5 mô hình), một điểm chuẩn kháng nhiễu được làm mới liên tục với các bài toán lập trình cạnh tranh mới. Ở mức này, mô hình xử lý các cấu trúc dữ liệu nâng cao, thuật toán đồ thị và các thử thách cấp phỏng vấn với độ tin cậy cao.
Thêm Để So Sánh
So sánh tất cả 24 mô hình qua 11 điểm chuẩn — có thể sắp xếp, có nguồn gốc và cập nhật tháng 6 năm 2026.

Qwen 3.7-Plus là mô hình AI độc quyền từ Alibaba, được xếp hạng Advanced với cửa sổ ngữ cảnh 1 triệu token. Mô hình có sẵn trực tiếp trong FlowHunt. Khám phá đi...

MiniMax M3 là mô hình AI trọng số mở từ MiniMax (MoE (không tiết lộ)), được xếp hạng Frontier với cửa sổ ngữ cảnh 1M token. Mô hình có sẵn trực tiếp trong FlowH...

Tích hợp FlowHunt với Qwen Max để tự động hóa vận hành máy chủ, giám sát tình trạng hệ thống và nâng cao năng suất bằng các quy trình làm việc AI thông minh, gi...
Đồng Ý Cookie
Chúng tôi sử dụng cookie để cải thiện trải nghiệm duyệt web của bạn và phân tích lưu lượng truy cập của mình. See our privacy policy.