Logo Alibaba

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max là mô hình AI frontier hàng đầu, được phát triển bởi Alibaba và phát hành vào tháng 5 năm 2026. Đây là mô hình độc quyền với trọng số đóng, có sẵn thông qua API của Alibaba. Cửa sổ ngữ cảnh 1 triệu token đủ lớn để chứa toàn bộ mã nguồn, tài liệu kỹ thuật dài hoặc các phiên tác nhân mở rộng mà không bị cắt bớt.

Trên Bảng xếp hạng AI FlowHunt, đây là một trong 24 mô hình được theo dõi, được đánh giá qua 8 điểm chuẩn. Các điểm số nổi bật: 89,6% trên MMLU-Pro (#1/8); 91,6% trên LiveCodeBench (#2/5); 41,4% trên HLE (#2/6).

Qwen 3.7-Max được phát hành vào ngày 20 tháng 5 năm 2026 với tư cách là mô hình hàng đầu trong thế hệ Qwen 3 của Alibaba, giới thiệu thứ mà Alibaba gọi là ‘chế độ suy luận’ — khả năng suy luận chuỗi tư duy mở rộng có thể bật/tắt cho từng truy vấn. Ở chế độ suy luận, mô hình thực hiện bước cân nhắc nội bộ trước khi đưa ra câu trả lời cuối cùng, cải thiện đáng kể hiệu suất trên các tác vụ suy luận đa bước. Khi ra mắt, Qwen 3.7-Max đạt 92,4% trên GPQA Diamond (thứ ba toàn cầu), 91,6% trên LiveCodeBench và 60,6% trên SWE-bench Pro — điểm số API mở cao nhất trên điểm chuẩn đó. Kết hợp với cửa sổ ngữ cảnh 1 triệu token và giá API cạnh tranh, mô hình đã khẳng định mình là lựa chọn thay thế Frontier hàng đầu cho các nhóm doanh nghiệp quan tâm đến chi phí.

Lưu ý: Dẫn đầu GPQA Diamond (92,4%). Dẫn đầu SWE-Pro (60,6%). AA Index 56,6.

Phát hành
Tháng 5 năm 2026
Ngữ cảnh
1 triệu token
Trọng số
Đóng
Hạng
Frontier
Nhà cung cấp
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Tập đoàn Alibaba là một trong những tập đoàn công nghệ lớn nhất và đa dạng nhất của Trung Quốc, được thành lập vào năm 1999 bởi Jack Ma và có trụ sở chính tại Hàng Châu. Thông qua Học viện DAMO và Phòng thí nghiệm Tongyi, Alibaba đã trở thành một lực lượng lớn trong việc phát triển mô hình ngôn ngữ lớn với dòng Qwen (Thông Nghĩa Thiên Vấn). Thế hệ Qwen 3.7, được phát hành vào giữa năm 2026, đánh dấu sự chuyển đổi của Alibaba từ triển khai nội địa sang cạnh tranh chuẩn quốc tế, với Qwen 3.7-Max đạt 92,4% trên GPQA Diamond và 91,6% trên LiveCodeBench. Chiến lược AI của Alibaba được xác định bởi việc phát hành trọng số mở như một đối trọng với các mô hình chỉ có API của Mỹ, tích hợp AI tạo sinh trên các mảng kinh doanh đám mây và thương mại điện tử của mình, và đầu tư mạnh vào cơ sở hạ tầng AI trên toàn bộ bộ phận Alibaba Cloud.

Trường hợp sử dụng

Nên Dùng Qwen 3.7-Max Cho Việc Gì

Kỹ thuật Phần mềm
Suy luận Khoa học & Kỹ thuật
Tự động hóa CLI Tác nhân
Phân tích Tài liệu Dài & Mã nguồn
Lập trình Cạnh tranh

Strengths & Limitations

Strengths

  • Kỹ thuật phần mềm mạnh mẽ — 80% SWE-bench Verified
  • Suy luận khoa học cấp độ sau đại học — 92% GPQA Diamond
  • Lập trình cạnh tranh — 91% LiveCodeBench
  • Trí tuệ tổng hợp — 56 điểm AA Intelligence Index (độc lập)
  • Tài liệu rất dài và mã nguồn lớn (ngữ cảnh 1 triệu)

Limitations

  • Trọng số đóng — không thể tự lưu trữ hoặc tinh chỉnh trên dữ liệu riêng

Xem Toàn Bộ Bảng Xếp Hạng Mô Hình AI

Câu hỏi thường gặp

Tìm hiểu thêm

MiniMax M3 — Điểm chuẩn, Khả năng và Trường hợp sử dụng
MiniMax M3 — Điểm chuẩn, Khả năng và Trường hợp sử dụng

MiniMax M3 — Điểm chuẩn, Khả năng và Trường hợp sử dụng

MiniMax M3 là mô hình AI trọng số mở từ MiniMax (MoE (không tiết lộ)), được xếp hạng Frontier với cửa sổ ngữ cảnh 1M token. Mô hình có sẵn trực tiếp trong FlowH...

5 phút đọc
Qwen Max
Qwen Max

Qwen Max

Tích hợp FlowHunt với Qwen Max để tự động hóa vận hành máy chủ, giám sát tình trạng hệ thống và nâng cao năng suất bằng các quy trình làm việc AI thông minh, gi...

5 phút đọc
AI Qwen Max +3