Alibaba logo

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max, Alibaba tarafından geliştirilen ve Mayıs 2026’da yayınlanan, en üst düzey bir frontier AI modelidir. Alibaba API’si aracılığıyla kullanılabilen, özel kapalı ağırlıklı bir modeldir. 1M token bağlam penceresi, tüm kod tabanlarını, uzun teknik belgeleri veya genişletilmiş ajan oturumlarını kesintiye uğratmadan tutacak kadar büyüktür.

FlowHunt AI Lider Tablosu’nda, 8 kıyaslama üzerinden değerlendirilen 24 takip edilen modelden biridir. Öne çıkan puanlar: MMLU-Pro’da %89,6 (8 model arasında #1); LiveCodeBench’te %91,6 (5 model arasında #2); HLE’de %41,4 (6 model arasında #2).

Qwen 3.7-Max, 20 Mayıs 2026’da Alibaba’nın Qwen 3 neslinin amiral gemisi modeli olarak yayınlandı ve Alibaba’nın ‘düşünme modu’ olarak adlandırdığı — sorgu başına açılıp kapatılabilen genişletilmiş bir zincirleme düşünce muhakeme yeteneği — özelliğini tanıttı. Düşünme modunda model, nihai yanıtını üretmeden önce dahili bir değerlendirme adımı çalıştırarak çok adımlı muhakeme görevlerinde performansı önemli ölçüde artırır. Lansman sırasında Qwen 3.7-Max, GPQA Diamond’da %92,4 (küreselde üçüncü), LiveCodeBench’te %91,6 ve SWE-bench Pro’da %60,6 — bu kıyaslamadaki en yüksek açık-API puanı — elde etti. 1M bağlam penceresi ve rekabetçi API fiyatlandırmasıyla birleştiğinde, maliyet bilincine sahip kurumsal ekipler için birincil Frontier kademesi alternatifi olarak kendini kanıtladı.

Not: GPQA Diamond lideri (%92,4). SWE-Pro lideri (%60,6). AA Index 56,6.

Yayın Tarihi
Mayıs 2026
Bağlam
1M token
Ağırlıklar
Kapalı
Kademe
Frontier
Sağlayıcı
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

Alibaba Group, 1999 yılında Jack Ma tarafından kurulan ve merkezi Hangzhou'da bulunan, Çin'in en büyük ve en çeşitli teknoloji holdinglerinden biridir. DAMO Akademisi ve Tongyi Laboratuvarı aracılığıyla Alibaba, Qwen (Tongyi Qianwen) ailesiyle büyük dil modeli geliştirmede önemli bir güç haline gelmiştir. 2026'nın ortalarında piyasaya sürülen Qwen 3.7 nesli, Alibaba'nın yurt içi dağıtımlardan uluslararası kıyaslama rekabetçiliğine geçişini işaret etmiş olup Qwen 3.7-Max, GPQA Diamond'da %92,4 ve LiveCodeBench'te %91,6 puan almıştır. Alibaba'nın yapay zeka stratejisi, ABD merkezli yalnızca API modellerine karşı bir denge unsuru olarak açık ağırlıklı sürümler, bulut ve e-ticaret işlerinde üretken yapay zekanın entegrasyonu ve Alibaba Cloud bölümünde yapay zeka altyapısına yapılan yoğun yatırımlarla tanımlanmaktadır.

Kullanım Alanları

Qwen 3.7-Max Hangi Amaçla Kullanılır

Yazılım Mühendisliği
Bilimsel ve Teknik Muhakeme
Ajan CLI Otomasyonu
Uzun Belge ve Kod Tabanı Analizi
Rekabetçi Programlama

Strengths & Limitations

Strengths

  • Güçlü yazılım mühendisliği — %80 SWE-bench Verified
  • Lisansüstü düzey bilim muhakemesi — %92 GPQA Diamond
  • Rekabetçi programlama — %91 LiveCodeBench
  • Bileşik zeka — 56 puan AA Intelligence Index (bağımsız)
  • Çok uzun belgeler ve büyük kod tabanları (1M bağlam)

Limitations

  • Kapalı ağırlık — kendi kendine barındırılamaz veya özel verilerle ince ayar yapılamaz

Tam AI Model Lider Tablosuna Göz Atın

Sıkça sorulan sorular

Daha fazla bilgi

Qwen 3.7-Plus — Kıyaslamalar, Yetenekler ve Kullanım Alanları
Qwen 3.7-Plus — Kıyaslamalar, Yetenekler ve Kullanım Alanları

Qwen 3.7-Plus — Kıyaslamalar, Yetenekler ve Kullanım Alanları

Qwen 3.7-Plus, Alibaba'nın sahip olduğu, Gelişmiş (Advanced) kademesinde sınıflandırılan ve 1 milyon token bağlam penceresine sahip tescilli bir yapay zeka mode...

3 dakika okuma
MiniMax M3 — Kıyaslamalar, Yetenekler ve Kullanım Alanları
MiniMax M3 — Kıyaslamalar, Yetenekler ve Kullanım Alanları

MiniMax M3 — Kıyaslamalar, Yetenekler ve Kullanım Alanları

MiniMax M3, MiniMax tarafından geliştirilen, MoE (açıklanmamış) mimarisine sahip, 1M token bağlam penceresi ile Frontier kademesinde sınıflandırılan açık ağırlı...

4 dakika okuma
Qwen Max
Qwen Max

Qwen Max

FlowHunt'u Qwen Max ile entegre ederek sunucu işlemlerini otomatikleştirin, sistem sağlığını izleyin ve ölçeklenebilir ve güvenilir altyapı yönetimi için akıllı...

3 dakika okuma
AI Qwen Max +3