
Qwen 3.7-Plus — Kıyaslamalar, Yetenekler ve Kullanım Alanları
Qwen 3.7-Plus, Alibaba'nın sahip olduğu, Gelişmiş (Advanced) kademesinde sınıflandırılan ve 1 milyon token bağlam penceresine sahip tescilli bir yapay zeka mode...
Qwen 3.7-Max, Alibaba tarafından geliştirilen ve Mayıs 2026’da yayınlanan, en üst düzey bir frontier AI modelidir. Alibaba API’si aracılığıyla kullanılabilen, özel kapalı ağırlıklı bir modeldir. 1M token bağlam penceresi, tüm kod tabanlarını, uzun teknik belgeleri veya genişletilmiş ajan oturumlarını kesintiye uğratmadan tutacak kadar büyüktür.
FlowHunt AI Lider Tablosu’nda, 8 kıyaslama üzerinden değerlendirilen 24 takip edilen modelden biridir. Öne çıkan puanlar: MMLU-Pro’da %89,6 (8 model arasında #1); LiveCodeBench’te %91,6 (5 model arasında #2); HLE’de %41,4 (6 model arasında #2).
Qwen 3.7-Max, 20 Mayıs 2026’da Alibaba’nın Qwen 3 neslinin amiral gemisi modeli olarak yayınlandı ve Alibaba’nın ‘düşünme modu’ olarak adlandırdığı — sorgu başına açılıp kapatılabilen genişletilmiş bir zincirleme düşünce muhakeme yeteneği — özelliğini tanıttı. Düşünme modunda model, nihai yanıtını üretmeden önce dahili bir değerlendirme adımı çalıştırarak çok adımlı muhakeme görevlerinde performansı önemli ölçüde artırır. Lansman sırasında Qwen 3.7-Max, GPQA Diamond’da %92,4 (küreselde üçüncü), LiveCodeBench’te %91,6 ve SWE-bench Pro’da %60,6 — bu kıyaslamadaki en yüksek açık-API puanı — elde etti. 1M bağlam penceresi ve rekabetçi API fiyatlandırmasıyla birleştiğinde, maliyet bilincine sahip kurumsal ekipler için birincil Frontier kademesi alternatifi olarak kendini kanıtladı.
Not: GPQA Diamond lideri (%92,4). SWE-Pro lideri (%60,6). AA Index 56,6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
Alibaba Group, 1999 yılında Jack Ma tarafından kurulan ve merkezi Hangzhou'da bulunan, Çin'in en büyük ve en çeşitli teknoloji holdinglerinden biridir. DAMO Akademisi ve Tongyi Laboratuvarı aracılığıyla Alibaba, Qwen (Tongyi Qianwen) ailesiyle büyük dil modeli geliştirmede önemli bir güç haline gelmiştir. 2026'nın ortalarında piyasaya sürülen Qwen 3.7 nesli, Alibaba'nın yurt içi dağıtımlardan uluslararası kıyaslama rekabetçiliğine geçişini işaret etmiş olup Qwen 3.7-Max, GPQA Diamond'da %92,4 ve LiveCodeBench'te %91,6 puan almıştır. Alibaba'nın yapay zeka stratejisi, ABD merkezli yalnızca API modellerine karşı bir denge unsuru olarak açık ağırlıklı sürümler, bulut ve e-ticaret işlerinde üretken yapay zekanın entegrasyonu ve Alibaba Cloud bölümünde yapay zeka altyapısına yapılan yoğun yatırımlarla tanımlanmaktadır.
Kullanım Alanları
Qwen 3.7-Max, SWE-bench Verified'da %80 puan alır — burada takip edilen 13 model arasında #7 sıradadır. Gerçek GitHub sorunlarını çözer, birden çok dilde üretim kalitesinde kod yazar ve çok adımlı ajan kodlama iş akışlarını yönetir — AI destekli yazılım geliştirme ekipleri için güçlü bir seçimdir.
GPQA Diamond'da %92 ile (14 model arasında #4) Qwen 3.7-Max, lisansüstü düzey biyoloji, kimya ve fizik sorularında insan doktora uzmanı taban çizgisinin (~%65) üzerine çıkar. Bilimsel literatür sentezi, hipotez değerlendirme, tıbbi ve hukuki soru-cevap ve derin alan bilgisinin önemli olduğu çok disiplinli araştırma görevleri için kullanın.
Qwen 3.7-Max, Terminal-Bench'te %69'a ulaşır (8 model arasında #3), bu da onu yaygın kabuk betikleme, komut satırı iş akışları ve ajan hatları içindeki hafif sistem yönetimi görevleri için yetkin kılar.
1M token bağlam penceresiyle Qwen 3.7-Max, tüm yazılım depolarını, uzun yasal sözleşmeleri, kitap boyutundaki araştırma raporlarını veya kapsamlı konuşma geçmişlerini tek bir istemde işleyebilir — parçalama buluşsal yöntemleri veya RAG hatları olmadan derin belge soru-cevap, dosyalar arası kod tabanı muhakemesi ve kapsamlı özetleme sağlar.
Qwen 3.7-Max, LiveCodeBench'te %91 puan alır (5 model arasında #2); bu, sürekli olarak yeni rekabetçi programlama problemleriyle güncellenen, kirlenmeye karşı dayanıklı bir kıyaslamadır. Bu seviyede, gelişmiş veri yapılarını, grafik algoritmalarını ve mülakat seviyesindeki zorlukları yüksek güvenilirlikle ele alır.
Karşılaştırma Yapılacak Diğerleri
24 modelin tamamını 11 kıyaslama üzerinden karşılaştırın — sıralanabilir, kaynaklı ve Haziran 2026 itibarıyla güncellenmiştir.

Qwen 3.7-Plus, Alibaba'nın sahip olduğu, Gelişmiş (Advanced) kademesinde sınıflandırılan ve 1 milyon token bağlam penceresine sahip tescilli bir yapay zeka mode...

MiniMax M3, MiniMax tarafından geliştirilen, MoE (açıklanmamış) mimarisine sahip, 1M token bağlam penceresi ile Frontier kademesinde sınıflandırılan açık ağırlı...

FlowHunt'u Qwen Max ile entegre ederek sunucu işlemlerini otomatikleştirin, sistem sağlığını izleyin ve ölçeklenebilir ve güvenilir altyapı yönetimi için akıllı...
Çerez Onayı
Göz atma deneyiminizi geliştirmek ve trafiğimizi analiz etmek için çerezleri kullanıyoruz. See our privacy policy.