
Qwen 3.7-Plus — المعايير، الإمكانيات، وحالات الاستخدام
Qwen 3.7-Plus هو نموذج ذكاء اصطناعي خاص من Alibaba، مصنف في المستوى المتقدم مع نافذة سياقية تبلغ 1 مليون رمز. وهو متاح مباشرة في FlowHunt. استكشف نتائج المعايير...
Qwen 3.7-Max هو نموذج ذكاء اصطناعي حدودي من الطراز الأول، طورته Alibaba وتم إصداره في مايو 2026. وهو نموذج خاص مغلق الأوزان، متاح عبر واجهة Alibaba API. النافذة السياقية التي تبلغ مليون رمز كبيرة بما يكفي لاحتواء قواعد بيانات برمجية كاملة، وثائق تقنية مطولة، أو جلسات وكيلية ممتدة دون اقتطاع.
على لوحة متصدرة الذكاء الاصطناعي من FlowHunt، هو واحد من 24 نموذجاً متتبعاً، تم تقييمه عبر 8 معايير. نتائج بارزة: 89.6% في MMLU-Pro (#1 من 8)؛ 91.6% في LiveCodeBench (#2 من 5)؛ 41.4% في HLE (#2 من 6).
تم إصدار Qwen 3.7-Max في 20 مايو 2026 كأفضل نموذج في الجيل الثالث من سلسلة Qwen من Alibaba، حيث قدمت Alibaba ما أسمته ‘وضع التفكير’ — قدرة استدلال ممتدة لسلسلة الأفكار يمكن تشغيلها لكل استعلام. في وضع التفكير، يقوم النموذج بخطوة مداولة داخلية قبل إنتاج إجابته النهائية، مما يحسن الأداء بشكل كبير في مهام الاستدلال متعددة الخطوات. عند الإطلاق، سجل Qwen 3.7-Max 92.4% في GPQA Diamond (ثالث عالمياً)، و91.6% في LiveCodeBench، و60.6% في SWE-bench Pro — أعلى درجة لواجهة API مفتوحة في ذلك المعيار. إلى جانب نافذة سياقية بحجم مليون رمز وتسعير API تنافسي، أثبت نفسه كبديل حدودي أساسي للفرق المؤسسية المهتمة بالتكلفة.
ملاحظة: رائد GPQA Diamond (92.4%). رائد SWE-Pro (60.6%). مؤشر AA 56.6.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.4% | 7 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 60.6% | 4 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 92.4% | 4 of 14 | SR | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 89.6% | 1 of 8 | SR | Hard knowledge reasoning, 12K questions |
| LiveCodeBench | 91.6% | 2 of 5 | SR | Competitive programming, continuously updated |
| Terminal-Bench | 69.7% | 3 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 2 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 56.6 pts | 4 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | Qwen 3.7-Max | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 80.4% | 88.6% | 87.6% |
| SWE-Pro | 60.6% | 69.2% | 64.3% |
| GPQA ◇ | 92.4% | 93.6% | 94.2% |
| MMLU-P | 89.6% | — | — |
| LiveCode | 91.6% | — | — |
| Terminal | 69.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 56.6 pts | 61.4 pts | 57.3 pts |
مجموعة Alibaba هي واحدة من أكبر وأكثر تكتلات التكنولوجيا تنوعًا في الصين، تأسست في عام 1999 على يد جاك ما ويقع مقرها الرئيسي في هانغتشو. من خلال أكاديمية DAMO ومختبر Tongyi، أصبحت Alibaba قوة رئيسية في تطوير نماذج اللغة الكبيرة من خلال عائلة Qwen (Tongyi Qianwen). يمثل الجيل Qwen 3.7، الذي صدر في منتصف عام 2026، انتقال Alibaba من النشر المحلي إلى المنافسة على المعايير الدولية، حيث سجل Qwen 3.7-Max نسبة 92.4% على GPQA Diamond و 91.6% على LiveCodeBench. تتميز استراتيجية Alibaba للذكاء الاصطناعي بإصدارات مفتوحة الأوزان كموازنة للنماذج الأمريكية التي تعمل بواجهة برمجة تطبيقات فقط، ودمج الذكاء الاصطناعي التوليدي عبر أعمالها السحابية والتجارة الإلكترونية، والاستثمار الكبير في البنية التحتية للذكاء الاصطناعي عبر قسم Alibaba Cloud.
حالات الاستخدام
يسجل Qwen 3.7-Max 80% في SWE-bench Verified — مصنف #7 من 13 نموذجاً متتبعاً هنا. يحل مشكلات GitHub الواقعية، ويكتب كوداً بجودة إنتاجية عبر لغات متعددة، ويتعامل مع سير عمل برمجية وكيلية متعددة الخطوات — خيار قوي لفرق تطوير البرمجيات المدعومة بالذكاء الاصطناعي.
عند 92% في GPQA Diamond (#4 من 14 نموذجاً)، يتجاوز Qwen 3.7-Max خط الأساس البشري البالغ ~65% من خبراء الدكتوراه في أسئلة البيولوجيا والكيمياء والفيزياء على مستوى الدراسات العليا. استخدمه لتجميع الأدبيات العلمية، تقييم الفرضيات، الأسئلة والأجوبة الطبية والقانونية، ومهام البحث متعددة التخصصات حيث تكون المعرفة العميقة بالمجال مهمة.
يحقق Qwen 3.7-Max 69% في Terminal-Bench (#3 من 8 نماذج)، مما يجعله كفؤاً في مهام البرمجة النصية الشائعة، سير عمل واجهة الأوامر، ومهام إدارة الأنظمة الخفيفة داخل خطوط الأنابيب الوكيلية.
مع نافذة سياقية تبلغ مليون رمز، يمكن لـ Qwen 3.7-Max استيعاب مستودعات برمجية كاملة، عقود قانونية طويلة، تقارير بحثية بطول كتاب، أو تواريخ محادثات ممتدة في استعلام واحد — مما يتيح أسئلة وأجوبة عميقة للوثائق، استدلال عبر ملفات قاعدة البيانات البرمجية، وتلخيص شامل دون الحاجة إلى استدلالات التجزئة أو خطوط RAG.
يسجل Qwen 3.7-Max 91% في LiveCodeBench (#2 من 5 نماذج)، وهو معيار مقاوم للتلوث يتم تحديثه باستمرار بمشاكل برمجة تنافسية جديدة. عند هذا المستوى، يتعامل مع هياكل البيانات المتقدمة، خوارزميات الرسم البياني، وتحديات مستوى المقابلات بموثوقية عالية.
المزيد للمقارنة
قارن جميع النماذج الـ 24 عبر 11 معياراً — قابلة للفرز، موثقة المصادر، ومُحدّثة حتى يونيو 2026.

Qwen 3.7-Plus هو نموذج ذكاء اصطناعي خاص من Alibaba، مصنف في المستوى المتقدم مع نافذة سياقية تبلغ 1 مليون رمز. وهو متاح مباشرة في FlowHunt. استكشف نتائج المعايير...

MiniMax M3 هو نموذج ذكاء اصطناعي مفتوح الأوزان من MiniMax (MoE (غير معلن))، مصنف ضمن المستوى الحدودي (Frontier) مع نافذة سياقية تبلغ مليون رمز (1M tokens). وهو ...

تقدم FlowHunt نماذج Qwen Image و Qwen Image Edit—أدوات ذكاء اصطناعي قوية لتوليد صور عالية الجودة تضاهي Gemini وقدرات تحرير متقدمة تضاهي Nano Banana....
الموافقة على ملفات تعريف الارتباط
نستخدم ملفات تعريف الارتباط لتعزيز تجربة التصفح وتحليل حركة المرور لدينا. See our privacy policy.