شعار Alibaba

Alibaba

Qwen 3.7-Max

FrontierAvailable in FlowHunt

Qwen 3.7-Max هو نموذج ذكاء اصطناعي حدودي من الطراز الأول، طورته Alibaba وتم إصداره في مايو 2026. وهو نموذج خاص مغلق الأوزان، متاح عبر واجهة Alibaba API. النافذة السياقية التي تبلغ مليون رمز كبيرة بما يكفي لاحتواء قواعد بيانات برمجية كاملة، وثائق تقنية مطولة، أو جلسات وكيلية ممتدة دون اقتطاع.

على لوحة متصدرة الذكاء الاصطناعي من FlowHunt، هو واحد من 24 نموذجاً متتبعاً، تم تقييمه عبر 8 معايير. نتائج بارزة: 89.6% في MMLU-Pro (#1 من 8)؛ 91.6% في LiveCodeBench (#2 من 5)؛ 41.4% في HLE (#2 من 6).

تم إصدار Qwen 3.7-Max في 20 مايو 2026 كأفضل نموذج في الجيل الثالث من سلسلة Qwen من Alibaba، حيث قدمت Alibaba ما أسمته ‘وضع التفكير’ — قدرة استدلال ممتدة لسلسلة الأفكار يمكن تشغيلها لكل استعلام. في وضع التفكير، يقوم النموذج بخطوة مداولة داخلية قبل إنتاج إجابته النهائية، مما يحسن الأداء بشكل كبير في مهام الاستدلال متعددة الخطوات. عند الإطلاق، سجل Qwen 3.7-Max 92.4% في GPQA Diamond (ثالث عالمياً)، و91.6% في LiveCodeBench، و60.6% في SWE-bench Pro — أعلى درجة لواجهة API مفتوحة في ذلك المعيار. إلى جانب نافذة سياقية بحجم مليون رمز وتسعير API تنافسي، أثبت نفسه كبديل حدودي أساسي للفرق المؤسسية المهتمة بالتكلفة.

ملاحظة: رائد GPQA Diamond (92.4%). رائد SWE-Pro (60.6%). مؤشر AA 56.6.

تاريخ الإصدار
مايو 2026
السياق
1M رمز
الأوزان
مغلقة
الطبقة
حدودية (Frontier)
المزود
Alibaba

Qwen 3.7-Max Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.4%7 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro60.6%4 of 9SRMulti-language, standardised scaffold
GPQA Diamond92.4%4 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro89.6%1 of 8SRHard knowledge reasoning, 12K questions
LiveCodeBench91.6%2 of 5SRCompetitive programming, continuously updated
Terminal-Bench69.7%3 of 8SRAgentic Linux terminal task completion
HLE41.4%2 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index56.6 pts4 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
80.4%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
60.6%
Multi-language, standardised scaffold
GPQA ◇ SR
92.4%
Graduate-level Google-proof science Q&A
MMLU-P SR
89.6%
Hard knowledge reasoning, 12K questions
LiveCode SR
91.6%
Competitive programming, continuously updated
Terminal SR
69.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
56.6 pts
Artificial Analysis composite score (independent)

Qwen 3.7-Max vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkQwen 3.7-MaxClaude Opus 4.8Claude Opus 4.7
SWE-V80.4%88.6%87.6%
SWE-Pro60.6%69.2%64.3%
GPQA ◇92.4%93.6%94.2%
MMLU-P89.6%
LiveCode91.6%
Terminal69.7%74.6%66.1%
HLE41.4%
AA Idx56.6 pts61.4 pts57.3 pts

About Alibaba

Alibaba Founded 1999 · Hangzhou, China
Website →

مجموعة Alibaba هي واحدة من أكبر وأكثر تكتلات التكنولوجيا تنوعًا في الصين، تأسست في عام 1999 على يد جاك ما ويقع مقرها الرئيسي في هانغتشو. من خلال أكاديمية DAMO ومختبر Tongyi، أصبحت Alibaba قوة رئيسية في تطوير نماذج اللغة الكبيرة من خلال عائلة Qwen (Tongyi Qianwen). يمثل الجيل Qwen 3.7، الذي صدر في منتصف عام 2026، انتقال Alibaba من النشر المحلي إلى المنافسة على المعايير الدولية، حيث سجل Qwen 3.7-Max نسبة 92.4% على GPQA Diamond و 91.6% على LiveCodeBench. تتميز استراتيجية Alibaba للذكاء الاصطناعي بإصدارات مفتوحة الأوزان كموازنة للنماذج الأمريكية التي تعمل بواجهة برمجة تطبيقات فقط، ودمج الذكاء الاصطناعي التوليدي عبر أعمالها السحابية والتجارة الإلكترونية، والاستثمار الكبير في البنية التحتية للذكاء الاصطناعي عبر قسم Alibaba Cloud.

حالات الاستخدام

لما يستخدم Qwen 3.7-Max

هندسة البرمجيات
الاستدلال العلمي والتقني
الأتمتة الوكيلية لواجهة الأوامر
تحليل المستندات الطويلة وقواعد البيانات البرمجية
البرمجة التنافسية

Strengths & Limitations

Strengths

  • هندسة برمجيات قوية — 80% SWE-bench Verified
  • استدلال علمي على مستوى الدراسات العليا — 92% GPQA Diamond
  • برمجة تنافسية — 91% LiveCodeBench
  • ذكاء مركب — 56 نقطة AA Intelligence Index (مستقل)
  • مستندات طويلة جداً وقواعد بيانات برمجية كبيرة (سياق 1M)

Limitations

  • أوزان مغلقة — لا يمكن استضافته ذاتياً أو ضبطه بدقة على بيانات خاصة

تصفح لوحة متصدرة نماذج الذكاء الاصطناعي الكاملة

الأسئلة الشائعة

اعرف المزيد

Qwen 3.7-Plus — المعايير، الإمكانيات، وحالات الاستخدام
Qwen 3.7-Plus — المعايير، الإمكانيات، وحالات الاستخدام

Qwen 3.7-Plus — المعايير، الإمكانيات، وحالات الاستخدام

Qwen 3.7-Plus هو نموذج ذكاء اصطناعي خاص من Alibaba، مصنف في المستوى المتقدم مع نافذة سياقية تبلغ 1 مليون رمز. وهو متاح مباشرة في FlowHunt. استكشف نتائج المعايير...

3 دقيقة قراءة
MiniMax M3 — المعايير، القدرات، وحالات الاستخدام
MiniMax M3 — المعايير، القدرات، وحالات الاستخدام

MiniMax M3 — المعايير، القدرات، وحالات الاستخدام

MiniMax M3 هو نموذج ذكاء اصطناعي مفتوح الأوزان من MiniMax (MoE (غير معلن))، مصنف ضمن المستوى الحدودي (Frontier) مع نافذة سياقية تبلغ مليون رمز (1M tokens). وهو ...

4 دقيقة قراءة
كيف تنشئ صوراً مذهلة باستخدام نماذج كوين للذكاء الاصطناعي؟
كيف تنشئ صوراً مذهلة باستخدام نماذج كوين للذكاء الاصطناعي؟

كيف تنشئ صوراً مذهلة باستخدام نماذج كوين للذكاء الاصطناعي؟

تقدم FlowHunt نماذج Qwen Image و Qwen Image Edit—أدوات ذكاء اصطناعي قوية لتوليد صور عالية الجودة تضاهي Gemini وقدرات تحرير متقدمة تضاهي Nano Banana....

7 دقيقة قراءة
AI Image Generation +5