
Claude Opus 4.8 — المعايير، القدرات، وحالات الاستخدام
Claude Opus 4.8 هو نموذج ذكاء اصطناعي مملوك من Anthropic، مصنف ضمن الفئة الحدودية (Frontier) مع نافذة سياق تبلغ 1 مليون رمز. استعرض نتائج المعايير، نقاط القوة، ...
كلود أوبوس 4.6 هو نموذج ذكاء اصطناعي متطور من الفئة الأولى، طورته Anthropic وأُصدر في فبراير 2026. وهو نموذج مملوك ومغلق الأوزان، متاح عبر واجهة Anthropic API. نافذة السياق البالغة 1 مليون رمز كبيرة بما يكفي لاستيعاب قواعد بيانات برمجية كاملة، أو وثائق تقنية طويلة، أو جلسات وكيلية ممتدة دون اقتطاع.
في لوحة متصدرة FlowHunt للذكاء الاصطناعي، هو واحد من 24 نموذجًا يتم تتبعها، تم تقييمها عبر 6 معايير. النتائج البارزة: 69.2% في ARC-AGI-2 (#1 من 3)؛ 53.0% في HLE (#1 من 6)؛ 80.8% في SWE-bench Verified (#5 من 13).
أُصدر كلود أوبوس 4.6 في 5 فبراير 2026، وحظي باهتمام خاص لأدائه في مهام التفكير البصري الجديدة. يحمل أعلى نتيجة تم التحقق منها علنًا في ARC-AGI-2 بنسبة 69.17% — وهو معيار للتعرف على الأنماط البصرية المجردة تم التحقق منه بشكل مستقل من قبل مؤسسة جائزة ARC، ومصمم خصيصًا لمنع الحفظ. وضعت هذه النتيجة أوبوس 4.6 فوق خط الأساس البشري البالغ حوالي 60% في اختبار كافحت النماذج المتطورة السابقة لتجاوزه. كما حقق 91.3% في GPQA Diamond و53.0% في Humanity’s Last Exam، مما يجعله النموذج الرائد لمهام التفكير الصعبة في النصف الأول من عام 2026.
ملاحظة: SOTA ARC-AGI-2 69.17% (3P جائزة ARC). تصنيف أمان ASL-3.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 80.8% | 5 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 57.3% | 8 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 91.3% | 5 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 65.4% | 7 of 8 | SR | Agentic Linux terminal task completion |
| ARC-AGI-2 | 69.2% | 1 of 3 | 3P | Novel visual reasoning, no memorisation |
| HLE | 53.0% | 1 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
Anthropic هي شركة سلامة ذكاء اصطناعي تأسست في عام 2021 على يد باحثين سابقين في OpenAI وهما داريو أمودي ودانييلا أمودي، إلى جانب مجموعة من الزملاء الذين قادوا سابقًا فرق السلامة والسياسات في OpenAI. تتمثل المهمة المعلنة للشركة في التطوير المسؤول للذكاء الاصطناعي لتحقيق المنفعة طويلة الأجل للبشرية، ويُحدد جدول أعمالها البحثي بهذا الالتزام: الذكاء الاصطناعي الدستوري (CAI)، وهي تقنية لتدريب النماذج لتكون مفيدة وغير ضارة وصادقة من خلال النقد الذاتي؛ وقابلية التفسير الميكانيكي، التي تهدف إلى هندسة عكسية لما تحسبه الخلايا العصبية والدوائر الفردية داخل الشبكات الكبيرة؛ وعلم التوسع، الذي يحاول التنبؤ بكيفية تغير سلوك النموذج مع زيادة القدرة الحاسوبية والبيانات. تنشر Anthropic هذا البحث علنًا وأصبحت واحدة من أكثر مختبرات سلامة الذكاء الاصطناعي استشهادًا في الأدبيات الأكاديمية. Claude هو نموذج عائلة Anthropic العام — سُمي تيمنًا بـ Claude Shannon، مؤسس نظرية المعلومات — ويمتد عبر أربعة أجيال (1 حتى 4.x/Fable 5). تدير Anthropic واجهة برمجة تطبيقات تجارية ومنتج Claude.ai الموجه للمستهلكين، وتحافظ على شراكات سحابية عميقة مع AWS (Amazon Bedrock) و Google Cloud (Vertex AI).
حالات الاستخدام
يسجل كلود أوبوس 4.6 80% في SWE-bench Verified — مرتبة #5 من 13 نموذجًا متتبعًا هنا. يقوم بحل مشكلات GitHub الواقعية، ويكتب كودًا بجودة إنتاجية عبر لغات متعددة، ويتعامل مع سير عمل برمجية وكيلية متعددة الخطوات — وهو خيار قوي لفرق تطوير البرمجيات المدعومة بالذكاء الاصطناعي.
بنسبة 91% في GPQA Diamond (#5 من 14 نموذجًا)، يتجاوز كلود أوبوس 4.6 خط الأساس البشري البالغ ~65% في أسئلة البيولوجيا والكيمياء والفيزياء على مستوى الدراسات العليا. استخدمه لتوليف الأدبيات العلمية، وتقييم الفرضيات، والأسئلة والأجوبة الطبية والقانونية، ومهام البحث متعددة التخصصات حيث تكون المعرفة العميقة بالمجال مهمة.
يحقق كلود أوبوس 4.6 65% في Terminal-Bench (#7 من 8 نماذج)، مما يجعله كفؤًا في البرمجة النصية الشائعة للقشرة، وسير عمل سطر الأوامر، ومهام إدارة الأنظمة البسيطة داخل خطوط الأنابيب الوكيلية.
مع نافذة سياقية بسعة 1 مليون رمز، يمكن لكلود أوبوس 4.6 استيعاب مستودعات برمجية كاملة، وعقود قانونية طويلة، وتقارير بحثية بطول كتاب، أو تاريخ محادثات موسع في استعلام واحد — مما يتيح إجابة أسئلة عميقة عن المستندات، واستدلالًا عبر ملفات قواعد البيانات البرمجية، وتلخيصًا شاملاً دون الحاجة إلى تجزئة إرشادية أو خطوط RAG.
المزيد للمقارنة
قارن جميع النماذج الـ 24 عبر 11 معيارًا — قابلة للفرز، وموثقة المصادر، ومُحدَّثة حتى يونيو 2026.

Claude Opus 4.8 هو نموذج ذكاء اصطناعي مملوك من Anthropic، مصنف ضمن الفئة الحدودية (Frontier) مع نافذة سياق تبلغ 1 مليون رمز. استعرض نتائج المعايير، نقاط القوة، ...

Claude Opus 4.7 هو نموذج ذكاء اصطناعي خاص من Anthropic، مصنف ضمن المستوى الحدودي (Frontier) مع نافذة سياقية تبلغ 1 مليون رمز. استكشف نتائج المراجع، نقاط القوة، ...

Claude Sonnet 4.6 هو نموذج ذكاء اصطناعي مملوك لشركة Anthropic، مصنف ضمن الفئة المتقدمة مع نافذة سياقية تبلغ 1M رمز. وهو متاح مباشرة في FlowHunt. استكشف نتائج ال...
الموافقة على ملفات تعريف الارتباط
نستخدم ملفات تعريف الارتباط لتعزيز تجربة التصفح وتحليل حركة المرور لدينا. See our privacy policy.