Anthropic logo

Anthropic

Claude Opus 4.6

FrontierAvailable in FlowHunt

كلود أوبوس 4.6 هو نموذج ذكاء اصطناعي متطور من الفئة الأولى، طورته Anthropic وأُصدر في فبراير 2026. وهو نموذج مملوك ومغلق الأوزان، متاح عبر واجهة Anthropic API. نافذة السياق البالغة 1 مليون رمز كبيرة بما يكفي لاستيعاب قواعد بيانات برمجية كاملة، أو وثائق تقنية طويلة، أو جلسات وكيلية ممتدة دون اقتطاع.

في لوحة متصدرة FlowHunt للذكاء الاصطناعي، هو واحد من 24 نموذجًا يتم تتبعها، تم تقييمها عبر 6 معايير. النتائج البارزة: 69.2% في ARC-AGI-2 (#1 من 3)؛ 53.0% في HLE (#1 من 6)؛ 80.8% في SWE-bench Verified (#5 من 13).

أُصدر كلود أوبوس 4.6 في 5 فبراير 2026، وحظي باهتمام خاص لأدائه في مهام التفكير البصري الجديدة. يحمل أعلى نتيجة تم التحقق منها علنًا في ARC-AGI-2 بنسبة 69.17% — وهو معيار للتعرف على الأنماط البصرية المجردة تم التحقق منه بشكل مستقل من قبل مؤسسة جائزة ARC، ومصمم خصيصًا لمنع الحفظ. وضعت هذه النتيجة أوبوس 4.6 فوق خط الأساس البشري البالغ حوالي 60% في اختبار كافحت النماذج المتطورة السابقة لتجاوزه. كما حقق 91.3% في GPQA Diamond و53.0% في Humanity’s Last Exam، مما يجعله النموذج الرائد لمهام التفكير الصعبة في النصف الأول من عام 2026.

ملاحظة: SOTA ARC-AGI-2 69.17% (3P جائزة ARC). تصنيف أمان ASL-3.

تاريخ الإصدار
فبراير 2026
السياق
1 مليون رمز
الأوزان
مغلقة
المستوى
متقدم (Frontier)
المزود
Anthropic

Claude Opus 4.6 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified80.8%5 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro57.3%8 of 9SRMulti-language, standardised scaffold
GPQA Diamond91.3%5 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench65.4%7 of 8SRAgentic Linux terminal task completion
ARC-AGI-269.2%1 of 33PNovel visual reasoning, no memorisation
HLE53.0%1 of 6SRHumanity's Last Exam (50+ STEM disciplines)

Detailed Benchmark Scores

SWE-V SR
80.8%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
57.3%
Multi-language, standardised scaffold
GPQA ◇ SR
91.3%
Graduate-level Google-proof science Q&A
Terminal SR
65.4%
Agentic Linux terminal task completion
ARC-2 3P
69.2%
Novel visual reasoning, no memorisation
HLE SR
53.0%
Humanity's Last Exam (50+ STEM disciplines)

Claude Opus 4.6 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.6GPT-5.5GPT-5.4
SWE-V80.8%88.7%
SWE-Pro57.3%58.6%59.1%
GPQA ◇91.3%93.6%
Terminal65.4%82.7%
ARC-269.2%
HLE53.0%41.4%

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic هي شركة سلامة ذكاء اصطناعي تأسست في عام 2021 على يد باحثين سابقين في OpenAI وهما داريو أمودي ودانييلا أمودي، إلى جانب مجموعة من الزملاء الذين قادوا سابقًا فرق السلامة والسياسات في OpenAI. تتمثل المهمة المعلنة للشركة في التطوير المسؤول للذكاء الاصطناعي لتحقيق المنفعة طويلة الأجل للبشرية، ويُحدد جدول أعمالها البحثي بهذا الالتزام: الذكاء الاصطناعي الدستوري (CAI)، وهي تقنية لتدريب النماذج لتكون مفيدة وغير ضارة وصادقة من خلال النقد الذاتي؛ وقابلية التفسير الميكانيكي، التي تهدف إلى هندسة عكسية لما تحسبه الخلايا العصبية والدوائر الفردية داخل الشبكات الكبيرة؛ وعلم التوسع، الذي يحاول التنبؤ بكيفية تغير سلوك النموذج مع زيادة القدرة الحاسوبية والبيانات. تنشر Anthropic هذا البحث علنًا وأصبحت واحدة من أكثر مختبرات سلامة الذكاء الاصطناعي استشهادًا في الأدبيات الأكاديمية. Claude هو نموذج عائلة Anthropic العام — سُمي تيمنًا بـ Claude Shannon، مؤسس نظرية المعلومات — ويمتد عبر أربعة أجيال (1 حتى 4.x/Fable 5). تدير Anthropic واجهة برمجة تطبيقات تجارية ومنتج Claude.ai الموجه للمستهلكين، وتحافظ على شراكات سحابية عميقة مع AWS (Amazon Bedrock) و Google Cloud (Vertex AI).

حالات الاستخدام

فيما يستخدم كلود أوبوس 4.6

هندسة البرمجيات
التفكير العلمي والتقني
أتمتة سطر الأوامر الوكيلية
تحليل المستندات الطويلة وقواعد البيانات البرمجية

Strengths & Limitations

Strengths

  • هندسة برمجيات قوية — 80% SWE-bench Verified
  • تفكير علمي بمستوى الدراسات العليا — 91% GPQA Diamond
  • تفكير بصري مبتكر — 69% ARC-AGI-2 (تم التحقق منه بشكل مستقل)
  • مستندات طويلة جدًا وقواعد بيانات برمجية كبيرة (سياق 1 مليون)

Limitations

  • أوزان مغلقة — لا يمكن استضافته ذاتيًا أو ضبطه بدقة على بيانات خاصة

تصفح لوحة متصدرة نماذج الذكاء الاصطناعي الكاملة

الأسئلة الشائعة

اعرف المزيد

Claude Opus 4.8 — المعايير، القدرات، وحالات الاستخدام
Claude Opus 4.8 — المعايير، القدرات، وحالات الاستخدام

Claude Opus 4.8 — المعايير، القدرات، وحالات الاستخدام

Claude Opus 4.8 هو نموذج ذكاء اصطناعي مملوك من Anthropic، مصنف ضمن الفئة الحدودية (Frontier) مع نافذة سياق تبلغ 1 مليون رمز. استعرض نتائج المعايير، نقاط القوة، ...

5 دقيقة قراءة
Claude Opus 4.7 — المراجع، القدرات، وحالات الاستخدام
Claude Opus 4.7 — المراجع، القدرات، وحالات الاستخدام

Claude Opus 4.7 — المراجع، القدرات، وحالات الاستخدام

Claude Opus 4.7 هو نموذج ذكاء اصطناعي خاص من Anthropic، مصنف ضمن المستوى الحدودي (Frontier) مع نافذة سياقية تبلغ 1 مليون رمز. استكشف نتائج المراجع، نقاط القوة، ...

5 دقيقة قراءة
Claude Sonnet 4.6 — المعايير، والقدرات، وحالات الاستخدام
Claude Sonnet 4.6 — المعايير، والقدرات، وحالات الاستخدام

Claude Sonnet 4.6 — المعايير، والقدرات، وحالات الاستخدام

Claude Sonnet 4.6 هو نموذج ذكاء اصطناعي مملوك لشركة Anthropic، مصنف ضمن الفئة المتقدمة مع نافذة سياقية تبلغ 1M رمز. وهو متاح مباشرة في FlowHunt. استكشف نتائج ال...

4 دقيقة قراءة