Anthropic logo

Anthropic

Claude Opus 4.8

Frontier

Claude Opus 4.8 は、Anthropicが開発し2026年5月にリリースされた、最上位のフロンティアAIモデルです。プロプライエタリなクローズドウェイトモデルであり、Anthropic APIを通じて利用可能です。100万トークンのコンテキストウィンドウは、コードベース全体、長大な技術文書、または拡張されたエージェントセッションを切り詰めることなく保持できる十分な大きさです。

FlowHunt AIリーダーボードでは、5つのベンチマークで評価された24の追跡モデルのうちの1つです。注目スコア:AA Intelligence Indexで61.4 pts(9モデル中1位)、SWE-bench Proで69.2%(9モデル中2位)、Terminal-Benchで74.6%(8モデル中2位)。

Claude Opus 4.8 は2026年5月28日に、Opus 4.7の上に焦点を当てたポイントリリースとしてリリースされ、Anthropicはこれを「同じ価格での控えめながら確かなアップグレード」と表現しました。このリリースは急速なペースに続くもので、Opus 4.6、4.7、4.8はすべて同じ四半期内に出荷され、Anthropicが継続的な段階的デリバリーへのシフトを反映しています。控えめなベンチマークの改善にもかかわらず、Opus 4.8 はArtificial Analysis Intelligence Indexで61.4ポイントのトップポジションを獲得しました——これはリリース時点での最高の独立複合スコアであり——独立した第三者測定による最もバランスの取れたフロンティアモデルとなりました。その2週間後には、純粋なコーディングタスクでClaude Fable 5に抜かれることになります。

注:同じ価格で4.7からの控えめながら確かなアップグレード。AA Intelligence Indexで61.4ポイントの1位。

リリース日
2026年5月
コンテキスト
100万トークン
重み
非公開
フロンティア
プロバイダー
Anthropic

Claude Opus 4.8 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.6%3 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro69.2%2 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%3 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench74.6%2 of 8SRAgentic Linux terminal task completion
AA Intelligence Index61.4 pts1 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.6%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
69.2%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
74.6%
Agentic Linux terminal task completion
AA Idx AA
61.4 pts
Artificial Analysis composite score (independent)

Claude Opus 4.8 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkClaude Opus 4.8GPT-5.5GPT-5.4
SWE-V88.6%88.7%
SWE-Pro69.2%58.6%59.1%
GPQA ◇93.6%93.6%
Terminal74.6%82.7%
AA Idx61.4 pts60.2 pts

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropicは、2021年にOpenAIの元研究者であるDario Amodei氏とDaniela Amodei氏、ならびにOpenAIの安全性およびポリシーチームを率いていた同僚らのグループによって設立されたAI安全企業です。同社の掲げる使命は、人類の長期的利益のために責任あるAIを開発することであり、その研究課題は以下の取り組みによって定義されています:自己批判を通じてモデルが有用で無害かつ正直であるよう訓練する手法であるConstitutional AI(CAI);大規模ネットワーク内の個々のニューロンや回路が実際に何を計算しているかをリバースエンジニアリングすることを目的とするメカニズム的解釈可能性;そして、計算量やデータによってモデルの振る舞いがどのように変化するかを予測しようとするスケーリング科学です。Anthropicはこれらの研究をオープンに公開しており、学術文献において最も引用されるAI安全研究所の一つとなっています。ClaudeはAnthropicの公開モデルファミリーであり、情報理論の創始者であるClaude Shannonにちなんで名付けられ、第1世代から第4世代/Fable 5までの4世代にわたります。Anthropicは商用APIと消費者向けClaude.ai製品を運営し、AWS(Amazon Bedrock)およびGoogle Cloud(Vertex AI)との強固なクラウドパートナーシップを維持しています。

ユースケース

Claude Opus 4.8の活用シーン

ソフトウェアエンジニアリング
科学的・技術的推論
エージェンティックCLI自動化
長文書・コードベース分析

Strengths & Limitations

Strengths

  • 強力なソフトウェアエンジニアリング — SWE-bench Verified 88%
  • 大学院レベルの科学的推論 — GPQA Diamond 93%
  • エージェンティックLinux/CLI自動化 — Terminal-Bench 74%
  • 複合インテリジェンス — AA Intelligence Index 61 pts(独立検証)
  • 非常に長い文書と大規模コードベース(100万コンテキスト)

Limitations

  • クローズドウェイト — セルフホスティングやプライベートデータでのファインチューニングは不可

完全なAIモデルリーダーボードを見る

よくある質問

詳しく見る

Claude Opus 4.7 — ベンチマーク、機能、ユースケース
Claude Opus 4.7 — ベンチマーク、機能、ユースケース

Claude Opus 4.7 — ベンチマーク、機能、ユースケース

Claude Opus 4.7はAnthropicが開発したプロプライエタリAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。ベンチマークスコア、強み、推奨ユースケースをご覧ください。...

2 分で読める
Claude Opus 4.6 — ベンチマーク、機能、およびユースケース
Claude Opus 4.6 — ベンチマーク、機能、およびユースケース

Claude Opus 4.6 — ベンチマーク、機能、およびユースケース

Claude Opus 4.6は、Anthropicが開発したプロプライエタリAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

2 分で読める
Claude Fable 5 — ベンチマーク、能力、ユースケース
Claude Fable 5 — ベンチマーク、能力、ユースケース

Claude Fable 5 — ベンチマーク、能力、ユースケース

Claude Fable 5はAnthropicが開発した独自AIモデルで、100万トークンのコンテキストウィンドウを備えたスーパーフロンティア層に分類されます。ベンチマークスコア、強み、推奨ユースケースをご紹介します。...

1 分で読める