
Claude Opus 4.8 — ベンチマーク、機能、ユースケース
Claude Opus 4.8 は、Anthropicが開発したプロプライエタリなAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...
Claude Fable 5は、このリーダーボードにおいてすべての標準的なフロンティアモデルを上回る最高評価のAIモデルであり、Anthropicによって開発され、2026年6月にリリースされました。独自のクローズドウェイトモデルであり、Anthropic APIを通じて利用可能です。100万トークンのコンテキストウィンドウは、コードベース全体、長大な技術文書、または長時間のエージェントセッションをトランケーションなしで保持するのに十分な大きさです。
FlowHunt AIリーダーボードでは、2つのベンチマークで評価された24の追跡モデルのうちの1つです。注目スコア:SWE-bench Verifiedで95.0%(13モデル中1位)、SWE-bench Proで80.3%(9モデル中1位)。
Claude Fable 5は2026年6月9日に、Anthropicの新しいMythosクラス層(既存のOpusラインを超える能力レベル)の最初のモデルとしてリリースされました。「Fable」という名称はAnthropicの文学的な命名慣例(Opus、Sonnet、Haiku)を継承しつつ、重要なアーキテクチャ上の転換を示しています。Fable 5は、Anthropicの内部研究モデルMythos 5をプロダクション展開したもので、エンタープライズグレードの安全性と信頼性の制約が適用されています。リリース時点でSWE-bench Verifiedで95%、SWE-bench Proで80.3%を記録し、両ベンチマークで過去最高のスコアを達成。人間のガイダンスなしで実際のGitHub課題の大半を自律的にクローズできる初めてのモデルとして確立されました。
注:Opusより上位の新Mythosクラス層。プロダクションセーフガードを適用したMythos 5と同じベースモデル。
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 95.0% | 1 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 80.3% | 1 of 9 | SR | Multi-language, standardised scaffold |
Anthropicは、2021年にOpenAIの元研究者であるDario Amodei氏とDaniela Amodei氏、ならびにOpenAIの安全性およびポリシーチームを率いていた同僚らのグループによって設立されたAI安全企業です。同社の掲げる使命は、人類の長期的利益のために責任あるAIを開発することであり、その研究課題は以下の取り組みによって定義されています:自己批判を通じてモデルが有用で無害かつ正直であるよう訓練する手法であるConstitutional AI(CAI);大規模ネットワーク内の個々のニューロンや回路が実際に何を計算しているかをリバースエンジニアリングすることを目的とするメカニズム的解釈可能性;そして、計算量やデータによってモデルの振る舞いがどのように変化するかを予測しようとするスケーリング科学です。Anthropicはこれらの研究をオープンに公開しており、学術文献において最も引用されるAI安全研究所の一つとなっています。ClaudeはAnthropicの公開モデルファミリーであり、情報理論の創始者であるClaude Shannonにちなんで名付けられ、第1世代から第4世代/Fable 5までの4世代にわたります。Anthropicは商用APIと消費者向けClaude.ai製品を運営し、AWS(Amazon Bedrock)およびGoogle Cloud(Vertex AI)との強固なクラウドパートナーシップを維持しています。
ユースケース
Claude Fable 5はSWE-bench Verifiedで95%を達成 — ここで追跡されている13モデル中1位です。このベンチマークは500件の人間検証済み実際のGitHub課題を使用しています。モデルはリポジトリを読み込み、失敗するテストを理解し、合格するパッチを生成します。このレベルでは、複雑なチケットを自律的にクローズし、複数ファイルにまたがるリファクタリングを実行し、実際の開発ワークフロー内でエージェンティックコーディングアシスタントとして機能します。
100万トークンのコンテキストウィンドウにより、Claude Fable 5はソフトウェアリポジトリ全体、長大な法的契約書、書籍サイズの調査レポート、または広範な会話履歴を単一のプロンプトで取り込むことができます。これにより、チャンキングヒューリスティックやRAGパイプラインを必要とせず、深い文書Q&A、ファイル横断的なコード分析、包括的な要約が可能になります。
比較情報

Claude Opus 4.8 は、Anthropicが開発したプロプライエタリなAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

Claude Opus 4.6は、Anthropicが開発したプロプライエタリAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

Claude Haiku 4.5は、Anthropicが開発したプロプライエタリAIモデルで、エフィシエント層に分類され、200Kトークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...