Anthropic logo

Anthropic

Claude Fable 5

Super-Frontier

Claude Fable 5 是本排行榜中评分最高的 AI 模型,超越所有标准前沿模型,由 Anthropic 开发并于 2026 年 6 月发布。这是一款专有闭源权重模型,通过 Anthropic API 提供。100 万 token 的上下文窗口足以容纳整个代码库、长篇技术文档或长时间的智能代理会话而无需截断。

在 FlowHunt AI 排行榜上,它是 24 个追踪模型之一,在 2 项基准测试上进行了评估。突出得分:SWE-bench Verified 95.0%(13 个模型中排名第 1);SWE-bench Pro 80.3%(9 个模型中排名第 1)。

Claude Fable 5 于 2026 年 6 月 9 日发布,是 Anthropic 全新 Mythos 级层级的首个模型——其能力水平超越现有的 Opus 系列。“Fable"这一名称延续了 Anthropic 的文学命名惯例(Opus、Sonnet、Haiku),同时标志着一次重大的架构革新。Fable 5 是 Anthropic 内部 Mythos 5 研究模型的生产部署版本,附加了企业级安全性和可靠性约束。发布时,它在 SWE-bench Verified 上取得了 95% 的成绩,在 SWE-bench Pro 上取得了 80.3% 的成绩——两项基准测试均创下历史最高纪录——使其成为第一个能够在无需人工引导的情况下自主解决大多数真实 GitHub 问题的模型。

注:Opus 之上的全新 Mythos 级层级。与 Mythos 5 共享相同基础架构,但增加了生产级安全防护。

发布日期
2026年6月
上下文窗口
100万 token
权重
闭源
层级
超级前沿
提供商
Anthropic

Claude Fable 5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified95.0%1 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro80.3%1 of 9SRMulti-language, standardised scaffold

Detailed Benchmark Scores

SWE-V SR
95.0%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
80.3%
Multi-language, standardised scaffold

About Anthropic

Anthropic Founded 2021 · San Francisco, CA
Website →

Anthropic 是一家AI安全公司,由前OpenAI研究员Dario Amodei和Daniela Amodei,以及一群曾领导OpenAI安全和政策团队的同事于2021年共同创立。该公司的既定使命是负责任地开发AI,以实现人类长期利益,其研究议程也围绕这一承诺展开:宪政AI(CAI)——一种通过自我批判训练模型成为有用、无害且诚实的模型的技术;机械可解释性——旨在逆向工程大型网络中单个神经元和电路实际计算的内容;以及规模化科学——试图预测模型行为如何随算力和数据变化而变化。Anthropic公开了这些研究成果,并已成为学术文献中被引用最多的AI安全实验室之一。Claude是Anthropic的公开模型系列——以信息论创始人Claude Shannon命名——涵盖四代(1至4.x/Fable 5)。Anthropic运营商业API和面向消费者的Claude.ai产品,并与AWS(Amazon Bedrock)和Google Cloud(Vertex AI)保持着深度云合作伙伴关系。

应用场景

Claude Fable 5 的推荐用途

软件工程
长文档与代码库分析

Strengths & Limitations

Strengths

  • 卓越的真实编码能力——SWE-bench Verified 95%
  • 超长文档与大型代码库处理(100万上下文)

Limitations

  • 闭源权重——无法自行托管或在私有数据上进行微调

浏览完整 AI 模型排行榜

常见问题

了解更多

Claude Opus 4.8 — 基准测试、能力与用例
Claude Opus 4.8 — 基准测试、能力与用例

Claude Opus 4.8 — 基准测试、能力与用例

Claude Opus 4.8 是 Anthropic 专有 AI 模型,属于 Frontier 层级,拥有 100 万 token 上下文窗口。探索其基准分数、优势及推荐用例。...

3 分钟阅读
Claude Opus 4.6 — 基准测试、能力与使用场景
Claude Opus 4.6 — 基准测试、能力与使用场景

Claude Opus 4.6 — 基准测试、能力与使用场景

Claude Opus 4.6 是 Anthropic 开发的专有 AI 模型,属于 Frontier 层级,拥有 100 万 token 的上下文窗口。该模型可直接在 FlowHunt 中使用。了解其基准测试分数、优势及推荐使用场景。...

3 分钟阅读
Claude Opus 4.7 — 基准测试、能力与应用场景
Claude Opus 4.7 — 基准测试、能力与应用场景

Claude Opus 4.7 — 基准测试、能力与应用场景

Claude Opus 4.7 是 Anthropic 开发的专有 AI 模型,属于 Frontier 级别,拥有 100 万 token 的上下文窗口。了解其基准测试分数、优势及推荐应用场景。...

2 分钟阅读