OpenAI logo

OpenAI

GPT-5

FrontierAvailable in FlowHunt

GPT-5 是 OpenAI 开发的顶级前沿 AI 模型,于 2025 年 8 月发布。它是一款专有封闭权重模型,可通过 OpenAI API 使用。它支持 40 万 Token 的上下文窗口,足以满足大多数文档和多轮对话应用的需求。

在 FlowHunt AI 排行榜上,它是 24 个追踪模型之一,已在 2 项基准测试上进行了评估。突出分数:GPQA Diamond 88.4%(14 个模型中排名第 7);SWE-bench Verified 74.9%(13 个模型中排名第 10)。

GPT-5 于 2025 年 8 月 7 日发布,是 OpenAI 首个在多项高难度推理基准测试上自我报告超过人类性能的模型。它是首个在推理层面将文本、图像和音频输入作为统一能力(而非通过专门模型流水线)进行整合的 GPT 模型。GPT-5 奠定了当前前沿层级的基础:其 40 万 Token 上下文窗口在发布时是 OpenAI 提供的最长长度;其相对于 GPT-4o 的编码能力提升足以替代大量基于 Codex 和 GPT-4o 的开发工具。此次发布推动了自 ChatGPT 2022 年首次亮相以来 GPT API 采用率的最快增长。

注:统一模型取代 GPT-4o、o3、o4-mini、GPT-4.1。AIME 2025:94.6%。

发布时间
2025 年 8 月
上下文窗口
40 万 Token
权重
封闭
层级
Frontier
提供商
OpenAI

GPT-5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified74.9%10 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond88.4%7 of 14SRGraduate-level Google-proof science Q&A

Detailed Benchmark Scores

SWE-V SR
74.9%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
88.4%
Graduate-level Google-proof science Q&A

GPT-5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5Claude Opus 4.8Claude Opus 4.7
SWE-V74.9%88.6%87.6%
GPQA ◇88.4%93.6%94.2%

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI于2015年12月由Sam Altman、Elon Musk、Greg Brockman、Ilya Sutskever、John Schulman和Wojciech Zaremba共同创立,最初是一家非营利性AI研究实验室,其使命是开发造福全人类的人工通用智能(AGI)。2019年,它创建了利润上限子公司OpenAI LP,以筹集机构资本并扩大模型训练规模。该公司以GPT系列语言模型(GPT-1至GPT-5.5)、DALL-E图像生成系列、Whisper语音识别和Sora视频生成而闻名。OpenAI运营ChatGPT消费者应用程序、开发者API,并通过Microsoft Azure提供企业服务。截至2026年,它与微软保持着密切的战略合作伙伴关系,微软是该公司最大的投资者和云服务提供商。

应用场景

GPT-5 适合做什么

软件工程
科学与技术推理

Strengths & Limitations

Strengths

  • 扎实的编码辅助能力——SWE-bench Verified 74%
  • 高级科学问答能力——GPQA Diamond 88%
  • 长上下文任务处理(40 万 Token 上下文窗口)

Limitations

  • 封闭权重——无法自行部署或在私有数据上进行微调

浏览完整 AI 模型排行榜

常见问题

了解更多

GPT-5.5 — 基准测试、能力与使用场景
GPT-5.5 — 基准测试、能力与使用场景

GPT-5.5 — 基准测试、能力与使用场景

GPT-5.5 是 OpenAI 专有 AI 模型,属于 Frontier 层级,拥有 100 万 token 的上下文窗口。可直接在 FlowHunt 中使用。探索基准测试分数、优势与推荐使用场景。...

3 分钟阅读
ChatGPT-5:你需要了解的 OpenAI 突破性 AI 模型
ChatGPT-5:你需要了解的 OpenAI 突破性 AI 模型

ChatGPT-5:你需要了解的 OpenAI 突破性 AI 模型

深入探索 ChatGPT-5 的突破性进展、应用场景、基准测试、安全性、定价及未来发展方向,尽在 FlowHunt 权威指南。

2 分钟阅读
chatgpt 5 gpt-5 +1