OpenAI logo

OpenAI

GPT-5

FrontierAvailable in FlowHunt

GPT-5は、OpenAIが開発し2025年8月にリリースされた、最高水準のフロンティアAIモデルです。プロプライエタリなクローズドウェイトモデルであり、OpenAI APIを通じて利用可能です。400Kトークンのコンテキストウィンドウをサポートし、ほとんどのドキュメントやマルチターンアプリケーションに十分対応できます。

FlowHunt AIリーダーボードでは、追跡中の24モデルのうちの1つとして、2つのベンチマークで評価されています。主なスコア:GPQA Diamond 88.4%(14モデル中7位)、SWE-bench Verified 74.9%(13モデル中10位)。

GPT-5は2025年8月7日にリリースされ、OpenAI初の、複数のハードな推論ベンチマークで人間以上のパフォーマンスを自己報告したモデルとなりました。テキスト、画像、音声入力を、専門モデルのパイプラインではなく推論レベルで統合された機能として統合した初のGPTモデルです。GPT-5は現在のフロンティア層の基盤を築きました。その400Kコンテキストウィンドウは、リリース時点でOpenAIが提供する最長のものでした。GPT-4oからのコーディング性能の向上は、CodexベースおよびGPT-4oベースの開発ツールの大部分を置き換えるほど顕著でした。このローンチにより、2022年のChatGPTデビュー以来最速のGPT API採用加速がもたらされました。

注記:GPT-4o、o3、o4-mini、GPT-4.1を統合した統一モデル。AIME 2025:94.6%。

リリース日
2025年8月
コンテキスト
400Kトークン
重み
クローズド
フロンティア
プロバイダー
OpenAI

GPT-5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified74.9%10 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond88.4%7 of 14SRGraduate-level Google-proof science Q&A

Detailed Benchmark Scores

SWE-V SR
74.9%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
88.4%
Graduate-level Google-proof science Q&A

GPT-5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5Claude Opus 4.8Claude Opus 4.7
SWE-V74.9%88.6%87.6%
GPQA ◇88.4%93.6%94.2%

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAIは、2015年12月にSam Altman氏、Elon Musk氏、Greg Brockman氏、Ilya Sutskever氏、John Schulman氏、Wojciech Zaremba氏によって非営利AI研究機関として設立され、全人類に利益をもたらす人工汎用知能(AGI)の開発を使命としています。2019年には利益上限付き子会社OpenAI LPを設立し、機関投資家からの資金調達とモデルトレーニングの大規模化を実現しました。同社はGPTシリーズの言語モデル(GPT-1からGPT-5.5)、DALL-E画像生成シリーズ、Whisper音声認識、Sora動画生成で知られています。OpenAIは消費者向けアプリケーションChatGPT、開発者向けAPI、およびMicrosoft Azureを通じたエンタープライズサービスを運営しています。2026年現在、同社は最大の投資家兼クラウドプロバイダーであるMicrosoftとの緊密な戦略的パートナーシップを維持しています。

ユースケース

GPT-5の活用シーン

ソフトウェアエンジニアリング
科学・技術的推論

Strengths & Limitations

Strengths

  • 堅実なコーディング支援 — SWE-bench Verified 74%
  • 高度な科学的Q&A — GPQA Diamond 88%
  • 長文コンテキストタスク(400Kコンテキストウィンドウ)

Limitations

  • クローズドウェイト — セルフホスティングやプライベートデータでのファインチューニング不可

AIモデルリーダーボードをすべて見る

よくある質問

詳しく見る

GPT-5.5 — ベンチマーク、機能、活用事例
GPT-5.5 — ベンチマーク、機能、活用事例

GPT-5.5 — ベンチマーク、機能、活用事例

GPT-5.5はOpenAIが開発したプロプライエタリなAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

2 分で読める
ChatGPT-5:OpenAIの画期的AIモデルのすべて
ChatGPT-5:OpenAIの画期的AIモデルのすべて

ChatGPT-5:OpenAIの画期的AIモデルのすべて

ChatGPT-5の革新的な進歩、ユースケース、ベンチマーク、セキュリティ、価格、今後の展望を網羅したFlowHuntの決定版ガイド。...

1 分で読める
chatgpt 5 gpt-5 +1