OpenAI logo

OpenAI

GPT-4o

EstablishedAvailable in FlowHunt

GPT-4oは、OpenAIが開発し2024年5月にリリースされた、実績のあるAIモデルで、現在も多くの本番システムで広く利用されています。これはプロプライエタリなクローズドウェイトモデルであり、OpenAI APIを通じて利用可能です。128Kトークンのコンテキストウィンドウをサポートし、ほとんどのドキュメントやマルチターンアプリケーションに十分対応できます。

FlowHunt AIリーダーボードでは、追跡対象の24モデルのうちの1つであり、3つのベンチマークで評価されています。主なスコア:MMLU-Pro 72.6%(8モデル中6位)、GPQA Diamond 53.6%(14モデル中12位)、SWE-bench Verified 33.2%(13モデル中13位)。

GPT-4o(「オムニ」)は、2024年5月13日にOpenAI初のネイティブ・マルチモーダルモデルとしてリリースされました。テキスト、画像、音声を専用サブモデルにルーティングするのではなく、単一のアーキテクチャで処理します。4oの「o」は「omni」(万能)を意味し、その統一アーキテクチャを反映しています。GPT-4oのリアルタイム音声モードは、2024年後半にリリースされ、初めて人間のような会話レイテンシを実現し、音声AI製品の波を引き起こしました。2024年を通じてChatGPTを動かすデフォルトモデルとなり、初代ビジョン対応エージェントの構築に使用されました。2026年現在、Established層に位置しており — 高度な推論ベンチマークではGPT-5シリーズに大きく劣るものの — コスト重視の高ボリューム・マルチモーダルアプリケーションでは今なお人気があります。

注記:初の旗艦マルチモーダルモデル。広く展開されたベースライン。

リリース日
2024年5月
コンテキスト
128Kトークン
重み
クローズド
Established
プロバイダー
OpenAI

GPT-4o Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified33.2%13 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond53.6%12 of 14SRGraduate-level Google-proof science Q&A
MMLU-Pro72.6%6 of 8SRHard knowledge reasoning, 12K questions

Detailed Benchmark Scores

SWE-V SR
33.2%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
53.6%
Graduate-level Google-proof science Q&A
MMLU-P SR
72.6%
Hard knowledge reasoning, 12K questions

GPT-4o vs. Established Peers

Head-to-head benchmark comparison with other Established-tier models. Higher is better for all metrics.

BenchmarkGPT-4oLlama 4 MaverickLlama 4 Scout
SWE-V33.2%
GPQA ◇53.6%69.8%
MMLU-P72.6%80.5%52.2%

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAIは、2015年12月にSam Altman氏、Elon Musk氏、Greg Brockman氏、Ilya Sutskever氏、John Schulman氏、Wojciech Zaremba氏によって非営利AI研究機関として設立され、全人類に利益をもたらす人工汎用知能(AGI)の開発を使命としています。2019年には利益上限付き子会社OpenAI LPを設立し、機関投資家からの資金調達とモデルトレーニングの大規模化を実現しました。同社はGPTシリーズの言語モデル(GPT-1からGPT-5.5)、DALL-E画像生成シリーズ、Whisper音声認識、Sora動画生成で知られています。OpenAIは消費者向けアプリケーションChatGPT、開発者向けAPI、およびMicrosoft Azureを通じたエンタープライズサービスを運営しています。2026年現在、同社は最大の投資家兼クラウドプロバイダーであるMicrosoftとの緊密な戦略的パートナーシップを維持しています。

ユースケース

GPT-4oの活用シーン

ソフトウェアエンジニアリング
科学・技術的推論

Strengths & Limitations

Strengths

  • 長文コンテキストタスク(128Kコンテキストウィンドウ)

Limitations

  • 最先端未満の高度な科学的推論(GPQA 53% — 最先端は90%超)
  • エージェンティックコーディングおよび複雑な推論において2026年の最先端モデルに大きく劣る
  • クローズドウェイト — セルフホスティングやプライベートデータでのファインチューニング不可

AIモデルリーダーボードをすべて見る

よくある質問

詳しく見る

GPT-4.1 — ベンチマーク、機能、およびユースケース
GPT-4.1 — ベンチマーク、機能、およびユースケース

GPT-4.1 — ベンチマーク、機能、およびユースケース

GPT-4.1はOpenAIのプロプライエタリAIモデルで、Advancedレベルの100万トークン対応コンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨されるユースケースをご覧ください。...

1 分で読める
GPT-5 — ベンチマーク、性能、ユースケース
GPT-5 — ベンチマーク、性能、ユースケース

GPT-5 — ベンチマーク、性能、ユースケース

GPT-5は、OpenAIが開発したプロプライエタリなAIモデルで、400Kトークンのコンテキストウィンドウを持つFrontier層に分類されます。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご紹介します。...

2 分で読める
GPT-5.4 — ベンチマーク、機能、ユースケース
GPT-5.4 — ベンチマーク、機能、ユースケース

GPT-5.4 — ベンチマーク、機能、ユースケース

GPT-5.4はOpenAIが開発したプロプライエタリなAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

1 分で読める