OpenAI logo

OpenAI

GPT-5.5

FrontierAvailable in FlowHunt

GPT-5.5は、OpenAIが開発し2026年4月にリリースされた、最上位のフロンティアAIモデルです。プロプライエタリなクローズドウェイトモデルであり、OpenAI APIを通じて利用可能です。100万トークンのコンテキストウィンドウは、コードベース全体、長大な技術文書、または長時間のエージェントセッションを切り詰めることなく保持するのに十分な大きさです。

FlowHunt AI Leaderboardでは、6つのベンチマークで評価された24の追跡モデルのうちの1つです。特筆すべきスコア:Terminal-Bench 82.7%(8モデル中1位)、SWE-bench Verified 88.7%(13モデル中2位)、GPQA Diamond 93.6%(14モデル中2位)。

GPT-5.5は、OpenAIによって2026年4月23日にGPT-5の反復的改良版としてリリースされました。リリース時点では、GPQA DiamondでClaude Opus 4.6と並んで93.6%を記録し、測定された全モデルの中で最高のTerminal-Benchスコア(82.7%)を達成しており、自律的なシステム管理、シェルスクリプティング、DevOps自動化における特に高い強みを示しています。OpenAIはGPT-5.5をAPIにおける主要な汎用モデルとして位置づけ、ChatGPTを利用するほとんどのユーザー向けのデフォルトモデルとなりました。また、SWE-bench Proで68.4%、SWE-bench Verifiedで88.7%を記録し、世界的にトップ3のコーディングモデルに位置しています。

注:Fable 5以前の最高SWE-bench Verifiedスコア。OpenAI最高のTerminal-Benchスコア。

リリース日
2026年4月
コンテキスト
100万トークン
ウェイト
クローズド
ティア
フロンティア
プロバイダー
OpenAI

GPT-5.5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.7%2 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro58.6%7 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%2 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench82.7%1 of 8SRAgentic Linux terminal task completion
HLE41.4%3 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index60.2 pts2 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.7%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
58.6%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
82.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
60.2 pts
Artificial Analysis composite score (independent)

GPT-5.5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5.5Claude Opus 4.8Claude Opus 4.7
SWE-V88.7%88.6%87.6%
SWE-Pro58.6%69.2%64.3%
GPQA ◇93.6%93.6%94.2%
Terminal82.7%74.6%66.1%
HLE41.4%
AA Idx60.2 pts61.4 pts57.3 pts

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAIは、2015年12月にSam Altman氏、Elon Musk氏、Greg Brockman氏、Ilya Sutskever氏、John Schulman氏、Wojciech Zaremba氏によって非営利AI研究機関として設立され、全人類に利益をもたらす人工汎用知能(AGI)の開発を使命としています。2019年には利益上限付き子会社OpenAI LPを設立し、機関投資家からの資金調達とモデルトレーニングの大規模化を実現しました。同社はGPTシリーズの言語モデル(GPT-1からGPT-5.5)、DALL-E画像生成シリーズ、Whisper音声認識、Sora動画生成で知られています。OpenAIは消費者向けアプリケーションChatGPT、開発者向けAPI、およびMicrosoft Azureを通じたエンタープライズサービスを運営しています。2026年現在、同社は最大の投資家兼クラウドプロバイダーであるMicrosoftとの緊密な戦略的パートナーシップを維持しています。

ユースケース

GPT-5.5の活用シーン

ソフトウェアエンジニアリング
科学・技術的推論
エージェント型CLI自動化
長文書・コードベース分析

Strengths & Limitations

Strengths

  • 強力なソフトウェアエンジニアリング — SWE-bench Verified 88%
  • 大学院レベルの科学推論 — GPQA Diamond 93%
  • エージェント型Linux/CLI自動化 — Terminal-Bench 82%
  • 複合知能 — AA Intelligence Index 60 pts(第三者検証済)
  • 超長文書・大規模コードベース対応(100万トークンコンテキスト)

Limitations

  • クローズドウェイト — セルフホスティングやプライベートデータでのファインチューニングは不可

AIモデルリーダーボードをすべて見る

よくある質問

詳しく見る

GPT-5 — ベンチマーク、性能、ユースケース
GPT-5 — ベンチマーク、性能、ユースケース

GPT-5 — ベンチマーク、性能、ユースケース

GPT-5は、OpenAIが開発したプロプライエタリなAIモデルで、400Kトークンのコンテキストウィンドウを持つFrontier層に分類されます。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご紹介します。...

2 分で読める
GPT-5.4 — ベンチマーク、機能、ユースケース
GPT-5.4 — ベンチマーク、機能、ユースケース

GPT-5.4 — ベンチマーク、機能、ユースケース

GPT-5.4はOpenAIが開発したプロプライエタリなAIモデルで、フロンティア層に分類され、100万トークンのコンテキストウィンドウを備えています。FlowHuntで直接利用可能です。ベンチマークスコア、強み、推奨ユースケースをご確認ください。...

1 分で読める
ChatGPT-5:OpenAIの画期的AIモデルのすべて
ChatGPT-5:OpenAIの画期的AIモデルのすべて

ChatGPT-5:OpenAIの画期的AIモデルのすべて

ChatGPT-5の革新的な進歩、ユースケース、ベンチマーク、セキュリティ、価格、今後の展望を網羅したFlowHuntの決定版ガイド。...

1 分で読める
chatgpt 5 gpt-5 +1