OpenAI logo

OpenAI

GPT-5.5

FrontierAvailable in FlowHunt

GPT-5.5는 OpenAI가 개발하여 2026년 4월에 출시한 최고 수준의 프론티어 AI 모델입니다. 독점 클로즈드 웨이트 모델이며, OpenAI API를 통해 사용할 수 있습니다. 100만 토큰 컨텍스트 윈도우는 전체 코드베이스, 긴 기술 문서 또는 확장된 에이전트 세션을 잘라내지 않고 처리할 수 있을 정도로 큽니다.

FlowHunt AI 리더보드에서는 6개 벤치마크에서 평가된 24개 추적 모델 중 하나입니다. 주요 점수: Terminal-Bench 82.7%(8개 중 1위), SWE-bench Verified 88.7%(13개 중 2위), GPQA Diamond 93.6%(14개 중 2위).

GPT-5.5는 OpenAI가 2026년 4월 23일에 GPT-5의 반복적 개선 버전으로 출시했습니다. 출시 당시 GPQA Diamond에서 Claude Opus 4.6과 동률인 93.6%를 기록했으며, 측정된 모든 모델 중 가장 높은 Terminal-Bench 점수인 82.7%를 기록하여 자율 시스템 관리, 셸 스크립팅 및 DevOps 자동화에서 특히 뛰어난 강점을 보여주었습니다. OpenAI는 GPT-5.5를 API의 주요 범용 모델로 지정했으며, 대부분의 사용자에게 ChatGPT를 구동하는 기본 모델이 되었습니다. 또한 SWE-bench Pro에서 68.4%, SWE-bench Verified에서 88.7%를 기록하여 전 세계 상위 3개 코딩 모델 중 하나로 자리매김했습니다.

참고: Fable 5 이전 최고 SWE-bench Verified 점수. OpenAI 최고 Terminal-Bench 점수.

출시일
2026년 4월
컨텍스트
100만 토큰
가중치
비공개
등급
Frontier
제공사
OpenAI

GPT-5.5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified88.7%2 of 13SRReal GitHub issue resolution (500 verified issues)
SWE-bench Pro58.6%7 of 9SRMulti-language, standardised scaffold
GPQA Diamond93.6%2 of 14SRGraduate-level Google-proof science Q&A
Terminal-Bench82.7%1 of 8SRAgentic Linux terminal task completion
HLE41.4%3 of 6SRHumanity's Last Exam (50+ STEM disciplines)
AA Intelligence Index60.2 pts2 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

SWE-V SR
88.7%
Real GitHub issue resolution (500 verified issues)
SWE-Pro SR
58.6%
Multi-language, standardised scaffold
GPQA ◇ SR
93.6%
Graduate-level Google-proof science Q&A
Terminal SR
82.7%
Agentic Linux terminal task completion
HLE SR
41.4%
Humanity's Last Exam (50+ STEM disciplines)
AA Idx AA
60.2 pts
Artificial Analysis composite score (independent)

GPT-5.5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5.5Claude Opus 4.8Claude Opus 4.7
SWE-V88.7%88.6%87.6%
SWE-Pro58.6%69.2%64.3%
GPQA ◇93.6%93.6%94.2%
Terminal82.7%74.6%66.1%
HLE41.4%
AA Idx60.2 pts61.4 pts57.3 pts

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI는 2015년 12월 Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman, Wojciech Zaremba가 모든 인류에게 혜택을 주는 인공 일반 지능(AGI)을 개발하겠다는 사명으로 비영리 AI 연구소로 설립되었습니다. 2019년에는 기관 자본을 유치하고 모델 훈련을 확장하기 위해 수익 상한이 있는 자회사 OpenAI LP를 설립했습니다. 이 회사는 GPT 시리즈 언어 모델(GPT-1부터 GPT-5.5까지), DALL-E 이미지 생성 시리즈, Whisper 음성 인식, Sora 비디오 생성으로 유명합니다. OpenAI는 ChatGPT 소비자 애플리케이션, 개발자 API, Microsoft Azure를 통한 엔터프라이즈 서비스를 운영합니다. 2026년 기준으로 Microsoft와 긴밀한 전략적 파트너십을 유지하고 있으며, Microsoft는 회사의 최대 투자자이자 클라우드 공급자입니다.

사용 사례

GPT-5.5 활용 분야

소프트웨어 엔지니어링
과학 및 기술 추론
에이전트 CLI 자동화
긴 문서 및 코드베이스 분석

Strengths & Limitations

Strengths

  • 강력한 소프트웨어 엔지니어링 — SWE-bench Verified 88%
  • 대학원 수준의 과학 추론 — GPQA Diamond 93%
  • 에이전트 리눅스/CLI 자동화 — Terminal-Bench 82%
  • 복합 지능 — AA Intelligence Index 60점 (독립 평가)
  • 매우 긴 문서 및 대규모 코드베이스 처리 (100만 컨텍스트)

Limitations

  • 클로즈드 웨이트 — 자체 호스팅 또는 비공개 데이터로 파인튜닝 불가

전체 AI 모델 리더보드 살펴보기

자주 묻는 질문

더 알아보기

GPT-5 — 벤치마크, 성능 및 사용 사례
GPT-5 — 벤치마크, 성능 및 사용 사례

GPT-5 — 벤치마크, 성능 및 사용 사례

GPT-5는 OpenAI의 독점 AI 모델로, 400K 토큰 컨텍스트 윈도우를 갖춘 Frontier 등급으로 분류됩니다. FlowHunt에서 직접 사용할 수 있습니다. 벤치마크 점수, 강점 및 권장 사용 사례를 살펴보세요....

3 분 읽기
GPT-5.4 — 벤치마크, 성능 및 사용 사례
GPT-5.4 — 벤치마크, 성능 및 사용 사례

GPT-5.4 — 벤치마크, 성능 및 사용 사례

GPT-5.4는 OpenAI의 독점 AI 모델로, 100만 토큰 컨텍스트 윈도우를 갖춘 Frontier 등급으로 분류됩니다. FlowHunt에서 직접 사용할 수 있습니다. 벤치마크 점수, 강점, 권장 사용 사례를 살펴보세요....

3 분 읽기