OpenAI logo

OpenAI

GPT-5

FrontierAvailable in FlowHunt

GPT-5는 OpenAI가 개발하여 2025년 8월에 출시된 최상위 프론티어 AI 모델입니다. 독점 폐쇄형 가중치 모델로, OpenAI API를 통해 사용할 수 있습니다. 400K 토큰 컨텍스트 윈도우를 지원하여 대부분의 문서 및 다중 턴 애플리케이션에 충분합니다.

FlowHunt AI 리더보드에서는 2개 벤치마크에서 평가된 24개 추적 모델 중 하나입니다. 주요 점수: GPQA Diamond 88.4%(14개 중 7위), SWE-bench Verified 74.9%(13개 중 10위).

GPT-5는 2025년 8월 7일에 OpenAI의 첫 번째 모델로 출시되었으며, 여러 어려운 추론 벤치마크에서 인간 수준 이상의 성능을 자체 보고했습니다. 또한 텍스트, 이미지 및 오디오 입력을 전문 모델 파이프라인이 아닌 추론 수준에서 통합 기능으로 결합한 최초의 GPT 모델입니다. GPT-5는 현재 프론티어 등급의 기반을 마련했습니다. 출시 당시 400K 컨텍스트 윈도우는 OpenAI에서 제공하는 가장 긴 컨텍스트였으며, GPT-4o 대비 코딩 성능 향상은 Codex 기반 및 GPT-4o 기반 개발 도구의 상당 부분을 대체할 정도로 컸습니다. 이 출시는 2022년 ChatGPT 데뷔 이후 GPT API 채택의 가장 빠른 가속화를 이끌었습니다.

참고: GPT-4o, o3, o4-mini, GPT-4.1을 대체하는 통합 모델입니다. AIME 2025: 94.6%.

출시일
2025년 8월
컨텍스트
400K 토큰
가중치
폐쇄형
등급
프론티어
제공사
OpenAI

GPT-5 Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
SWE-bench Verified74.9%10 of 13SRReal GitHub issue resolution (500 verified issues)
GPQA Diamond88.4%7 of 14SRGraduate-level Google-proof science Q&A

Detailed Benchmark Scores

SWE-V SR
74.9%
Real GitHub issue resolution (500 verified issues)
GPQA ◇ SR
88.4%
Graduate-level Google-proof science Q&A

GPT-5 vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkGPT-5Claude Opus 4.8Claude Opus 4.7
SWE-V74.9%88.6%87.6%
GPQA ◇88.4%93.6%94.2%

About OpenAI

OpenAI Founded 2015 · San Francisco, CA
Website →

OpenAI는 2015년 12월 Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman, Wojciech Zaremba가 모든 인류에게 혜택을 주는 인공 일반 지능(AGI)을 개발하겠다는 사명으로 비영리 AI 연구소로 설립되었습니다. 2019년에는 기관 자본을 유치하고 모델 훈련을 확장하기 위해 수익 상한이 있는 자회사 OpenAI LP를 설립했습니다. 이 회사는 GPT 시리즈 언어 모델(GPT-1부터 GPT-5.5까지), DALL-E 이미지 생성 시리즈, Whisper 음성 인식, Sora 비디오 생성으로 유명합니다. OpenAI는 ChatGPT 소비자 애플리케이션, 개발자 API, Microsoft Azure를 통한 엔터프라이즈 서비스를 운영합니다. 2026년 기준으로 Microsoft와 긴밀한 전략적 파트너십을 유지하고 있으며, Microsoft는 회사의 최대 투자자이자 클라우드 공급자입니다.

사용 사례

GPT-5 사용 용도

소프트웨어 엔지니어링
과학 및 기술 추론

Strengths & Limitations

Strengths

  • 견고한 코딩 지원 — SWE-bench Verified 74%
  • 고급 과학 Q&A — GPQA Diamond 88%
  • 긴 컨텍스트 작업 (400K 컨텍스트 윈도우)

Limitations

  • 폐쇄형 가중치 — 자체 호스팅 또는 프라이빗 데이터로 파인튜닝 불가

전체 AI 모델 리더보드 살펴보기

자주 묻는 질문

더 알아보기

GPT-5.5 — 벤치마크, 성능 및 사용 사례
GPT-5.5 — 벤치마크, 성능 및 사용 사례

GPT-5.5 — 벤치마크, 성능 및 사용 사례

GPT-5.5는 OpenAI의 독점 AI 모델로, Frontier 등급으로 분류되며 100만 토큰 컨텍스트 윈도우를 제공합니다. FlowHunt에서 바로 사용할 수 있습니다. 벤치마크 점수, 강점 및 권장 사용 사례를 알아보세요....

4 분 읽기