
GPT-5 — Benchmarks, Capacidades e Casos de Uso
O GPT-5 é um modelo de IA proprietário da OpenAI, classificado como nível Frontier com janela de contexto de 400K tokens. Está disponível diretamente no FlowHun...
O GPT-5.5 é um modelo de IA de fronteira de alto nível, desenvolvido pela OpenAI e lançado em abril de 2026. É um modelo proprietário de pesos fechados, disponível através da API da OpenAI. A janela de contexto de 1M de tokens é grande o suficiente para conter bases de código inteiras, documentos técnicos extensos ou sessões agênticas prolongadas sem truncamento.
No Ranking de IA do FlowHunt, é um dos 24 modelos monitorados, avaliados em 6 benchmarks. Pontuações de destaque: 82,7% no Terminal-Bench (#1 de 8); 88,7% no SWE-bench Verified (#2 de 13); 93,6% no GPQA Diamond (#2 de 14).
O GPT-5.5 foi lançado pela OpenAI em 23 de abril de 2026 como um refinamento iterativo do GPT-5. No lançamento, igualou o Claude Opus 4.6 no GPQA Diamond com 93,6% e registrou a maior pontuação no Terminal-Bench já medida para qualquer modelo — 82,7% — refletindo uma força particular em administração autônoma de sistemas, scripts shell e automação DevOps. A OpenAI posicionou o GPT-5.5 como o principal modelo de uso geral em sua API, e ele se tornou o modelo padrão que alimenta o ChatGPT para a maioria dos usuários. Também registrou 68,4% no SWE-bench Pro e 88,7% no SWE-bench Verified, colocando-o entre os três melhores modelos de codificação globalmente.
Nota: Maior pontuação no SWE-bench Verified antes do Fable 5. Melhor pontuação no Terminal-Bench da OpenAI.
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| SWE-bench Verified | 88.7% | 2 of 13 | SR | Real GitHub issue resolution (500 verified issues) |
| SWE-bench Pro | 58.6% | 7 of 9 | SR | Multi-language, standardised scaffold |
| GPQA Diamond | 93.6% | 2 of 14 | SR | Graduate-level Google-proof science Q&A |
| Terminal-Bench | 82.7% | 1 of 8 | SR | Agentic Linux terminal task completion |
| HLE | 41.4% | 3 of 6 | SR | Humanity's Last Exam (50+ STEM disciplines) |
| AA Intelligence Index | 60.2 pts | 2 of 9 | AA | Artificial Analysis composite score (independent) |
Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.
| Benchmark | GPT-5.5 | Claude Opus 4.8 | Claude Opus 4.7 |
|---|---|---|---|
| SWE-V | 88.7% | 88.6% | 87.6% |
| SWE-Pro | 58.6% | 69.2% | 64.3% |
| GPQA ◇ | 93.6% | 93.6% | 94.2% |
| Terminal | 82.7% | 74.6% | 66.1% |
| HLE | 41.4% | — | — |
| AA Idx | 60.2 pts | 61.4 pts | 57.3 pts |
A OpenAI foi fundada em dezembro de 2015 como um laboratório de investigação sem fins lucrativos por Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, John Schulman e Wojciech Zaremba, com a missão de desenvolver inteligência artificial geral (AGI) que beneficie toda a humanidade. Em 2019, criou uma subsidiária com lucro limitado, a OpenAI LP, para angariar capital institucional e escalar o treino de modelos. A empresa é conhecida pela série GPT de modelos de linguagem (GPT-1 a GPT-5.5), pela série de geração de imagens DALL-E, pelo reconhecimento de voz Whisper e pela geração de vídeos Sora. A OpenAI opera a aplicação de consumo ChatGPT, uma API para programadores e serviços empresariais através do Microsoft Azure. Em 2026, mantém uma parceria estratégica próxima com a Microsoft, que é a maior investidora e fornecedora de cloud da empresa.
Casos de Uso
O GPT-5.5 pontua 88% no SWE-bench Verified — classificado em #2 de 13 modelos monitorados aqui. Ele resolve issues reais do GitHub, escreve código de qualidade de produção em múltiplas linguagens e lida com fluxos de trabalho de codificação agêntica de múltiplas etapas — uma escolha robusta para equipes de desenvolvimento de software assistidas por IA.
Com 93% no GPQA Diamond (#2 de 14 modelos), o GPT-5.5 supera a linha de base humana de ~65% de especialistas com doutorado em perguntas de biologia, química e física de nível de pós-graduação. Use-o para síntese de literatura científica, avaliação de hipóteses, perguntas e respostas médicas e jurídicas, e tarefas de pesquisa multidisciplinar onde o conhecimento profundo do domínio é importante.
Com pontuação de 82% no Terminal-Bench (#1 de 8 modelos), o GPT-5.5 é bem adequado para automação DevOps agêntica e de infraestrutura. O Terminal-Bench mede a conclusão autônoma de tarefas de shell Linux — gerenciamento de pacotes, operações de sistema de arquivos, controle de processos e administração de sistemas em múltiplas etapas — sem orientação humana durante a tarefa.
Com uma janela de contexto de 1M de tokens, o GPT-5.5 pode processar repositórios de software inteiros, contratos legais extensos, relatórios de pesquisa do tamanho de livros ou históricos extensos de conversas em um único prompt — permitindo perguntas e respostas profundas sobre documentos, raciocínio entre arquivos de código e sumarização abrangente sem heurísticas de fragmentação ou pipelines de RAG.
Mais para Comparar
Compare todos os 24 modelos em 11 benchmarks — classificável, com fontes e atualizado em junho de 2026.

O GPT-5 é um modelo de IA proprietário da OpenAI, classificado como nível Frontier com janela de contexto de 400K tokens. Está disponível diretamente no FlowHun...

O GPT-5.4 é um modelo de IA proprietário da OpenAI, classificado como nível Frontier com janela de contexto de 1 milhão de tokens. Está disponível diretamente n...

GPT-4.1 é um modelo de IA proprietário da OpenAI, classificado como nível Avançado com janela de contexto de 1M de tokens. Está disponível diretamente no FlowHu...
Consentimento de Cookies
Usamos cookies para melhorar sua experiência de navegação e analisar nosso tráfego. See our privacy policy.