TLDR
- O GPT-5.4 foi lançado pela OpenAI em 5 de março de 2026 e se posiciona como o modelo de fronteira mais capaz da empresa para trabalho profissional, raciocínio, programação e tarefas com agentes de IA.
- A maior novidade é o uso nativo do computador — o modelo consegue operar desktops, clicar em botões, interagir com aplicativos abertos e entender o que aparece na tela, alcançando 75% no benchmark OSWorld-Verified (acima da referência humana de 72,4%).
- A janela de contexto chega a 2 milhões de tokens — o dobro do limite anterior do GPT-4.1 — o que permite processar bases de código inteiras, documentos jurídicos extensos e arquivos completos de pesquisa.
- Em relação ao GPT-5.2, os erros factuais caíram 33% e os erros gerais nas respostas caíram 18%, enquanto o novo sistema Tool Search reduz o consumo de tokens em 47% em fluxos de trabalho complexos.
- Destaques nos benchmarks: 83% no GDPval (trabalho de conhecimento), 87,5% em modelagem de banco de investimento e desempenho de nível especialista em entregas do mundo real, como planilhas e apresentações.
- O modelo vem em duas configurações: o GPT-5.4 Thinking para a maioria dos usuários e o GPT-5.4 Pro para cargas de trabalho corporativas mais exigentes.
- Diante dos concorrentes, o GPT-5.4 supera ligeiramente o Gemini 3.1 Pro na maioria dos benchmarks e parece desafiar o domínio de longa data do Claude Opus 4.6 em programação.
- Está disponível nos planos pagos do ChatGPT, na API da OpenAI e no Overchat AI, com o preço da API compensado, na prática, pelos recursos de redução de tokens do Tool Search.
O que é o GPT-5.4?
O GPT-5.4 é um modelo de linguagem de grande porte lançado pela OpenAI em 5 de março de 2026, voltado principalmente para o trabalho profissional.
A OpenAI o descreve como seu modelo de fronteira mais capaz e eficiente para tarefas profissionais, reunindo raciocínio, programação e uso do computador em um único sistema.
O modelo traz várias melhorias importantes:
- Até 2 milhões de tokens de contexto
- Benchmarks de raciocínio aprimorados
- Grandes reduções nas alucinações
- Melhor integração com ferramentas e softwares externos
Para quem trabalha com agentes de IA, o GPT-5.4 também avança no esforço da OpenAI em direção a sistemas de IA capazes de operar de forma autônoma por longos períodos. Isso é possível graças ao uso nativo do computador.
O modelo vem em duas configurações principais:
- GPT-5.4 Thinking — para tarefas difíceis.
- GPT-5.4 Pro — uma versão de desempenho ainda mais alto, desenvolvida para as cargas de trabalho mais exigentes.
A maioria das pessoas vai usar o GPT-5.4 Thinking; a versão Pro é voltada para usuários avançados e empresas.
Qual é o melhor: GPT-5.2 ou GPT-5.4?
O GPT-5.4 é um modelo de IA melhor do que o GPT-5.2, já que se trata de uma atualização iterativa.
Segundo os benchmarks da OpenAI, o GPT-5.4 tem desempenho de nível especialista ou superior em uma ampla variedade de tarefas do mundo real.
Por exemplo:
- GDPval (benchmark de trabalho de conhecimento): 83%
- Benchmark de modelagem de banco de investimento: 87,5%
- Benchmark de uso do computador OSWorld: 75% (acima da referência humana)
Esses benchmarks medem a capacidade dos sistemas de IA de produzir entregas reais, como planilhas, apresentações ou fluxos de agendamento.
Em comparação com o GPT-5.2:
- Os erros factuais caíram 33%
- Os erros gerais nas respostas caíram 18%
Outra melhoria importante é a eficiência.
O novo sistema Tool Search reduz o consumo de tokens em 47% em fluxos de trabalho complexos, nos quais há muitas ferramentas disponíveis.
Benchmarks do GPT-5.4
Veja a seguir alguns dos resultados de benchmark mais notáveis divulgados para o GPT-5.4:
| Benchmark |
Pontuação |
Descrição |
| GDPval (trabalho de conhecimento) |
83% |
Iguala ou supera os profissionais |
| GPQA Diamond |
92.8% |
Raciocínio científico avançado |
| ARC-AGI-2 |
73.3% |
Forte raciocínio abstrato |
| OSWorld Verified |
75% |
Supera o desempenho humano |
| SWE-Bench Pro |
57.7% |
Engenharia de software do mundo real |
Recursos do GPT 5.4
Afinal, o que faz desse modelo o melhor que a OpenAI já lançou? Vamos falar sobre seus principais recursos.
O maior recurso novo: uso do computador
A adição mais importante do GPT-5.4 é o fato de que agora ele consegue usar computadores de forma nativa. Isso significa que o modelo pode:
- Executar ações no desktop
- Interagir com aplicativos abertos
- Clicar em botões e digitar comandos
- Entender o que está na tela no momento
No benchmark OSWorld-Verified, que mede a capacidade de controlar a interface de um computador, o GPT-5.4 alcançou 75% de precisão, superando a referência humana de 72,4%.
Contexto longo: 2 milhões de tokens
O GPT-5.4 suporta até dois milhões de tokens de contexto pela API e pela plataforma Codex. É o dobro do milhão de tokens suportado pelo modelo anterior com a maior janela de contexto: o GPT 4.1. O GPT 4.1 era basicamente um modelo de programação e ficou obsoleto rapidamente.
Os modelos anteriores da linha GPT-5 conseguiam lidar apenas com centenas de milhares de tokens, nem chegavam a um milhão.
Um contexto de dois milhões de tokens permite que os sistemas de IA processem:
- Bases de código inteiras
- Documentos jurídicos extensos
- Arquivos completos de pesquisa
O resultado é um raciocínio e um planejamento de longo prazo melhores.
GPT 5.4 vs. concorrentes
E veja como o novo modelo se compara a outras IAs de fronteira:
GPT-5.4 vs. Gemini 3.1 Pro
O Gemini 3.1 Pro, da Google, é um dos concorrentes mais fortes do GPT-5.4 da OpenAI, especialmente em tarefas de raciocínio e de contexto longo. Ainda assim, na maioria dos benchmarks o GPT-5.4 supera ligeiramente o concorrente da Google e, em vários deles, supera por uma margem grande. Considerando apenas o desempenho nos benchmarks, o GPT-5.4 é o modelo superior.
| Benchmark |
GPT-5.4 |
Gemini 3.1 Pro |
Vencedor |
| ARC-AGI-2 (raciocínio abstrato) |
73.3% |
65.2% |
GPT-5.4 |
| GPQA Diamond (ciência de doutorado) |
92.8% |
91.9% |
GPT-5.4 |
| OSWorld-Verified (uso do computador) |
75.0% |
72.7% |
GPT-5.4 |
| SWE-Bench Pro (engenharia de software) |
57.7% |
54.1% |
GPT-5.4 |
GPT-5.4 vs. Claude Opus 4.6
Muita gente acredita que o Claude Opus 4.6, da Anthropic, seja o melhor modelo de IA do mundo para programação. Em especial, muitos desenvolvedores o preferem com folga às opções da OpenAI. O jogo está prestes a virar? É o que parece, pelo menos de acordo com estes benchmarks:
| Benchmark |
GPT-5.4 |
Claude Opus 4.6 |
Vencedor |
| SWE-Bench Pro (programação) |
57.7% |
56.9% |
GPT-5.4 |
| ARC-AGI-2 (raciocínio abstrato) |
73.3% |
62.4% |
GPT-5.4 |
| WebArena-Verified (agentes de navegador) |
67.3% |
66.4% |
GPT-5.4 |
| OSWorld-Verified (uso do computador) |
75.0% |
69.8% |
GPT-5.4 |
Preços do GPT 5.4
A OpenAI também apresentou novos preços de API para o GPT-5.4.
| Modelo |
Tokens de entrada |
Tokens de saída |
| GPT-5.4 |
US$ 2,50 / milhão |
US$ 15 / milhão |
| GPT-5.4 Pro |
US$ 30 / milhão |
US$ 180 / milhão |
Outro ponto que vale a pena ter em mente ao falar do custo do GPT-5.4 é que há vários recursos que reduzem o custo total. O Tool Search é um recurso que permite ao modelo carregar de forma seletiva informações sobre as ferramentas disponíveis. Isso reduz o consumo total de tokens, então, embora o preço por token possa ser maior, a diferença pode não ser perceptível no uso real.
Perguntas frequentes (FAQ)
Quando o GPT-5.4 foi lançado?
O GPT-5.4 foi lançado em 5 de março de 2026 pela OpenAI.
O que é o GPT-5.4?
O GPT-5.4 é o melhor modelo de IA da OpenAI. Ele foi desenvolvido para trabalho profissional, automação e tarefas com agentes de IA. As maiores novidades são o uso nativo do computador, benchmarks de raciocínio aprimorados e uma janela de contexto de 1 milhão de tokens.
Onde posso acessar o GPT-5.4?
No momento, o GPT-5.4 está disponível no Overchat AI, nos planos pagos do ChatGPT e na API da OpenAI.
Conclusão
O GPT-5.4 é o melhor modelo de IA da OpenAI e um grande passo rumo a sistemas de IA com agentes capazes de realizar tarefas do mundo real por conta própria. Em comparação com o GPT-5.2, o novo modelo oferece:
- Desempenho significativamente melhor nos benchmarks
- Uso nativo do computador
- Muito menos alucinações
- Uma enorme janela de contexto de 2 milhões de tokens
Em resumo, o GPT-5.4 foi projetado para tornar a IA muito mais útil em tarefas complexas do mundo real.