OpenAI Lança GPT-5.4: Mais Eficiente, com Computer Use Nativo e Foco em Trabalho Profissional
A OpenAI apresentou o GPT-5.4, o seu modelo frontier mais capaz e eficiente para trabalho profissional — com menos alucinações, computer use nativo, janela de contexto de 1M de tokens e nova gestão de ferramentas.
Resumo
A OpenAI lançou a 5 de Março de 2026 o GPT-5.4, que descreve como o seu "modelo frontier mais capaz e eficiente para trabalho profissional". O modelo combina os avanços de raciocínio do GPT-5.2 com as capacidades de código do GPT-5.3-Codex, expandindo também o suporte a folhas de cálculo, documentos e apresentações. Está disponível em três versões: GPT-5.4 (padrão), GPT-5.4 Thinking (raciocínio) e GPT-5.4 Pro (alta performance).
O modelo está a ser disponibilizado gradualmente no ChatGPT e no Codex, e via API. No ChatGPT, o GPT-5.4 Thinking está disponível para subscritores Plus, Team e Pro, substituindo o GPT-5.2 Thinking, que será descontinuado em três meses. O GPT-5.4 Pro está disponível via API e para planos Pro e Enterprise. O GPT-5.3 Instant mantém-se como modelo padrão para conversas regulares no ChatGPT.
Na pratica
A OpenAI destaca seis áreas principais de melhoria neste lançamento:
**Factualidade:** O GPT-5.4 é descrito como o modelo mais rigoroso da OpenAI até à data — as respostas completas são 18% menos propensas a conter erros, e as afirmações individuais são 33% menos propensas a ser falsas, em comparação com o GPT-5.2.
**Eficiência de tokens:** O modelo resolve problemas com significativamente menos tokens do que os seus antecessores — em alguns casos até 47% menos — o que se traduz em respostas mais rápidas e custos mais baixos, apesar de o preço por token na API ser superior ao do GPT-5.2 para reflectir as capacidades melhoradas.
**Janela de contexto:** O GPT-5.4 suporta até 1 milhão de tokens de contexto na API, a maior janela de contexto já disponibilizada pela OpenAI, facilitando a análise de bases de código completas, colecções de documentos extensas ou trajectórias de agentes longas numa única chamada.
**Computer use nativo:** É o primeiro modelo "mainline" da OpenAI com capacidades de uso de computador integradas, permitindo que agentes interajam directamente com software para completar, verificar e corrigir tarefas num ciclo build-run-verify-fix. Em avaliações internas com portais de HOA e impostos sobre propriedade, o GPT-5.4 atingiu uma taxa de sucesso de 95% na primeira tentativa e 100% dentro de três tentativas, completando as sessões cerca de 3 vezes mais rapidamente e usando aproximadamente 70% menos tokens do que modelos anteriores de computer use.
**Tool Search (API):** Nova funcionalidade que permite ao modelo receber uma lista leve de ferramentas disponíveis e procurar as definições apenas quando necessário, em vez de incluir todas as definições de ferramentas no prompt de início. Em sistemas com muitas ferramentas, a abordagem anterior podia adicionar dezenas de milhares de tokens a cada pedido. A nova abordagem reduz drasticamente o número de tokens necessários e preserva a cache, tornando os pedidos mais rápidos e baratos.
**GPT-5.4 Thinking com plano antecipado:** À semelhança do Codex, o GPT-5.4 Thinking passa a apresentar um resumo do seu plano de trabalho no início de consultas mais longas e complexas. Os utilizadores podem também dar instruções ou ajustar a direcção do modelo a meio da resposta, sem precisar de recomeçar. Esta funcionalidade está disponível em chatgpt.com e na aplicação Android, com chegada prevista à aplicação iOS.
No que respeita a benchmarks, o GPT-5.4 atinge 83% no GDPval — a avaliação interna da OpenAI que testa o desempenho em tarefas de trabalho do conhecimento em 44 profissões — superando o resultado de 70,9% do GPT-5.2. O modelo supera também os antecessores nos benchmarks de computer use OSWorld-Verified e WebArena Verified, e ultrapassa o lançamento recente GPT-5.3-Codex (e o Gemini 3.1 Pro da Google) no benchmark SWE-Bench Pro de código.
O GPT-5.4 Pro, mais caro, destaca-se especialmente em matemática avançada, alcançando 38% no benchmark FrontierMath para os problemas mais difíceis, face a 27,1% da versão Thinking.
Contexto
A OpenAI também publicou simultaneamente nova investigação de segurança sobre a monitorização do raciocínio dos modelos, incluindo uma avaliação open-source para testar se os sistemas conseguem ocultar o seu raciocínio. Os resultados indicam que o GPT-5.4 Thinking apresenta baixa capacidade de dissimular o seu raciocínio, o que a empresa caracteriza como um sinal positivo de segurança.
O lançamento ocorre num contexto de pressão competitiva crescente, com relatos de utilizadores a migrarem do ChatGPT para concorrentes como o Claude da Anthropic. A OpenAI mantém a mesma classificação de risco cibernético elevado usada para o GPT-5.3-Codex e implementou protecções adicionais, incluindo sistemas de segurança cibernética expandidos, ferramentas de monitorização, controlos de acesso e bloqueio de pedidos para actividades de maior risco.
Porque importa
- O GPT-5.4 representa a aposta mais directa da OpenAI no mercado de trabalho profissional e empresarial, com melhorias mensuráveis em factualidade, eficiência e capacidade de agência autónoma — áreas onde a concorrência com Google e Anthropic é mais intensa.
- A combinação de computer use nativo com Tool Se