Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

GPT-5.4 Pro

Lançado em 2026-03-05

chatVisãoCódigoChamada de ferramentasRaciocínio

O GPT-5.4 Pro é o nível premium de raciocínio da família GPT-5.4: segundo a OpenAI, ele “usa mais compute para pensar mais e fornecer respostas consistentemente melhores”, produzindo respostas mais inteligentes e precisas em problemas difíceis.

Entrada
texto imagem $30/M
Saída
texto $180/M
Leitura de cache
$15/M
Contexto
922K
Corte de conhecimento
2025-08

Benchmarks

Acima da médiaNenhum melhor12 / 131 / 13
GPT-5.4 Pro outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
GeneBench
25.6%
GDPval (wins or ties)
82%
GPQA Diamond
94.4%
BrowseComp
89.3%

Publicado pelos fornecedores: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

O preço em contexto

Posição do preço entre 60 modelos comparáveis

Entrada$30/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Saída$180/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Leitura em cache$15/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

A barra mostra onde fica o preço deste modelo entre todos os modelos do mesmo tipo na Synthorai. Em cada extremidade está o mais barato e o mais caro. São tarifas base; os descontos de lote, região e escrita em cache estão na página de preços.

Especificações e limites

Tokens

Janela de contexto (especificação do fornecedor) 1.050.000
Saída máxima (especificação do fornecedor) 128.000
Corte de conhecimento 2025-08

Cache de prompts

Modo automático
Prefixo mín. 1.024
Duração 5-10 min, até 1 hora

Raciocínio

Parâmetro do fornecedor reasoning.effort
Valores aceites medium · high · xhigh
Valor predefinido medium aplicado quando o pedido nada indica
Pode ser desativado Não
Comportamento do raciocínio Apenas pela Responses API; as requisições podem levar vários minutos, então a OpenAI recomenda o modo em background.
Parâmetro reasoning_effort
Valores minimal · low · medium · high a superfície de parâmetros do gateway - aplica-se o mapeamento do fornecedor acima

Modelo

Modalidades texto + imagem → texto
  • Nível pro de maior compute
  • saídas estruturadas não suportadas
  • uso em múltiplos turnos apenas pela Responses API
  • as requisições podem levar minutos (modo em background recomendado)
  • contexto de 1,05M

conforme documentação oficial da OpenAI ↗

Use o GPT-5.4 Pro em 30 segundos

Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-pro",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Sobre o GPT-5.4 Pro

  • Ele mantém a janela de contexto de 1.050.000 tokens (especificação do fornecedor) e os 128K de saída máxima, aceita entrada de imagem e suporta esforço de raciocínio em medium, high e xhigh; requisições de longa duração podem levar vários minutos, então a execução em background é recomendada.
  • A ausência de none e low é justamente o ponto do nível: seu piso é a deliberação, não a velocidade.
  • A OpenAI o restringe à Responses API, explicando que é isso que permite interações de múltiplos turnos com o modelo antes de uma requisição ser respondida, e a Batch API é explicitamente não suportada neste modelo.
  • Sua lista de ferramentas cobre function calling, busca na web, busca em arquivos, busca de ferramentas, geração de imagens, apply patch, uso de computador e MCP.
  • A mesma regra de cobrança de contexto longo do GPT-5.4 se aplica: prompts acima de 272K tokens de entrada são cobrados a 2x a entrada e 1,5x a saída para a requisição inteira.
  • O corte de conhecimento é agosto de 2025, e o snapshot entregue é datado de março de 2026.
  • Reserve-o para problemas em que uma resposta melhor vale minutos de latência e várias vezes o custo por token.
  • A Synthorai torna o GPT-5.4 Pro chamável pela sua interface compatível com OpenAI bem ao lado dos modelos padrão.

Perguntas frequentes

A API do GPT-5.4 Pro é gratuita para testar?

Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $30/M de tokens de entrada, só esse crédito já cobre cerca de 4 requisições de ~8K tokens ao GPT-5.4 Pro.

Em que o GPT-5.4 Pro é melhor?

Usa mais compute para pensar mais; respostas consistentemente melhores em problemas difíceis; execução em background para requisições de vários minutos. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o GPT-5.4 Pro?

Na Synthorai, o GPT-5.4 Pro custa $30 por milhão de tokens de entrada e $180 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $15/M.

O GPT-5.4 Pro suporta cache de prompts?

Sim, automaticamente: prompts servidos pela OpenAI entram em cache sem nenhuma mudança no código. Tokens de entrada em cache são cobrados a $15/M, contra $30/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache (TTL 5-10 min, até 1 hora). Guia de cache de prompts →

Como obtenho acesso ao GPT-5.4 Pro?

Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="gpt-5.4-pro" e pronto. Uma única chave de API cobre todos os modelos do gateway.

Qual é o corte de conhecimento do GPT-5.4 Pro?

O corte de conhecimento do GPT-5.4 Pro é 2025-08, segundo a documentação oficial do fornecedor (verificado em 2026-07-09).

Modelos relacionados

Comparar

Cada valor desta página é transcrito da documentação do fornecedor, ligada acima, e traz a data em que foi verificado. Os preços são comparados em todo o catálogo; os valores de especificação que os fornecedores definem de forma diferente são apresentados com a diferença indicada em vez de representados num gráfico. Nada aqui é medido por nós, e nada é pontuado.

Obtenha sua chave API Compare seu custo →