Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

GPT-5.4 Mini

Lançado em 2026-03-16

chatVisãoCódigoChamada de ferramentasRaciocínioCache de prompts

O GPT-5.4 Mini é o “modelo mini mais forte até agora para código, uso de computador e subagentes” da OpenAI, trazendo as forças do GPT-5.4 para um nível mais rápido e eficiente.

Entrada
texto imagem $0.75/M
Saída
texto $4.5/M
Leitura de cache
$0.375/M
Contexto
400K
vs GPT-4o
~85% mais barato
Corte de conhecimento
2025-08

Benchmarks

Acima da média2 / 10
GPT-5.4 Mini outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
SWE-Bench Pro
54.4%
OSWorld-Verified
72.1%
GDPval-AA v2 Elo · 642-1861
1171
GPQA Diamond
88%
CharXiv (RQ) no tools
80.3%

Publicado pelos fornecedores: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

O preço em contexto

Posição do preço entre 60 modelos comparáveis

Entrada$0.75/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Saída$4.5/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Leitura em cache$0.375/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

A barra mostra onde fica o preço deste modelo entre todos os modelos do mesmo tipo na Synthorai. Em cada extremidade está o mais barato e o mais caro. São tarifas base; os descontos de lote, região e escrita em cache estão na página de preços.

Especificações e limites

Tokens

Janela de contexto (especificação do fornecedor) 400.000
Saída máxima (especificação do fornecedor) 128.000
Corte de conhecimento 2025-08

Cache de prompts

Modo automático
Prefixo mín. 1.024
Duração 5-10 min, até 1 hora

Raciocínio

Parâmetro do fornecedor reasoning.effort
Valores aceites none · low · medium · high · xhigh
Valor predefinido none aplicado quando o pedido nada indica
Pode ser desativado Sim
Parâmetro reasoning_effort
Valores minimal · low · medium · high a superfície de parâmetros do gateway - aplica-se o mapeamento do fornecedor acima

Modelo

Modalidades texto + imagem → texto
  • Posicionado como o modelo mini mais forte para código, computer use e subagentes
  • contexto de 400k / saída máxima de 128k

conforme documentação oficial da OpenAI ↗

Use o GPT-5.4 Mini em 30 segundos

Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Sobre o GPT-5.4 Mini

  • Ele oferece uma janela de contexto de 400K tokens, 128K tokens de saída máxima, entrada de imagem e suporte completo a streaming, function calling e saídas estruturadas, por uma fração do preço do carro-chefe.
  • A nota de lançamento da OpenAI o enquadra como trazendo capacidades de classe GPT-5.4 para um modelo mais rápido e eficiente voltado a cargas de trabalho de alto volume, e nomeia código, uso de computador e orquestração de subagentes como as cargas para as quais ele foi ajustado.
  • Crucialmente para quem constrói agentes, ele mantém a lista completa de ferramentas do carro-chefe (function calling, busca na web, busca em arquivos, busca de ferramentas, geração de imagens, interpretador de código, shell hospedado, apply patch, skills, uso de computador e MCP), que é a linha que o separa do nível nano mais barato.
  • O esforço de raciocínio abrange none, low, medium, high e xhigh, assumindo none por padrão, e a compaction é suportada para sessões longas.
  • O teto de entrada documentado dentro da janela de 400K é de 272K tokens, e o corte de conhecimento é agosto de 2025.
  • Chat Completions, Responses e Batch estão todos disponíveis no upstream, junto com o cache de prompts e sua tarifa de entrada em cache com desconto, e o snapshot entregue é datado de março de 2026.
  • Como sua janela para em 400K, ele nunca cruza o limiar de cobrança de contexto longo que reprecifica os modelos de classe 1M, então o custo permanece linear conforme os prompts crescem.
  • As requisições ao GPT-5.4 Mini na Synthorai passam pelo mesmo endpoint compatível com OpenAI que qualquer modelo GPT.

Perguntas frequentes

A API do GPT-5.4 Mini é gratuita para testar?

Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $0.75/M de tokens de entrada, só esse crédito já cobre cerca de 166 requisições de ~8K tokens ao GPT-5.4 Mini.

Em que o GPT-5.4 Mini é melhor?

Mini mais forte para código e subagentes; uma fração do preço do carro-chefe; 400K de contexto com 128K de saída. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o GPT-5.4 Mini?

Na Synthorai, o GPT-5.4 Mini custa $0.75 por milhão de tokens de entrada e $4.5 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.375/M.

O GPT-5.4 Mini suporta cache de prompts?

Sim, automaticamente: prompts servidos pela OpenAI entram em cache sem nenhuma mudança no código. Tokens de entrada em cache são cobrados a $0.375/M, contra $0.75/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache (TTL 5-10 min, até 1 hora). Guia de cache de prompts →

Como obtenho acesso ao GPT-5.4 Mini?

Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="gpt-5.4-mini" e pronto. Uma única chave de API cobre todos os modelos do gateway.

Qual é o corte de conhecimento do GPT-5.4 Mini?

O corte de conhecimento do GPT-5.4 Mini é 2025-08, segundo a documentação oficial do fornecedor (verificado em 2026-07-09).

Modelos relacionados

Comparar

Cada valor desta página é transcrito da documentação do fornecedor, ligada acima, e traz a data em que foi verificado. Os preços são comparados em todo o catálogo; os valores de especificação que os fornecedores definem de forma diferente são apresentados com a diferença indicada em vez de representados num gráfico. Nada aqui é medido por nós, e nada é pontuado.

Obtenha sua chave API Compare seu custo →