Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

GPT-5.4 Mini

Rilasciato 2026-03-16

chatVisioneCodiceChiamata di strumentiRagionamentoCaching dei prompt

GPT-5.4 Mini è il "mini model più forte finora per coding, computer use e subagent" di OpenAI, che porta i punti di forza di GPT-5.4 su un livello più veloce ed efficiente.

Input
testo immagine $0.75/M
Output
testo $4.5/M
Lettura cache
$0.375/M
Contesto
400K
vs GPT-4o
~85% più economico
Cutoff di conoscenza
2025-08

Benchmark

Sopra la media2 / 10
GPT-5.4 Mini altri modelli misurati media dei modelli confrontati nessun altro modello ha fatto meglio
SWE-Bench Pro
54.4%
OSWorld-Verified
72.1%
GDPval-AA v2 Elo · 642-1861
1171
GPQA Diamond
88%
CharXiv (RQ) no tools
80.3%

Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

Il prezzo nel contesto

Posizione del prezzo tra 60 modelli comparabili

Input$0.75/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Output$4.5/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lettura da cache$0.375/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Token

Finestra di contesto (specifica del fornitore) 400.000
Output massimo (specifica del vendor) 128.000
Cutoff di conoscenza 2025-08

Caching prompt

Modalità automatico
Prefisso min. 1.024
Durata 5-10 min, fino a 1 ora

Ragionamento

Parametro del fornitore reasoning.effort
Valori accettati none · low · medium · high · xhigh
Valore predefinito none applicato se la richiesta non specifica nulla
Disattivabile
Parametro reasoning_effort
Valori minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra

Modello

Modalità testo + immagine → testo
  • Posizionato come il modello mini più forte per coding, computer use e subagent
  • 400k di contesto / 128k di output massimo

fonte: documentazione ufficiale OpenAI ↗

Usa GPT-5.4 Mini in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Informazioni su GPT-5.4 Mini

  • Offre una finestra di contesto da 400K token, 128K token di output massimo, input di immagini e pieno supporto per streaming, function calling e output strutturati, a una frazione del prezzo del flagship.
  • La nota di rilascio di OpenAI lo inquadra come il modo di portare capacità di classe GPT-5.4 su un modello più veloce ed efficiente per carichi di lavoro ad alto volume, e indica coding, computer use e orchestrazione di subagent come i carichi per cui è stato tarato.
  • Fatto cruciale per chi costruisce agent, mantiene l'elenco completo di strumenti del flagship (function calling, ricerca web, ricerca file, tool search, generazione di immagini, code interpreter, shell hosted, apply patch, skill, computer use e MCP), ed è questa la linea che lo separa dal livello nano più economico.
  • Il reasoning effort copre none, low, medium, high e xhigh, con none come predefinito, e la compaction è supportata per le sessioni lunghe.
  • Il tetto di input documentato dentro la finestra da 400K è di 272K token, e il cutoff di conoscenza è agosto 2025.
  • Chat Completions, Responses e Batch sono tutti disponibili a monte, insieme al caching dei prompt e alla sua tariffa scontata per l'input in cache, e lo snapshot distribuito è datato marzo 2026.
  • Poiché la sua finestra si ferma a 400K non supera mai la soglia di fatturazione a contesto lungo che riprezza i modelli di classe 1M, quindi il costo resta lineare al crescere dei prompt.
  • Le richieste a GPT-5.4 Mini su Synthorai passano dallo stesso endpoint compatibile OpenAI di qualsiasi modello GPT.

FAQ

L'API di GPT-5.4 Mini si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $0.75/M token in input, quel credito da solo copre circa 166 richieste da ~8K token verso GPT-5.4 Mini.

In cosa eccelle GPT-5.4 Mini?

Il più forte mini per coding e subagent; una frazione del prezzo del flagship; contesto da 400K con 128K di output. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa GPT-5.4 Mini?

Su Synthorai, GPT-5.4 Mini costa $0.75 per milione di token in input e $4.5 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.375/M.

GPT-5.4 Mini supporta il caching dei prompt?

Sì, in automatico: i prompt serviti da OpenAI vanno in cache senza modifiche al codice. I token di input in cache si fatturano a $0.375/M contro $0.75/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5-10 min, fino a 1 ora). Guida al caching dei prompt →

Come ottengo l'accesso a GPT-5.4 Mini?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-5.4-mini" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Qual è il cutoff di conoscenza di GPT-5.4 Mini?

Il cutoff di conoscenza di GPT-5.4 Mini è 2025-08, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →