GPT-5.4 Mini è il "mini model più forte finora per coding, computer use e subagent" di OpenAI, che porta i punti di forza di GPT-5.4 su un livello più veloce ed efficiente.
- Input
- testo immagine $0.75/M
- Output
- testo $4.5/M
- Lettura cache
- $0.375/M
- Contesto
- 400K
- vs GPT-4o
- ~85% più economico
- Cutoff di conoscenza
- 2025-08
Benchmark
Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai
Il prezzo nel contesto
Posizione del prezzo tra 60 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 400.000 |
|---|---|
| Output massimo (specifica del vendor) | 128.000 |
| Cutoff di conoscenza | 2025-08 |
Caching prompt
| Modalità | automatico |
|---|---|
| Prefisso min. | 1.024 |
| Durata | 5-10 min, fino a 1 ora |
Ragionamento
| Parametro del fornitore | reasoning.effort |
|---|---|
| Valori accettati | none · low · medium · high · xhigh |
| Valore predefinito | none applicato se la richiesta non specifica nulla |
| Disattivabile | Sì |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine → testo |
|---|
- Posizionato come il modello mini più forte per coding, computer use e subagent
- 400k di contesto / 128k di output massimo
Usa GPT-5.4 Mini in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-mini",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-mini",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-mini",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-mini")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su GPT-5.4 Mini
- Offre una finestra di contesto da 400K token, 128K token di output massimo, input di immagini e pieno supporto per streaming, function calling e output strutturati, a una frazione del prezzo del flagship.
- La nota di rilascio di OpenAI lo inquadra come il modo di portare capacità di classe GPT-5.4 su un modello più veloce ed efficiente per carichi di lavoro ad alto volume, e indica coding, computer use e orchestrazione di subagent come i carichi per cui è stato tarato.
- Fatto cruciale per chi costruisce agent, mantiene l'elenco completo di strumenti del flagship (function calling, ricerca web, ricerca file, tool search, generazione di immagini, code interpreter, shell hosted, apply patch, skill, computer use e MCP), ed è questa la linea che lo separa dal livello nano più economico.
- Il reasoning effort copre none, low, medium, high e xhigh, con none come predefinito, e la compaction è supportata per le sessioni lunghe.
- Il tetto di input documentato dentro la finestra da 400K è di 272K token, e il cutoff di conoscenza è agosto 2025.
- Chat Completions, Responses e Batch sono tutti disponibili a monte, insieme al caching dei prompt e alla sua tariffa scontata per l'input in cache, e lo snapshot distribuito è datato marzo 2026.
- Poiché la sua finestra si ferma a 400K non supera mai la soglia di fatturazione a contesto lungo che riprezza i modelli di classe 1M, quindi il costo resta lineare al crescere dei prompt.
- Le richieste a GPT-5.4 Mini su Synthorai passano dallo stesso endpoint compatibile OpenAI di qualsiasi modello GPT.
FAQ
L'API di GPT-5.4 Mini si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $0.75/M token in input, quel credito da solo copre circa 166 richieste da ~8K token verso GPT-5.4 Mini.
In cosa eccelle GPT-5.4 Mini?
Il più forte mini per coding e subagent; una frazione del prezzo del flagship; contesto da 400K con 128K di output. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa GPT-5.4 Mini?
Su Synthorai, GPT-5.4 Mini costa $0.75 per milione di token in input e $4.5 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.375/M.
GPT-5.4 Mini supporta il caching dei prompt?
Sì, in automatico: i prompt serviti da OpenAI vanno in cache senza modifiche al codice. I token di input in cache si fatturano a $0.375/M contro $0.75/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5-10 min, fino a 1 ora). Guida al caching dei prompt →
Come ottengo l'accesso a GPT-5.4 Mini?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-5.4-mini" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Qual è il cutoff di conoscenza di GPT-5.4 Mini?
Il cutoff di conoscenza di GPT-5.4 Mini è 2025-08, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.