GPT-5.4 Pro è il livello di ragionamento premium della famiglia GPT-5.4: secondo OpenAI "usa più calcolo per pensare più a fondo e fornire risposte costantemente migliori", producendo risposte più intelligenti e precise sui problemi difficili.
- Input
- testo immagine $30/M
- Output
- testo $180/M
- Lettura cache
- $15/M
- Contesto
- 922K
- Cutoff di conoscenza
- 2025-08
Benchmark
Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
Il prezzo nel contesto
Posizione del prezzo tra 60 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 1.050.000 |
|---|---|
| Output massimo (specifica del vendor) | 128.000 |
| Cutoff di conoscenza | 2025-08 |
Caching prompt
| Modalità | automatico |
|---|---|
| Prefisso min. | 1.024 |
| Durata | 5-10 min, fino a 1 ora |
Ragionamento
| Parametro del fornitore | reasoning.effort |
|---|---|
| Valori accettati | medium · high · xhigh |
| Valore predefinito | medium applicato se la richiesta non specifica nulla |
| Disattivabile | No |
| Comportamento del ragionamento | Solo Responses API; le richieste possono richiedere diversi minuti, quindi OpenAI consiglia la background mode. |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine → testo |
|---|
- Livello pro con più capacità di calcolo
- output strutturati non supportati
- l'uso multi-turno è disponibile solo sulla Responses API
- le richieste possono richiedere minuti (consigliata la background mode)
- 1,05M di contesto
Usa GPT-5.4 Pro in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-pro",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-pro",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-pro",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-pro",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-pro")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su GPT-5.4 Pro
- Mantiene la finestra di contesto da 1.050.000 token (specifica del vendor) e i 128K di output massimo, accetta input di immagini e supporta il reasoning effort a medium, high e xhigh; le richieste prolungate possono richiedere diversi minuti, quindi è consigliata l'esecuzione in background.
- L'assenza di none e low è il senso stesso del livello: il suo minimo è la deliberazione, non la velocità.
- OpenAI lo limita alla Responses API, spiegando che è questo a consentire interazioni multi-turno del modello prima che una richiesta riceva risposta, e la Batch API è esplicitamente non supportata su questo modello.
- Il suo elenco di strumenti copre function calling, ricerca web, ricerca file, tool search, generazione di immagini, apply patch, computer use e MCP.
- Vale la stessa regola di fatturazione a contesto lungo di GPT-5.4: i prompt sopra i 272K token di input sono addebitati a 2x l'input e 1,5x l'output per l'intera richiesta.
- Il cutoff di conoscenza è agosto 2025 e lo snapshot distribuito è datato marzo 2026.
- Riservalo ai problemi in cui una risposta migliore vale minuti di latenza e un costo per token di diverse volte superiore.
- Synthorai rende GPT-5.4 Pro richiamabile tramite la sua interfaccia compatibile OpenAI, accanto ai modelli standard.
FAQ
L'API di GPT-5.4 Pro si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $30/M token in input, quel credito da solo copre circa 4 richieste da ~8K token verso GPT-5.4 Pro.
In cosa eccelle GPT-5.4 Pro?
Più calcolo per pensare più a fondo; risposte costantemente migliori su problemi difficili; esecuzione in background per richieste di più minuti. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa GPT-5.4 Pro?
Su Synthorai, GPT-5.4 Pro costa $30 per milione di token in input e $180 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $15/M.
GPT-5.4 Pro supporta il caching dei prompt?
Sì, in automatico: i prompt serviti da OpenAI vanno in cache senza modifiche al codice. I token di input in cache si fatturano a $15/M contro $30/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5-10 min, fino a 1 ora). Guida al caching dei prompt →
Come ottengo l'accesso a GPT-5.4 Pro?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-5.4-pro" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Qual è il cutoff di conoscenza di GPT-5.4 Pro?
Il cutoff di conoscenza di GPT-5.4 Pro è 2025-08, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.