GPT-5.4 Nano è il "modello di classe GPT-5.4 più economico per compiti semplici ad alto volume" di OpenAI, e la sua pagina nomina il lavoro con precisione: classificazione, estrazione di dati, ranking e sub-agent, dove velocità e costo contano di più.
- Input
- testo immagine $0.2/M
- Output
- testo $1.25/M
- Lettura cache
- $0.1/M
- Contesto
- 400K
- vs GPT-4o
- ~96% più economico
- Cutoff di conoscenza
- 2025-08
Il prezzo nel contesto
Posizione del prezzo tra 60 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 400.000 |
|---|---|
| Output massimo (specifica del vendor) | 128.000 |
| Cutoff di conoscenza | 2025-08 |
Caching prompt
| Modalità | automatico |
|---|---|
| Prefisso min. | 1.024 |
| Durata | 5-10 min, fino a 1 ora |
Ragionamento
| Parametro del fornitore | reasoning.effort |
|---|---|
| Valori accettati | none · low · medium · high · xhigh |
| Valore predefinito | none applicato se la richiesta non specifica nulla |
| Disattivabile | Sì |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine → testo |
|---|
- Il modello di classe GPT-5.4 più economico, pensato per classificazione/estrazione/ranking/subagent
- computer use e tool search non supportati
Usa GPT-5.4 Nano in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-nano",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-nano",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-nano",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-nano",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-nano")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su GPT-5.4 Nano
- Mantiene la finestra di contesto da 400K token e i 128K di output massimo della famiglia scambiando la profondità di ragionamento di punta con velocità ed efficienza di costo, e supporta streaming, function calling e output strutturati con un cutoff di conoscenza ad agosto 2025.
- Il reasoning effort va da none, il predefinito, passando per low, medium, high e xhigh, quindi è disponibile più deliberazione quando un caso difficile giustifica il costo.
- Il divario di capacità rispetto a GPT-5.4 Mini è specifico e documentato anziché vago: la tool search e il computer use integrato sono assenti dall'elenco di strumenti di nano, mentre restano function calling, ricerca web, ricerca file, generazione di immagini, code interpreter, shell hosted, apply patch, skill e MCP.
- Il caching dei prompt con la sua tariffa scontata per l'input in cache, la compaction, l'input di immagini e la Batch API sono supportati su Chat Completions e Responses, e il tetto di input documentato entro la finestra è di 272K token.
- È stato distribuito insieme a GPT-5.4 Mini a marzo 2026 come snapshot datato, quindi una build fissata resta riproducibile.
- Quando il budget per chiamata è il vincolo stringente e il compito è una trasformazione ben definita anziché un ragionamento aperto, è l'opzione ad alto volume della famiglia.
- Synthorai serve GPT-5.4 Nano tramite la consueta interfaccia chat compatibile OpenAI.
FAQ
L'API di GPT-5.4 Nano si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $0.2/M token in input, quel credito da solo copre circa 625 richieste da ~8K token verso GPT-5.4 Nano.
In cosa eccelle GPT-5.4 Nano?
Il più economico della sua classe; profondità di ragionamento scambiata per velocità e costo; contesto da 400K e 128K di output mantenuti. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa GPT-5.4 Nano?
Su Synthorai, GPT-5.4 Nano costa $0.2 per milione di token in input e $1.25 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.1/M.
GPT-5.4 Nano supporta il caching dei prompt?
Sì, in automatico: i prompt serviti da OpenAI vanno in cache senza modifiche al codice. I token di input in cache si fatturano a $0.1/M contro $0.2/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5-10 min, fino a 1 ora). Guida al caching dei prompt →
Come ottengo l'accesso a GPT-5.4 Nano?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-5.4-nano" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Qual è il cutoff di conoscenza di GPT-5.4 Nano?
Il cutoff di conoscenza di GPT-5.4 Nano è 2025-08, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.