GPT-5.4 Nano est le « modèle de classe GPT-5.4 le moins cher pour les tâches simples à fort volume » d'OpenAI, et sa page nomme précisément le travail visé : classification, extraction de données, ordonnancement et sous-agents, là où la vitesse et le coût priment.
- Entrée
- texte image $0.2/M
- Sortie
- texte $1.25/M
- Lecture de cache
- $0.1/M
- Contexte
- 400K
- vs GPT-4o
- ~96% moins cher
- Coupure des connaissances
- 2025-08
Le prix en contexte
Position du prix parmi 60 modèles comparables
La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.
Spécifications et limites
Tokens
| Fenêtre de contexte (spécification du fournisseur) | 400 000 |
|---|---|
| Sortie max (spéc. fournisseur) | 128 000 |
| Coupure des connaissances | 2025-08 |
Mise en cache
| Mode | automatique |
|---|---|
| Préfixe min. | 1 024 |
| Durée de vie | 5-10 min, jusqu'à 1 heure |
Raisonnement
| Paramètre du fournisseur | reasoning.effort |
|---|---|
| Valeurs acceptées | none · low · medium · high · xhigh |
| Valeur par défaut | none appliquée si la requête ne précise rien |
| Désactivable | Oui |
| Paramètre | reasoning_effort |
| Valeurs | minimal · low · medium · high la surface de paramètres de la passerelle - le mappage fournisseur ci-dessus s'applique |
Modèle
| Modalités | texte + image → texte |
|---|
- Modèle de classe GPT-5.4 le moins cher, destiné à la classification, l'extraction, le classement et les sous-agents
- l'utilisation d'ordinateur et la recherche d'outils ne sont pas prises en charge
Utilisez GPT-5.4 Nano en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-nano",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-nano",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-nano",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-nano",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-nano")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));À propos de GPT-5.4 Nano
- Il conserve la fenêtre de contexte de 400K tokens et les 128K de sortie maximale de la famille tout en échangeant la profondeur de raisonnement maximale contre de la vitesse et de l'efficacité de coût, et prend en charge le streaming, l'appel de fonctions et les sorties structurées avec une date limite des connaissances en août 2025.
- L'effort de raisonnement va de none, la valeur par défaut, à low, medium, high et xhigh, de sorte qu'une délibération accrue reste disponible quand un cas difficile justifie d'en payer le prix.
- L'écart de capacités face à GPT-5.4 Mini est précis et documenté plutôt que vague : la recherche d'outils et l'utilisation de l'ordinateur intégrée sont absentes de la liste d'outils de nano, tandis que l'appel de fonctions, la recherche web, la recherche de fichiers, la génération d'images, l'interpréteur de code, le shell hébergé, apply patch, les skills et MCP demeurent tous.
- La mise en cache des prompts avec son tarif réduit d'entrée mise en cache, la compaction, l'entrée d'images et la Batch API sont prises en charge sur Chat Completions comme sur Responses, et le plafond d'entrée documenté à l'intérieur de la fenêtre est de 272K tokens.
- Il a été livré aux côtés de GPT-5.4 Mini en mars 2026 sous forme de snapshot daté, ce qui garde une build épinglée reproductible.
- Quand le budget par appel est la contrainte déterminante et que la tâche est une transformation bien définie plutôt qu'un raisonnement ouvert, c'est l'option à fort volume de la famille.
- Synthorai sert GPT-5.4 Nano via l'interface de chat standard compatible OpenAI.
FAQ
Peut-on essayer l'API GPT-5.4 Nano gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $0.2/M de tokens en entrée, ce crédit couvre à lui seul environ 625 requêtes de ~8K tokens sur GPT-5.4 Nano.
Quels sont les points forts de GPT-5.4 Nano ?
Le moins cher de sa classe ; troque la profondeur de raisonnement contre vitesse et coût ; conserve le contexte de 400K et 128K en sortie. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte GPT-5.4 Nano ?
Sur Synthorai, GPT-5.4 Nano coûte $0.2 par million de tokens en entrée et $1.25 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.1/M.
GPT-5.4 Nano prend-il en charge la mise en cache des prompts ?
Oui, automatiquement : les prompts servis par OpenAI sont mis en cache sans modification de code. Les tokens d'entrée en cache sont facturés $0.1/M contre $0.2/M hors cache ; les prompts doivent avoir un préfixe stable de 1,024 tokens pour être mis en cache (TTL 5-10 min, jusqu'à 1 heure). Guide de mise en cache des prompts →
Comment obtenir l'accès à GPT-5.4 Nano ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="gpt-5.4-nano", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.
Quelle est la date de coupure des connaissances de GPT-5.4 Nano ?
La date de coupure des connaissances de GPT-5.4 Nano est 2025-08, selon la documentation officielle du fournisseur (au 2026-07-09).
Modèles associés
Comparer
Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.