GPT-5.4 Nano ist OpenAIs „günstigstes Modell der GPT-5.4-Klasse für einfache Aufgaben mit hohem Volumen“, und seine Seite benennt die Arbeit präzise: Klassifikation, Datenextraktion, Ranking und Subagenten, wo Geschwindigkeit und Kosten am meisten zählen.
- Eingabe
- Text Bild $0.2/M
- Ausgabe
- Text $1.25/M
- Cache-Read
- $0.1/M
- Kontext
- 400K
- vs. GPT-4o
- ~96% günstiger
- Knowledge Cutoff
- 2025-08
Preis im Vergleich
Preisposition unter 60 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Tokens
| Kontextfenster (Herstellerangabe) | 400.000 |
|---|---|
| Max. Output (Anbieter-Spezifikation) | 128.000 |
| Knowledge Cutoff | 2025-08 |
Prompt Caching
| Modus | automatisch |
|---|---|
| Min. Präfix | 1.024 |
| Lebensdauer | 5-10 Min., bis zu 1 Std. |
Thinking
| Anbieter-Parameter | reasoning.effort |
|---|---|
| Zulässige Werte | none · low · medium · high · xhigh |
| Standardwert | none gilt, wenn die Anfrage nichts angibt |
| Abschaltbar | Ja |
| Parameter | reasoning_effort |
| Werte | minimal · low · medium · high die Parameteroberfläche des Gateways - das Anbieter-Mapping oben gilt |
Modell
| Modalitäten | Text + Bild → Text |
|---|
- Günstigstes Modell der GPT-5.4-Klasse, ausgerichtet auf Klassifikation, Extraktion, Ranking und Subagenten
- Computer Use und Tool Search werden nicht unterstützt
GPT-5.4 Nano in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-nano",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-nano",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-nano",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-nano",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-nano")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Über GPT-5.4 Nano
- Es behält das Kontextfenster von 400K Token und die maximal 128K Output-Token der Familie, tauscht dabei aber maximale Reasoning-Tiefe gegen Geschwindigkeit und Kosteneffizienz, und unterstützt Streaming, Function Calling und strukturierte Ausgaben, mit einem Knowledge Cutoff im August 2025.
- Der Reasoning-Aufwand reicht von none, dem Standard, über low, medium und high bis xhigh, sodass mehr Abwägung verfügbar ist, wenn ein schwieriger Fall es rechtfertigt, dafür zu zahlen.
- Der Fähigkeitsunterschied zu GPT-5.4 Mini ist konkret und dokumentiert statt vage: Tool-Suche und integriertes Computer Use fehlen in Nanos Tool-Liste, während Function Calling, Websuche, Dateisuche, Bildgenerierung, Code Interpreter, gehostete Shell, Apply Patch, Skills und MCP alle erhalten bleiben.
- Prompt-Caching mit seinem vergünstigten Satz für gecachte Eingaben, Compaction, Bildeingabe und die Batch API werden über Chat Completions und Responses hinweg unterstützt, und die dokumentierte Input-Obergrenze innerhalb des Fensters liegt bei 272K Token.
- Es wurde im März 2026 zusammen mit GPT-5.4 Mini als datierter Snapshot ausgeliefert, sodass ein angepinnter Build reproduzierbar bleibt.
- Wenn das Budget pro Aufruf die bindende Beschränkung ist und die Aufgabe eine klar definierte Transformation statt offenem Reasoning, ist es die Option der Familie für hohes Volumen.
- Synthorai stellt GPT-5.4 Nano über die standardmäßige OpenAI-kompatible Chat-Schnittstelle bereit.
FAQ
Lässt sich die GPT-5.4 Nano API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $0.2/M Input-Tokens deckt allein dieses Guthaben rund 625 Requests mit je ~8K Tokens gegen GPT-5.4 Nano ab.
Worin ist GPT-5.4 Nano am besten?
Günstigstes Modell seiner Klasse; tauscht Reasoning-Tiefe gegen Geschwindigkeit und Kosten; behält 400K Kontext und 128K Output. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet GPT-5.4 Nano?
GPT-5.4 Nano kostet auf Synthorai $0.2 pro Million Input-Tokens und $1.25 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $0.1/M abgerechnet.
Unterstützt GPT-5.4 Nano Prompt-Caching?
Ja, automatisch: Über OpenAI ausgelieferte Prompts werden ohne Codeänderungen gecacht. Gecachte Input-Tokens werden mit $0.1/M statt $0.2/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden (TTL 5-10 Min., bis zu 1 Std.). Prompt-Caching-Guide →
Wie erhalte ich Zugang zu GPT-5.4 Nano?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gpt-5.4-nano", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Wo liegt der Knowledge Cutoff von GPT-5.4 Nano?
Der Knowledge Cutoff von GPT-5.4 Nano liegt bei 2025-08, laut offizieller Dokumentation des Anbieters (Stand: 2026-07-09).
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.