GPT-5.4 Pro ist die Premium-Reasoning-Stufe der GPT-5.4-Familie: Laut OpenAI „nutzt es mehr Rechenleistung, um gründlicher nachzudenken und durchgängig bessere Antworten zu liefern“, und erzeugt klügere, präzisere Antworten auf schwierige Probleme.
- Eingabe
- Text Bild $30/M
- Ausgabe
- Text $180/M
- Cache-Read
- $15/M
- Kontext
- 922K
- Knowledge Cutoff
- 2025-08
Benchmarks
Herstellerangaben: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
Preis im Vergleich
Preisposition unter 60 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Tokens
| Kontextfenster (Herstellerangabe) | 1.050.000 |
|---|---|
| Max. Output (Anbieter-Spezifikation) | 128.000 |
| Knowledge Cutoff | 2025-08 |
Prompt Caching
| Modus | automatisch |
|---|---|
| Min. Präfix | 1.024 |
| Lebensdauer | 5-10 Min., bis zu 1 Std. |
Thinking
| Anbieter-Parameter | reasoning.effort |
|---|---|
| Zulässige Werte | medium · high · xhigh |
| Standardwert | medium gilt, wenn die Anfrage nichts angibt |
| Abschaltbar | Nein |
| Thinking-Verhalten | Nur Responses API; Anfragen können mehrere Minuten dauern, daher empfiehlt OpenAI den Background-Modus. |
| Parameter | reasoning_effort |
| Werte | minimal · low · medium · high die Parameteroberfläche des Gateways - das Anbieter-Mapping oben gilt |
Modell
| Modalitäten | Text + Bild → Text |
|---|
- Pro-Stufe mit höherem Rechenaufwand
- strukturierte Ausgaben werden nicht unterstützt
- die Nutzung über mehrere Turns läuft nur über die Responses API
- Anfragen können Minuten dauern (Background-Modus empfohlen)
- 1.05M Kontext
GPT-5.4 Pro in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-pro",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-pro",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-pro",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-pro",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-pro")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Über GPT-5.4 Pro
- Es behält das Kontextfenster von 1.050.000 Token (Herstellerangabe) und den maximalen Output von 128K, akzeptiert Bildeingabe und unterstützt Reasoning-Aufwand bei medium, high und xhigh; langlaufende Anfragen können mehrere Minuten dauern, weshalb Ausführung im Hintergrund empfohlen wird.
- Das Fehlen von none und low ist der Sinn dieser Stufe: Ihre Untergrenze ist Abwägung, nicht Geschwindigkeit.
- OpenAI beschränkt es auf die Responses API und erklärt, dass erst dies mehrstufige Modellinteraktionen erlaubt, bevor eine Anfrage beantwortet wird, und die Batch API wird bei diesem Modell ausdrücklich nicht unterstützt.
- Seine Tool-Liste umfasst Function Calling, Websuche, Dateisuche, Tool-Suche, Bildgenerierung, Apply Patch, Computer Use und MCP.
- Es gilt dieselbe Long-Context-Abrechnungsregel wie bei GPT-5.4: Prompts über 272K Input-Token werden für die gesamte Anfrage mit 2x Input und 1,5x Output berechnet.
- Der Knowledge Cutoff liegt im August 2025, und der ausgelieferte Snapshot ist auf März 2026 datiert.
- Reservieren Sie es für Probleme, bei denen eine bessere Antwort Minuten an Latenz und ein Vielfaches der Kosten pro Token wert ist.
- Synthorai macht GPT-5.4 Pro über seine OpenAI-kompatible Schnittstelle direkt neben den Standardmodellen aufrufbar.
FAQ
Lässt sich die GPT-5.4 Pro API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $30/M Input-Tokens deckt allein dieses Guthaben rund 4 Requests mit je ~8K Tokens gegen GPT-5.4 Pro ab.
Worin ist GPT-5.4 Pro am besten?
Nutzt mehr Rechenleistung für gründlicheres Nachdenken; durchgängig bessere Antworten auf schwierige Probleme; Hintergrundausführung für mehrminütige Anfragen. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet GPT-5.4 Pro?
GPT-5.4 Pro kostet auf Synthorai $30 pro Million Input-Tokens und $180 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $15/M abgerechnet.
Unterstützt GPT-5.4 Pro Prompt-Caching?
Ja, automatisch: Über OpenAI ausgelieferte Prompts werden ohne Codeänderungen gecacht. Gecachte Input-Tokens werden mit $15/M statt $30/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden (TTL 5-10 Min., bis zu 1 Std.). Prompt-Caching-Guide →
Wie erhalte ich Zugang zu GPT-5.4 Pro?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gpt-5.4-pro", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Wo liegt der Knowledge Cutoff von GPT-5.4 Pro?
Der Knowledge Cutoff von GPT-5.4 Pro liegt bei 2025-08, laut offizieller Dokumentation des Anbieters (Stand: 2026-07-09).
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.