GPT-5.4 Mini ist OpenAIs „bislang stärkstes Mini-Modell für Coding, Computer Use und Subagenten“ und bringt die Stärken von GPT-5.4 in eine schnellere, effizientere Stufe.
- Eingabe
- Text Bild $0.75/M
- Ausgabe
- Text $4.5/M
- Cache-Read
- $0.375/M
- Kontext
- 400K
- vs. GPT-4o
- ~85% günstiger
- Knowledge Cutoff
- 2025-08
Benchmarks
Herstellerangaben: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai
Preis im Vergleich
Preisposition unter 60 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Tokens
| Kontextfenster (Herstellerangabe) | 400.000 |
|---|---|
| Max. Output (Anbieter-Spezifikation) | 128.000 |
| Knowledge Cutoff | 2025-08 |
Prompt Caching
| Modus | automatisch |
|---|---|
| Min. Präfix | 1.024 |
| Lebensdauer | 5-10 Min., bis zu 1 Std. |
Thinking
| Anbieter-Parameter | reasoning.effort |
|---|---|
| Zulässige Werte | none · low · medium · high · xhigh |
| Standardwert | none gilt, wenn die Anfrage nichts angibt |
| Abschaltbar | Ja |
| Parameter | reasoning_effort |
| Werte | minimal · low · medium · high die Parameteroberfläche des Gateways - das Anbieter-Mapping oben gilt |
Modell
| Modalitäten | Text + Bild → Text |
|---|
- Positioniert als das stärkste Mini-Modell für Coding, Computer Use und Subagenten
- 400k Kontext / 128k max. Output
GPT-5.4 Mini in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-mini",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-mini",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-mini",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-mini")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Über GPT-5.4 Mini
- Es bietet ein Kontextfenster von 400K Token, maximal 128K Output-Token, Bildeingabe und volle Unterstützung für Streaming, Function Calling und strukturierte Ausgaben, zu einem Bruchteil des Flaggschiff-Preises.
- OpenAIs Release Note rahmt es als Modell, das Fähigkeiten der GPT-5.4-Klasse in ein schnelleres, effizienteres Modell für Workloads mit hohem Volumen bringt, und nennt Coding, Computer Use und die Orchestrierung von Subagenten als die Workloads, für die es abgestimmt wurde.
- Entscheidend für Agent-Entwickler: Es behält die vollständige Tool-Liste des Flaggschiffs (Function Calling, Websuche, Dateisuche, Tool-Suche, Bildgenerierung, Code Interpreter, gehostete Shell, Apply Patch, Skills, Computer Use und MCP), und das ist die Linie, die es von der günstigeren Nano-Stufe trennt.
- Der Reasoning-Aufwand umfasst none, low, medium, high und xhigh und steht standardmäßig auf none, und Compaction wird für lange Sitzungen unterstützt.
- Die dokumentierte Input-Obergrenze innerhalb des 400K-Fensters liegt bei 272K Token, und der Knowledge Cutoff liegt im August 2025.
- Chat Completions, Responses und Batch sind upstream alle verfügbar, dazu Prompt-Caching mit seinem vergünstigten Satz für gecachte Eingaben, und der ausgelieferte Snapshot ist auf März 2026 datiert.
- Da sein Fenster bei 400K endet, überschreitet es nie die Long-Context-Abrechnungsschwelle, die die Modelle der 1M-Klasse neu bepreist, sodass die Kosten mit wachsenden Prompts linear bleiben.
- Anfragen an GPT-5.4 Mini laufen auf Synthorai über denselben OpenAI-kompatiblen Endpoint wie bei jedem GPT-Modell.
FAQ
Lässt sich die GPT-5.4 Mini API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $0.75/M Input-Tokens deckt allein dieses Guthaben rund 166 Requests mit je ~8K Tokens gegen GPT-5.4 Mini ab.
Worin ist GPT-5.4 Mini am besten?
Stärkstes Mini für Coding und Subagenten; ein Bruchteil des Flaggschiff-Preises; 400K Kontext mit 128K Output. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet GPT-5.4 Mini?
GPT-5.4 Mini kostet auf Synthorai $0.75 pro Million Input-Tokens und $4.5 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $0.375/M abgerechnet.
Unterstützt GPT-5.4 Mini Prompt-Caching?
Ja, automatisch: Über OpenAI ausgelieferte Prompts werden ohne Codeänderungen gecacht. Gecachte Input-Tokens werden mit $0.375/M statt $0.75/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden (TTL 5-10 Min., bis zu 1 Std.). Prompt-Caching-Guide →
Wie erhalte ich Zugang zu GPT-5.4 Mini?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gpt-5.4-mini", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Wo liegt der Knowledge Cutoff von GPT-5.4 Mini?
Der Knowledge Cutoff von GPT-5.4 Mini liegt bei 2025-08, laut offizieller Dokumentation des Anbieters (Stand: 2026-07-09).
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.