Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

GPT-5.4 Mini

Veröffentlicht 2026-03-16

chatVisionCodeTool-AufrufeReasoningPrompt Caching

GPT-5.4 Mini ist OpenAIs „bislang stärkstes Mini-Modell für Coding, Computer Use und Subagenten“ und bringt die Stärken von GPT-5.4 in eine schnellere, effizientere Stufe.

Eingabe
Text Bild $0.75/M
Ausgabe
Text $4.5/M
Cache-Read
$0.375/M
Kontext
400K
vs. GPT-4o
~85% günstiger
Knowledge Cutoff
2025-08

Benchmarks

Über dem Durchschnitt2 / 10
GPT-5.4 Mini weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
SWE-Bench Pro
54.4%
OSWorld-Verified
72.1%
GDPval-AA v2 Elo · 642-1861
1171
GPQA Diamond
88%
CharXiv (RQ) no tools
80.3%

Herstellerangaben: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

Preis im Vergleich

Preisposition unter 60 vergleichbaren Modellen

Eingabe$0.75/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Ausgabe$4.5/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Cache-Lesen$0.375/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.

Spezifikationen & Limits

Tokens

Kontextfenster (Herstellerangabe) 400.000
Max. Output (Anbieter-Spezifikation) 128.000
Knowledge Cutoff 2025-08

Prompt Caching

Modus automatisch
Min. Präfix 1.024
Lebensdauer 5-10 Min., bis zu 1 Std.

Thinking

Anbieter-Parameter reasoning.effort
Zulässige Werte none · low · medium · high · xhigh
Standardwert none gilt, wenn die Anfrage nichts angibt
Abschaltbar Ja
Parameter reasoning_effort
Werte minimal · low · medium · high die Parameteroberfläche des Gateways - das Anbieter-Mapping oben gilt

Modell

Modalitäten Text + Bild → Text
  • Positioniert als das stärkste Mini-Modell für Coding, Computer Use und Subagenten
  • 400k Kontext / 128k max. Output

laut Offizielle OpenAI-Dokumentation ↗

GPT-5.4 Mini in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Über GPT-5.4 Mini

  • Es bietet ein Kontextfenster von 400K Token, maximal 128K Output-Token, Bildeingabe und volle Unterstützung für Streaming, Function Calling und strukturierte Ausgaben, zu einem Bruchteil des Flaggschiff-Preises.
  • OpenAIs Release Note rahmt es als Modell, das Fähigkeiten der GPT-5.4-Klasse in ein schnelleres, effizienteres Modell für Workloads mit hohem Volumen bringt, und nennt Coding, Computer Use und die Orchestrierung von Subagenten als die Workloads, für die es abgestimmt wurde.
  • Entscheidend für Agent-Entwickler: Es behält die vollständige Tool-Liste des Flaggschiffs (Function Calling, Websuche, Dateisuche, Tool-Suche, Bildgenerierung, Code Interpreter, gehostete Shell, Apply Patch, Skills, Computer Use und MCP), und das ist die Linie, die es von der günstigeren Nano-Stufe trennt.
  • Der Reasoning-Aufwand umfasst none, low, medium, high und xhigh und steht standardmäßig auf none, und Compaction wird für lange Sitzungen unterstützt.
  • Die dokumentierte Input-Obergrenze innerhalb des 400K-Fensters liegt bei 272K Token, und der Knowledge Cutoff liegt im August 2025.
  • Chat Completions, Responses und Batch sind upstream alle verfügbar, dazu Prompt-Caching mit seinem vergünstigten Satz für gecachte Eingaben, und der ausgelieferte Snapshot ist auf März 2026 datiert.
  • Da sein Fenster bei 400K endet, überschreitet es nie die Long-Context-Abrechnungsschwelle, die die Modelle der 1M-Klasse neu bepreist, sodass die Kosten mit wachsenden Prompts linear bleiben.
  • Anfragen an GPT-5.4 Mini laufen auf Synthorai über denselben OpenAI-kompatiblen Endpoint wie bei jedem GPT-Modell.

FAQ

Lässt sich die GPT-5.4 Mini API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $0.75/M Input-Tokens deckt allein dieses Guthaben rund 166 Requests mit je ~8K Tokens gegen GPT-5.4 Mini ab.

Worin ist GPT-5.4 Mini am besten?

Stärkstes Mini für Coding und Subagenten; ein Bruchteil des Flaggschiff-Preises; 400K Kontext mit 128K Output. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet GPT-5.4 Mini?

GPT-5.4 Mini kostet auf Synthorai $0.75 pro Million Input-Tokens und $4.5 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $0.375/M abgerechnet.

Unterstützt GPT-5.4 Mini Prompt-Caching?

Ja, automatisch: Über OpenAI ausgelieferte Prompts werden ohne Codeänderungen gecacht. Gecachte Input-Tokens werden mit $0.375/M statt $0.75/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden (TTL 5-10 Min., bis zu 1 Std.). Prompt-Caching-Guide →

Wie erhalte ich Zugang zu GPT-5.4 Mini?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gpt-5.4-mini", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Wo liegt der Knowledge Cutoff von GPT-5.4 Mini?

Der Knowledge Cutoff von GPT-5.4 Mini liegt bei 2025-08, laut offizieller Dokumentation des Anbieters (Stand: 2026-07-09).

Verwandte Modelle

Vergleichen

Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.

API-Schlüssel abrufen Ihre Kosten vergleichen →