Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Claude Sonnet 4.5

Veröffentlicht 2025-09-29

chatCodeReasoningTool-AufrufeVisionPrompt Caching

Claude Sonnet 4.5 ist ein Sonnet-Modell der vorherigen Generation, das auf der Claude-Plattform weiterhin verfügbar ist.

Eingabe
Text Bild $3/M
Ausgabe
Text $15/M
Cache-Read
$0.3/M
Kontext
200K
vs. GPT-4o
~40% günstiger
Knowledge Cutoff
2025-01

Benchmarks

Über dem Durchschnitt1 / 6
Claude Sonnet 4.5 weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
SciCode
45%
GPQA Diamond
83%

Herstellerangaben: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preis im Vergleich

Preisposition unter 60 vergleichbaren Modellen

Eingabe$3/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Ausgabe$15/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Cache-Lesen$0.3/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.

Spezifikationen & Limits

Tokens

Kontextfenster (Herstellerangabe) 200.000
Max. Output (Anbieter-Spezifikation) 64.000
Knowledge Cutoff 2025-01
Trainingsdaten bis 2025-07 Wissensstand 2025-01

Prompt Caching

Modus explizit (Opt-in)
Min. Präfix 1.024
Lebensdauer Standard 5 Min., optional 1 Std.
Schreibkosten 1.25x (5m) / 2x (1h)

Thinking

Anbieter-Parameter thinking.type "enabled" + budget_tokens
Zulässige Werte budget_tokens at least 1,024 and below max_tokens; "adaptive" returns 400
Standardwert aus, ohne Thinking, sofern die Anfrage es nicht setzt gilt, wenn die Anfrage nichts angibt
Abschaltbar Ja
Thinking-Verhalten Nur Extended Thinking, ohne effort-Parameter; die Thinking-Blöcke früherer Turns werden entfernt, nur der letzte bleibt erhalten; Interleaved Thinking erfordert den Beta-Header interleaved-thinking-2025-05-14.
Parameter reasoning_effort
Werte minimal · low · medium · high die Parameteroberfläche des Gateways - das Anbieter-Mapping oben gilt

Modell

Modalitäten Text + Bild → Text
  • Legacy-Modell
  • die 1M-Kontext-Beta (context-1m-2025-08-07) wurde am 2026-04-30 eingestellt, jetzt begrenzt auf 200k Kontext / 64k max. Output

laut Offizielle Anthropic-Dokumentation ↗

Claude Sonnet 4.5 in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-sonnet-4-5",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Über Claude Sonnet 4.5

  • Es verbindet schnelle vergleichsweise Latenz mit starkem Reasoning und unterstützt ein Kontextfenster von 200K Token, bis zu 64K Output-Token, Extended Thinking, Bildeingabe und den vollständigen Tool-Nutzungs-Stack von Claude zu $3/$15 pro Million Token.
  • Anthropic führte es als sein bestes Modell für komplexe Agenten und Coding ein, mit der damals höchsten Intelligenz über die meisten Aufgaben hinweg, und es ist die Version, mit der strukturierte Ausgaben erstmals in einer öffentlichen Beta ausgeliefert wurden, bevor sie allgemein verfügbar wurden.
  • Eine Grenze sollte man kennen, bevor man einen Workload dimensioniert: Seine Beta für 1M Token Kontext wurde im April 2026 eingestellt, und Anfragen oberhalb des Standardfensters von 200K geben nun einen Fehler zurück, statt stillschweigend abzuschneiden.
  • Thinking ist der ältere Extended-Thinking-Stil mit einem expliziten Token-Budget, der Thinking-Typ adaptive gibt einen Fehler zurück, und es gibt keinen effort-Parameter; Interleaved Thinking erfordert einen Beta-Header, und Thinking-Blöcke aus früheren Turns werden entfernt statt weitergeführt.
  • Prompt-Caching beginnt bei einem Präfix von 1.024 Token.
  • Anthropic empfiehlt inzwischen neuere Sonnet-Versionen für bessere Leistung, doch Sonnet 4.5 bleibt ein stabiler, angepinnter Snapshot für darauf abgestimmte Workloads.
  • Synthorai stellt es weiterhin hinter derselben OpenAI-kompatiblen API wie den Rest des Katalogs bereit.

FAQ

Lässt sich die Claude Sonnet 4.5 API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $3/M Input-Tokens deckt allein dieses Guthaben rund 41 Requests mit je ~8K Tokens gegen Claude Sonnet 4.5 ab.

Worin ist Claude Sonnet 4.5 am besten?

Schnelle Latenz gepaart mit starkem Reasoning; $3/$15 pro Million mit 200K Kontext; stabiler, angepinnter Snapshot für abgestimmte Workloads. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet Claude Sonnet 4.5?

Claude Sonnet 4.5 kostet auf Synthorai $3 pro Million Input-Tokens und $15 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $0.3/M abgerechnet.

Unterstützt Claude Sonnet 4.5 Prompt-Caching?

Ja, per Opt-in: Markieren Sie stabile Präfixe mit cache_control-Breakpoints. Gecachte Input-Tokens werden mit $0.3/M statt $3/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden (TTL Standard 5 Min., optional 1 Std.). Prompt-Caching-Guide →

Wie erhalte ich Zugang zu Claude Sonnet 4.5?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="claude-sonnet-4-5", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Wo liegt der Knowledge Cutoff von Claude Sonnet 4.5?

Der Knowledge Cutoff von Claude Sonnet 4.5 liegt bei 2025-01, laut offizieller Dokumentation des Anbieters (Stand: 2026-07-09).

Verwandte Modelle

Vergleichen

Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.

API-Schlüssel abrufen Ihre Kosten vergleichen →