Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Claude Fable 5.1 vs GLM-5.3-Flash

Claude Fable 5.1 wird auf Einladung bereitgestellt. Die untenstehenden Zahlen entsprechen den Live-Raten, aber Aufrufe erfordern zunächst eine Workspace-Berechtigung; fordern Sie bei uns Zugang an, bevor Sie auf diesem Vergleich aufbauen.

vs

Welches Modell, wann

Beide Modelle haben 1M-token Kontextfenster und bei keinem lässt sich das Thinking deaktivieren, daher liegt der eigentliche Unterschied in Preis und Eingaben: glm-5.3-flash kostet $0.15 bei der Eingabe und $0.5 bei der Ausgabe gegenüber $10 und $50 für claude-fable-5-1, was ungefähr 67x und 100x günstiger ist, und es akzeptiert Video neben Text und Bild, während es auch bis zu 163840 Ausgabe-Tokens im Vergleich zu 128000 zulässt. Greifen Sie zu glm-5.3-flash für hochvolumige oder videogespeiste Arbeiten, bei denen die Kosten pro Million wichtig sind, und für die günstigeren $0.03 Cache-Reads. Wählen Sie claude-fable-5-1, wenn Sie die neuere Generation von Anthropic mit einem Knowledge-Cutoff von 2026-06 wünschen.

Benchmarks

Über dem DurchschnittKeins besserClaude Fable 5.17 / 77 / 7GLM-5.3-Flash4 / 50 / 5
Claude Fable 5.1 GLM-5.3-Flash weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
Terminal-Bench 2.1
N/A
84.3%
OSWorld 2.0 partial
77.9%
N/A
GDPval-AA v2 Elo · 1711-1853 laut Anthropic · 2026-09-05
kein anderes Modell war besser 1853
N/A
Humanity's Last Exam with tools
kein anderes Modell war besser 65%
55.3%
Agents' Last Exam
N/A
26.3%

Herstellerangaben: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preise

Claude Fable 5.1 GLM-5.3-Flash Δ
Input / 1M Token $10 $0.15 67×
Output / 1M Token $50 $0.5 100×
Cache-Read / 1M Token $0.25 $0.03 8.3×
Cache-Schreiben 1.25x (5m) / 2x (1h) - -

Preise aus dem Live-Katalog zum Zeitpunkt des Builds; jede Modellseite enthält die aktuelle Übersicht.

Wo sie stehen - Eingabepreis pro 1M Tokens über alle 67 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Fähigkeiten

Claude Fable 5.1 GLM-5.3-Flash
Tool-Nutzung ja ja
Thinking-Kontrolle immer aktiv immer aktiv
Strukturierte Ausgabe ja ja
Prompt-Caching explizit (Sie markieren das Präfix) implizit (automatisch)
Cache-Lebensdauer 5m default, 1h option nicht veröffentlicht
Minimales gecachtes Präfix 1024 Tokens nicht veröffentlicht

Spezifikationen

Claude Fable 5.1 GLM-5.3-Flash
Input-Modalitäten Text Bild Text Bild Video
Ausgabemodalitäten Text Text
Veröffentlicht 2026-09-01 -
Wissensgrenze 2026-06 -
Kontextfenster 1M 1M
Maximaler Output 128K 164K
Thinking-Parameter output_config.effort (thinking is adaptive-only and always on) reasoning_effort
Zulässige Werte
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
Standardwert

thinking always on (adaptive)

effort
  • high
max

Die Spezifikationen sind aus der Dokumentation der jeweiligen Anbieter übernommen; eine Zeile, die ein Anbieter nicht veröffentlicht, wird weggelassen und nicht abgeleitet. Vollständige Quellen: Claude Fable 5.1 · GLM-5.3-Flash

Mit einer Zeile zwischen ihnen wechseln

Beide IDs befinden sich in jedem Tab unten - das hervorgehobene Zeilenpaar ist die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiche Request-Struktur.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="glm-5.3-flash",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API-Schlüssel abrufen →

FAQ

Welches ist günstiger, Claude Fable 5.1 oder GLM-5.3-Flash?

GLM-5.3-Flash ist günstiger bei input / 1m token ($0.15 vs. $10, 67× Unterschied). Andere Zeilen können in die andere Richtung deuten - die obige Tabelle enthält alle Daten, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich Claude Fable 5.1 gegen GLM-5.3-Flash ohne zwei Integrationen A/B-testen?

Ja. Beide werden über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel bereitgestellt - der Wechsel ist eine einzeilige Änderung des Modell-Strings, sodass Sie einen Bruchteil des Traffics an jedes Modell leiten und die Rechnungen direkt vergleichen können.

Unterstützen Claude Fable 5.1 und GLM-5.3-Flash Prompt-Caching?

Ja - beide berechnen Cache-Reads günstiger als ihre Eingaberate, sodass Warm-Prefix-Workloads weniger kosten, als die Listenpreise vermuten lassen. Die genauen Zeilen für Cache-Reads befinden sich in der obigen Preistabelle.

Verwandte Vergleiche

Aus unseren gemessenen Studien