Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Claude Fable 5.1 vs Qwen3.8 Max

Claude Fable 5.1 wird auf Einladung bereitgestellt. Die untenstehenden Zahlen entsprechen den Live-Raten, aber Aufrufe erfordern zunächst eine Workspace-Berechtigung; fordern Sie bei uns Zugang an, bevor Sie auf diesem Vergleich aufbauen.

vs

Welches Modell, wann

Beide nehmen Text und Bild als Input entgegen und geben Text zurück, teilen sich eine Cache-Read-Rate von $0.25 und liegen bei der Kapazität im Bereich eines Rundungsfehlers beieinander - 1000000 Token Kontext und 128000 maximaler Output für claude-fable-5-1 gegenüber 983616 und 131072 für qwen3.8-max. Das Unterscheidungsmerkmal ist die Preisliste: qwen3.8-max kostet $2 Input und $6 Output im Vergleich zu $10 und $50, sodass claude-fable-5-1 5x so viel beim Input- und knapp über 8x so viel beim Output-Preis kostet, was bei langen Generierungen am stärksten ins Gewicht fällt. Wählen Sie claude-fable-5-1, wenn Sie seinen stets aktiven Thinking-Modus benötigen, und qwen3.8-max für hochvolumige Arbeiten zu einem Bruchteil der Kosten.

Benchmarks

Über dem DurchschnittKeins besserClaude Fable 5.17 / 77 / 7Qwen3.8 Max29 / 388 / 38
Claude Fable 5.1 Qwen3.8 Max weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
SWE-Bench Pro
N/A
67.7%
AndroidBench
N/A
75.1%
Cybergym
N/A
78.5%
HealthBench
N/A
kein anderes Modell war besser 60.2%
JobBench
N/A
53.4%
PLawBench
N/A
kein anderes Modell war besser 73.2%
Humanity's Last Exam no tools
kein anderes Modell war besser 60.9%
43.6%
Agents' Last Exam
N/A
27%

Herstellerangaben: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preise

Claude Fable 5.1 Qwen3.8 Max Δ
Input / 1M Token $10 $2
Output / 1M Token $50 $6 8.3×
Cache-Read / 1M Token $0.25 $0.25 =
Cache-Schreiben 1.25x (5m) / 2x (1h) 1.25x -

Preise aus dem Live-Katalog zum Zeitpunkt des Builds; jede Modellseite enthält die aktuelle Übersicht.

Wo sie stehen - Eingabepreis pro 1M Tokens über alle 67 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

Fähigkeiten

Claude Fable 5.1 Qwen3.8 Max
Tool-Nutzung ja ja
Thinking-Kontrolle immer aktiv ja - Regler des Anbieters nicht veröffentlicht
Strukturierte Ausgabe ja ja
Prompt-Caching explizit (Sie markieren das Präfix) implizit + explizit
Cache-Lebensdauer 5m default, 1h option explicit: 5m, reset on hit
Minimales gecachtes Präfix 1024 Tokens 1024 Tokens

Spezifikationen

Claude Fable 5.1 Qwen3.8 Max
Input-Modalitäten Text Bild Text Bild
Ausgabemodalitäten Text Text
Veröffentlicht 2026-09-01 2026-08-03
Wissensgrenze 2026-06 -
Kontextfenster 1M 984K
Maximaler Output 128K 131K
Thinking-Parameter output_config.effort (thinking is adaptive-only and always on) -
Zulässige Werte
effort
  • low
  • medium
  • high
  • xhigh
  • max
-
Standardwert

thinking always on (adaptive)

effort
  • high
-

Die Spezifikationen sind aus der Dokumentation der jeweiligen Anbieter übernommen; eine Zeile, die ein Anbieter nicht veröffentlicht, wird weggelassen und nicht abgeleitet. Vollständige Quellen: Claude Fable 5.1 · Qwen3.8 Max

Mit einer Zeile zwischen ihnen wechseln

Beide IDs befinden sich in jedem Tab unten - das hervorgehobene Zeilenpaar ist die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiche Request-Struktur.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="qwen3.8-max",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API-Schlüssel abrufen →

FAQ

Welches ist günstiger, Claude Fable 5.1 oder Qwen3.8 Max?

Qwen3.8 Max ist günstiger bei input / 1m token ($2 vs. $10, 5.0× Unterschied). Andere Zeilen können in die andere Richtung deuten - die obige Tabelle enthält alle Daten, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich Claude Fable 5.1 gegen Qwen3.8 Max ohne zwei Integrationen A/B-testen?

Ja. Beide werden über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel bereitgestellt - der Wechsel ist eine einzeilige Änderung des Modell-Strings, sodass Sie einen Bruchteil des Traffics an jedes Modell leiten und die Rechnungen direkt vergleichen können.

Unterstützen Claude Fable 5.1 und Qwen3.8 Max Prompt-Caching?

Ja - beide berechnen Cache-Reads günstiger als ihre Eingaberate, sodass Warm-Prefix-Workloads weniger kosten, als die Listenpreise vermuten lassen. Die genauen Zeilen für Cache-Reads befinden sich in der obigen Preistabelle.

Verwandte Vergleiche

Aus unseren gemessenen Studien