Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Claude Fable 5.1 vs Gemini 3.7 Flash

Claude Fable 5.1 wird auf Einladung bereitgestellt. Die untenstehenden Zahlen entsprechen den Live-Raten, aber Aufrufe erfordern zunächst eine Workspace-Berechtigung; fordern Sie bei uns Zugang an, bevor Sie auf diesem Vergleich aufbauen.

vs

Welches Modell, wann

gemini-3.7-flash ist die günstigere Option mit breiteren Eingabemöglichkeiten: $0.75 Input und $3.75 Output pro Million Token, ungefähr 13x weniger als claude-fable-5-1 mit $10 und $50, bei einem 1048576-Token-Kontext und Text, Bild, Audio und Video als Eingabe (Audio-Input wird ebenfalls pro Million Token berechnet, mit $0.75). Wählen Sie claude-fable-5-1, wenn Sie dessen immer aktiven Thinking-Modus benötigen, der nicht deaktiviert werden kann, sowie 128000 maximale Output-Token gegenüber 65536, bei einem 1000000-Token-Kontext. Wenn Ihre Eingaben aus Text und Bildern bestehen und Sie kostenbewusst sind, deckt das Google-Modell dies ab; Cache-Lesezugriffe kosten $0.075 gegenüber $0.25.

Benchmarks

Über dem DurchschnittKeins besserClaude Fable 5.17 / 77 / 7Gemini 3.7 Flash17 / 234 / 23
Claude Fable 5.1 Gemini 3.7 Flash weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
Terminal-bench 4.0
kein anderes Modell war besser 55.8%
11.2%
BioMysteryBench hard
N/A
43.5%
OSWorld 2.0
N/A
47.9%
Finance Agent v2
N/A
59%
Harvey Lab-AA
N/A
90.7%
Humanity's Last Exam no tools
kein anderes Modell war besser 60.9%
N/A
AutomationBench
kein anderes Modell war besser 31.4%
30.4%
LVBench
N/A
kein anderes Modell war besser 85.4%

Herstellerangaben: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preise

Claude Fable 5.1 Gemini 3.7 Flash Δ
Input / 1M Token $10 $0.75 13×
Output / 1M Token $50 $3.75 13×
Cache-Read / 1M Token $0.25 $0.075 3.3×
Cache-Schreiben 1.25x (5m) / 2x (1h) - -

Preise aus dem Live-Katalog zum Zeitpunkt des Builds; jede Modellseite enthält die aktuelle Übersicht.

Wo sie stehen - Eingabepreis pro 1M Tokens über alle 67 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

Fähigkeiten

Claude Fable 5.1 Gemini 3.7 Flash
Tool-Nutzung ja ja
Thinking-Kontrolle immer aktiv ja - Regler des Anbieters nicht veröffentlicht
Strukturierte Ausgabe ja ja
Prompt-Caching explizit (Sie markieren das Präfix) implizit + explizit
Cache-Lebensdauer 5m default, 1h option nicht veröffentlicht
Minimales gecachtes Präfix 1024 Tokens 4096 Tokens

Spezifikationen

Claude Fable 5.1 Gemini 3.7 Flash
Input-Modalitäten Text Bild Text Bild Audio Video
Ausgabemodalitäten Text Text
Veröffentlicht 2026-09-01 2026-08-13
Wissensgrenze 2026-06 -
Kontextfenster 1M 1M
Maximaler Output 128K 66K
Thinking-Parameter output_config.effort (thinking is adaptive-only and always on) -
Zulässige Werte
effort
  • low
  • medium
  • high
  • xhigh
  • max
-
Standardwert

thinking always on (adaptive)

effort
  • high
-

Die Spezifikationen sind aus der Dokumentation der jeweiligen Anbieter übernommen; eine Zeile, die ein Anbieter nicht veröffentlicht, wird weggelassen und nicht abgeleitet. Vollständige Quellen: Claude Fable 5.1 · Gemini 3.7 Flash

Mit einer Zeile zwischen ihnen wechseln

Beide IDs befinden sich in jedem Tab unten - das hervorgehobene Zeilenpaar ist die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiche Request-Struktur.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="gemini-3.7-flash",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API-Schlüssel abrufen →

FAQ

Welches ist günstiger, Claude Fable 5.1 oder Gemini 3.7 Flash?

Gemini 3.7 Flash ist günstiger bei input / 1m token ($0.75 vs. $10, 13× Unterschied). Andere Zeilen können in die andere Richtung deuten - die obige Tabelle enthält alle Daten, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich Claude Fable 5.1 gegen Gemini 3.7 Flash ohne zwei Integrationen A/B-testen?

Ja. Beide werden über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel bereitgestellt - der Wechsel ist eine einzeilige Änderung des Modell-Strings, sodass Sie einen Bruchteil des Traffics an jedes Modell leiten und die Rechnungen direkt vergleichen können.

Unterstützen Claude Fable 5.1 und Gemini 3.7 Flash Prompt-Caching?

Ja - beide berechnen Cache-Reads günstiger als ihre Eingaberate, sodass Warm-Prefix-Workloads weniger kosten, als die Listenpreise vermuten lassen. Die genauen Zeilen für Cache-Reads befinden sich in der obigen Preistabelle.

Verwandte Vergleiche

Aus unseren gemessenen Studien