Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Claude Fable 5.1 vs Gemini 3.6 Flash

Claude Fable 5.1 wird auf Einladung bereitgestellt. Die untenstehenden Zahlen entsprechen den Live-Raten, aber Aufrufe erfordern zunächst eine Workspace-Berechtigung; fordern Sie bei uns Zugang an, bevor Sie auf diesem Vergleich aufbauen.

vs

Welches Modell, wann

Beide Modelle haben ungefähr die gleiche Kontextgröße - 1000000 Token für claude-fable-5-1 im Vergleich zu 1048576 für gemini-3.6-flash - die eigentliche Unterscheidung liegt also bei Preis, Output-Kapazität und Inputs. claude-fable-5-1 kostet etwa 6.7x mehr beim Input ($10 gegenüber $1.5 pro Million) und etwa 6.7x mehr beim Output ($50 gegenüber $7.5), aber es verdoppelt die maximale Output-Grenze auf 128000 Token und bietet Thinking- und Reasoning-Flags sowie einen 2026-06 Cutoff. Wählen Sie gemini-3.6-flash für Text-, Bild-, Video- oder Audio-Workloads mit hohem Volumen (Audio-Input für $5 pro Million), und claude-fable-5-1 für lange, reasoning-intensive Generierungen.

Benchmarks

Über dem DurchschnittKeins besserClaude Fable 5.17 / 77 / 7Gemini 3.6 Flash5 / 181 / 18
Claude Fable 5.1 Gemini 3.6 Flash weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
Terminal-Bench 2.1
N/A
78%
BioMysteryBench hard
N/A
41.2%
OSWorld 2.0
N/A
33.8%
GDPval-AA v2 Elo · 1711-1853 laut Anthropic · 2026-09-05
kein anderes Modell war besser 1853
N/A
Harvey Lab-AA
N/A
85.1%
Humanity's Last Exam no tools
kein anderes Modell war besser 60.9%
N/A
AutomationBench
kein anderes Modell war besser 31.4%
17%
LVBench
N/A
84.2%

Herstellerangaben: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preise

Claude Fable 5.1 Gemini 3.6 Flash Δ
Input / 1M Token $10 $1.5 6.7×
Output / 1M Token $50 $7.5 6.7×
Cache-Read / 1M Token $0.25 $0.15 1.7×
Cache-Schreiben 1.25x (5m) / 2x (1h) - -

Preise aus dem Live-Katalog zum Zeitpunkt des Builds; jede Modellseite enthält die aktuelle Übersicht.

Wo sie stehen - Eingabepreis pro 1M Tokens über alle 67 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

Fähigkeiten

Claude Fable 5.1 Gemini 3.6 Flash
Tool-Nutzung ja ja
Thinking-Kontrolle immer aktiv immer aktiv
Strukturierte Ausgabe ja ja
Prompt-Caching explizit (Sie markieren das Präfix) implizit + explizit
Cache-Lebensdauer 5m default, 1h option nicht veröffentlicht
Minimales gecachtes Präfix 1024 Tokens 4096 Tokens

Spezifikationen

Claude Fable 5.1 Gemini 3.6 Flash
Input-Modalitäten Text Bild Text Bild Audio Video
Ausgabemodalitäten Text Text
Veröffentlicht 2026-09-01 -
Wissensgrenze 2026-06 2026-03
Kontextfenster 1M 1M
Maximaler Output 128K 66K
Thinking-Parameter output_config.effort (thinking is adaptive-only and always on) thinkingLevel
Zulässige Werte
effort
  • low
  • medium
  • high
  • xhigh
  • max
  • minimal
  • low
  • medium
  • high
Standardwert

thinking always on (adaptive)

effort
  • high
medium

Die Spezifikationen sind aus der Dokumentation der jeweiligen Anbieter übernommen; eine Zeile, die ein Anbieter nicht veröffentlicht, wird weggelassen und nicht abgeleitet. Vollständige Quellen: Claude Fable 5.1 · Gemini 3.6 Flash

Mit einer Zeile zwischen ihnen wechseln

Beide IDs befinden sich in jedem Tab unten - das hervorgehobene Zeilenpaar ist die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiche Request-Struktur.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="gemini-3.6-flash",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API-Schlüssel abrufen →

FAQ

Welches ist günstiger, Claude Fable 5.1 oder Gemini 3.6 Flash?

Gemini 3.6 Flash ist günstiger bei input / 1m token ($1.5 vs. $10, 6.7× Unterschied). Andere Zeilen können in die andere Richtung deuten - die obige Tabelle enthält alle Daten, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich Claude Fable 5.1 gegen Gemini 3.6 Flash ohne zwei Integrationen A/B-testen?

Ja. Beide werden über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel bereitgestellt - der Wechsel ist eine einzeilige Änderung des Modell-Strings, sodass Sie einen Bruchteil des Traffics an jedes Modell leiten und die Rechnungen direkt vergleichen können.

Unterstützen Claude Fable 5.1 und Gemini 3.6 Flash Prompt-Caching?

Ja - beide berechnen Cache-Reads günstiger als ihre Eingaberate, sodass Warm-Prefix-Workloads weniger kosten, als die Listenpreise vermuten lassen. Die genauen Zeilen für Cache-Reads befinden sich in der obigen Preistabelle.

Verwandte Vergleiche

Aus unseren gemessenen Studien