Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Claude Fable 5.1 vs Gemini 3.7 Flash

Claude Fable 5.1 è disponibile su invito. Le cifre sottostanti sono le tariffe in tempo reale, ma le chiamate richiedono prima un'autorizzazione per il workspace; richiedici l'accesso prima di basare il tuo sviluppo su questo confronto.

vs

Quale scegliere e quando

gemini-3.7-flash è l'opzione più economica e con input più ampi: $0.75 in input e $3.75 in output per milione di token, circa 13x in meno rispetto a claude-fable-5-1 a $10 e $50, con un contesto di 1048576 token e input di testo, immagini, audio e video (anche l'input audio è prezzato per milione di token, a $0.75). Scegli claude-fable-5-1 quando desideri la sua modalità thinking sempre attiva, che non può essere disabilitata, oltre a 128000 token di output massimi contro 65536, su un contesto di 1000000 token. Se i tuoi input sono testo e immagini e sei attento ai costi, il modello Google lo copre; le letture dalla cache sono $0.075 contro $0.25.

Benchmark

Sopra la mediaNessuno miglioreClaude Fable 5.17 / 77 / 7Gemini 3.7 Flash17 / 234 / 23
Claude Fable 5.1 Gemini 3.7 Flash altri modelli misurati media dei modelli confrontati nessun altro modello ha fatto meglio
Terminal-bench 4.0
nessun altro modello ha fatto meglio 55.8%
11.2%
BioMysteryBench hard
N/A
43.5%
OSWorld 2.0
N/A
47.9%
Finance Agent v2
N/A
59%
Harvey Lab-AA
N/A
90.7%
Humanity's Last Exam no tools
nessun altro modello ha fatto meglio 60.9%
N/A
AutomationBench
nessun altro modello ha fatto meglio 31.4%
30.4%
LVBench
N/A
nessun altro modello ha fatto meglio 85.4%

Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Prezzi

Claude Fable 5.1 Gemini 3.7 Flash Δ
Input / 1M token $10 $0.75 13×
Output / 1M token $50 $3.75 13×
Lettura cache / 1M token $0.25 $0.075 3.3×
Scrittura in cache 1.25x (5m) / 2x (1h) - -

Le tariffe provengono dal catalogo live al momento della build; la pagina di ciascun modello riporta la scheda attuale.

Dove si posizionano - prezzo di input per 1M di token rispetto a tutti gli 67 modelli chat con questa unità di fatturazione (scala logaritmica)

Capacità

Claude Fable 5.1 Gemini 3.7 Flash
Utilizzo dei tool
Controllo del ragionamento sempre attivo sì - il fornitore non pubblica il controllo
Output strutturato
Prompt caching esplicito (contrassegni il prefisso) implicito + esplicito
Durata della cache 5m default, 1h option non pubblicato
Prefisso minimo in cache 1024 token 4096 token

Specifiche

Claude Fable 5.1 Gemini 3.7 Flash
Modalità di input testo immagine testo immagine audio video
Modalità di output testo testo
Rilascio 2026-09-01 2026-08-13
Cutoff di conoscenza 2026-06 -
Finestra di contesto 1M 1M
Output massimo 128K 66K
Parametro thinking output_config.effort (thinking is adaptive-only and always on) -
Valori accettati
effort
  • low
  • medium
  • high
  • xhigh
  • max
-
Predefinito

thinking always on (adaptive)

effort
  • high
-

Le specifiche sono trascritte dalla documentazione di ciascun fornitore; una riga che un fornitore non pubblica viene omessa anziché essere dedotta. Fonti complete: Claude Fable 5.1 · Gemini 3.7 Flash

Passa dall'uno all'altro con una sola riga

Entrambi gli id sono presenti in ogni scheda qui sotto - la coppia di righe evidenziata è l'unica modifica. Stesso endpoint, stessa chiave, stessa struttura della richiesta.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="gemini-3.7-flash",  # decommenta questa riga, commenta quella sopra
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Ottieni la tua chiave API →

FAQ

Qual è più economico, Claude Fable 5.1 o Gemini 3.7 Flash?

Gemini 3.7 Flash è più economico per input / 1m token ($0.75 contro $10, 13× di differenza). Altre righe potrebbero indicare il contrario - la tabella sopra riporta la scheda completa, e il costo reale dipende dal tuo mix.

Posso fare un A/B test di Claude Fable 5.1 contro Gemini 3.7 Flash senza due integrazioni?

Sì. Entrambi sono serviti tramite lo stesso endpoint compatibile con OpenAI con una singola chiave API - il passaggio richiede la modifica della stringa del modello in una sola riga, quindi puoi instradare una frazione del traffico verso ciascuno e confrontare direttamente le fatture.

Claude Fable 5.1 e Gemini 3.7 Flash supportano il prompt caching?

Sì - entrambi fatturano le letture in cache a un prezzo inferiore rispetto alla loro tariffa di input, quindi i carichi di lavoro con warm-prefix costano meno di quanto suggeriscano le tariffe di listino. Le righe esatte per la lettura in cache si trovano nella tabella dei prezzi qui sopra.

Confronti correlati

Dai nostri studi misurati