Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Claude Fable 5.1 vs GPT-6 Astra

Claude Fable 5.1 est disponible sur invitation. Ses chiffres ci-dessous sont les tarifs en vigueur, mais les appels nécessitent d'abord une autorisation de l'espace de travail ; demandez-nous l'accès avant de développer sur la base de cette comparaison.

vs

Lequel, quand

claude-fable-5-1 et gpt-6-astra sont des modèles très similaires qui facturent tous deux $10 par million de tokens d'entrée et $50 par million de tokens de sortie, avec une limite de sortie maximale de 128000 tokens. Choisissez claude-fable-5-1 pour les workflows répétitifs car son tarif de lecture en cache de $0.25 est quatre fois moins cher que le tarif de $1 de gpt-6-astra. Alternativement, choisissez gpt-6-astra si vous avez besoin d'une fenêtre de contexte légèrement plus grande de 1050000 tokens ou si vous devez pouvoir désactiver la réflexion, ce qui ne peut pas être désactivé sur claude-fable-5-1.

Benchmarks

Au-dessus de la moyenneAucun meilleurClaude Fable 5.17 / 77 / 7GPT-6 Astraseulement 4 comparables
Claude Fable 5.1 GPT-6 Astra autres modèles mesurés moyenne des modèles comparés aucun autre modèle n'a fait mieux
Terminal-bench 4.0
aucun autre modèle n'a fait mieux 55.8%
N/A
OSWorld 2.0 partial
77.9%
N/A
HealthBench
N/A
58.1%
GDPval-AA v2 Elo · 1711-1853 selon Anthropic · 2026-09-05
aucun autre modèle n'a fait mieux 1853
N/A
Humanity's Last Exam no tools
aucun autre modèle n'a fait mieux 60.9%
N/A
AutomationBench
aucun autre modèle n'a fait mieux 31.4%
N/A

Chiffres publiés par les fournisseurs : Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Z.ai

Tarification

Claude Fable 5.1 GPT-6 Astra Δ
Entrée / 1M tokens $10 $10 =
Sortie / 1M tokens $50 $50 =
Lecture en cache / 1M tokens $0.25 $1 0.25×
Écriture cache 1.25x (5m) / 2x (1h) aucun frais supplémentaire -

Tarifs issus du catalogue en direct au moment de la compilation ; chaque page de modèle présente la fiche actuelle.

Où ils se situent - prix en entrée pour 1M de tokens sur l'ensemble des 68 modèles chat pour cette unité de facturation (échelle logarithmique)

$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Capacités

Claude Fable 5.1 GPT-6 Astra
Utilisation d'outils oui oui
Contrôle de la réflexion toujours activé configurable
Sortie structurée oui oui
Mise en cache du prompt explicite (vous indiquez le préfixe) implicite (automatique)
Durée de vie du cache 5m default, 1h option 5-10m, up to 1h
Préfixe minimum mis en cache 1024 jetons 1024 jetons

Spécifications

Claude Fable 5.1 GPT-6 Astra
Modalités d'entrée texte image texte image
Modalités de sortie texte texte
Sortie 2026-09-01 2026-09-03
Limite de connaissances 2026-06 2026-04
Fenêtre de contexte 1M 1.1M
Sortie maximale 128K 128K
Paramètre de réflexion output_config.effort (thinking is adaptive-only and always on) reasoning.effort
Valeurs acceptées
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning.effort
  • none
  • low
  • medium
  • high
  • xhigh
  • max
Par défaut

thinking always on (adaptive)

effort
  • high
medium

Les spécifications sont transcrites à partir de la documentation de chaque fournisseur ; une ligne qu'un fournisseur ne publie pas est omise plutôt que déduite. Sources complètes : Claude Fable 5.1 · GPT-6 Astra

Basculez de l'un à l'autre avec une seule ligne

Les deux ids sont dans chaque onglet ci-dessous - la paire de lignes en surbrillance est la seule modification. Même endpoint, même clé, même structure de requête.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="gpt-6-astra",  # décommentez cette ligne, commentez celle du dessus
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Obtenez votre clé API →

FAQ

Lequel est le moins cher, Claude Fable 5.1 ou GPT-6 Astra ?

Ils affichent la même valeur pour entrée / 1m tokens ($10), donc le prix ne permet pas de trancher ici - consultez les spécifications et les capacités ci-dessous.

Puis-je faire un test A/B de Claude Fable 5.1 par rapport à GPT-6 Astra sans deux intégrations ?

Oui. Les deux sont servis via le même endpoint compatible OpenAI avec une seule clé API - le basculement est un changement de chaîne de modèle en une ligne, vous pouvez donc diriger une fraction du trafic vers chacun et comparer les factures directement.

Est-ce que Claude Fable 5.1 et GPT-6 Astra prennent en charge le prompt caching ?

Oui - les deux facturent les lectures en cache en dessous de leur tarif d'entrée, donc les charges de travail à préfixe chaud coûtent moins cher que ce que les tarifs de base suggèrent. Les lignes exactes des lectures en cache se trouvent dans le tableau de tarification ci-dessus.

Comparaisons associées

Issu de nos études mesurées