Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Claude Fable 5.1 vs Kimi K3

Claude Fable 5.1 est disponible sur invitation. Ses chiffres ci-dessous sont les tarifs en vigueur, mais les appels nécessitent d'abord une autorisation de l'espace de travail ; demandez-nous l'accès avant de développer sur la base de cette comparaison.

vs

Lequel, quand

Les deux couvrent à peu près le même terrain - environ un million de tokens de contexte, texte et image en entrée, texte en sortie, plus chat, code, outils et raisonnement - mais kimi-k3 coûte un tiers du prix par token, à $3 en entrée et $15 en sortie contre $10 et $50 pour claude-fable-5-1, il accepte également la vidéo et permet jusqu'à 1048576 tokens de sortie contre 128000. Choisissez kimi-k3 pour les longues générations, l'entrée vidéo ou les travaux à volume élevé où l'écart de prix de 3.3x a de l'importance. Choisissez claude-fable-5-1 lorsque vous souhaitez spécifiquement sa capacité de réflexion Anthropic ou les lectures en cache légèrement moins chères à $0.25 contre $0.3.

Benchmarks

Au-dessus de la moyenneAucun meilleurClaude Fable 5.17 / 77 / 7Kimi K350 / 6113 / 61
Claude Fable 5.1 Kimi K3 autres modèles mesurés moyenne des modèles comparés aucun autre modèle n'a fait mieux
Terminal-Bench 2.1
N/A
88.3%
OSWorld-Verified
N/A
84.8%
Cybergym
N/A
80%
Finance Agent v2
N/A
54.4%
Harvey Lab-AA
N/A
aucun autre modèle n'a fait mieux 94.6%
Humanity's Last Exam no tools
aucun autre modèle n'a fait mieux 60.9%
43.5%
BrowseComp
N/A
aucun autre modèle n'a fait mieux 91.2%
Video-MME (w. sub)
N/A
aucun autre modèle n'a fait mieux 90%

Chiffres publiés par les fournisseurs : Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Tarification

Claude Fable 5.1 Kimi K3 Δ
Entrée / 1M tokens $10 $3 3.3×
Sortie / 1M tokens $50 $15 3.3×
Lecture en cache / 1M tokens $0.25 $0.3 0.83×
Écriture cache 1.25x (5m) / 2x (1h) - -

Tarifs issus du catalogue en direct au moment de la compilation ; chaque page de modèle présente la fiche actuelle.

Où ils se situent - prix en entrée pour 1M de tokens sur l'ensemble des 67 modèles chat pour cette unité de facturation (échelle logarithmique)

Claude Fable 5.1 · $10 Kimi K3 · $3
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Capacités

Claude Fable 5.1 Kimi K3
Utilisation d'outils oui oui
Contrôle de la réflexion toujours activé toujours activé
Sortie structurée oui oui
Mise en cache du prompt explicite (vous indiquez le préfixe) implicite (automatique)
Durée de vie du cache 5m default, 1h option non publié
Préfixe minimum mis en cache 1024 jetons non publié

Spécifications

Claude Fable 5.1 Kimi K3
Modalités d'entrée texte image texte image vidéo
Modalités de sortie texte texte
Sortie 2026-09-01 -
Limite de connaissances 2026-06 -
Fenêtre de contexte 1M 1M
Sortie maximale 128K 1M
Paramètre de réflexion output_config.effort (thinking is adaptive-only and always on) reasoning_effort (top-level; the thinking object is not accepted)
Valeurs acceptées
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
Par défaut

thinking always on (adaptive)

effort
  • high
max

Les spécifications sont transcrites à partir de la documentation de chaque fournisseur ; une ligne qu'un fournisseur ne publie pas est omise plutôt que déduite. Sources complètes : Claude Fable 5.1 · Kimi K3

Basculez de l'un à l'autre avec une seule ligne

Les deux ids sont dans chaque onglet ci-dessous - la paire de lignes en surbrillance est la seule modification. Même endpoint, même clé, même structure de requête.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="kimi-k3",  # décommentez cette ligne, commentez celle du dessus
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Obtenez votre clé API →

FAQ

Lequel est le moins cher, Claude Fable 5.1 ou Kimi K3 ?

Kimi K3 est moins cher sur entrée / 1m tokens ($3 contre $10, avec un écart de 3.3×). D'autres lignes peuvent indiquer l'inverse - le tableau ci-dessus contient la fiche complète, et le coût réel dépend de votre combinaison.

Puis-je faire un test A/B de Claude Fable 5.1 par rapport à Kimi K3 sans deux intégrations ?

Oui. Les deux sont servis via le même endpoint compatible OpenAI avec une seule clé API - le basculement est un changement de chaîne de modèle en une ligne, vous pouvez donc diriger une fraction du trafic vers chacun et comparer les factures directement.

Est-ce que Claude Fable 5.1 et Kimi K3 prennent en charge le prompt caching ?

Oui - les deux facturent les lectures en cache en dessous de leur tarif d'entrée, donc les charges de travail à préfixe chaud coûtent moins cher que ce que les tarifs de base suggèrent. Les lignes exactes des lectures en cache se trouvent dans le tableau de tarification ci-dessus.

Comparaisons associées

Issu de nos études mesurées