Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Claude Fable 5.1 vs Kimi K3

O Claude Fable 5.1 é disponibilizado por convite. Os valores abaixo são as tarifas em tempo real, mas as chamadas exigem uma permissão de workspace primeiro; solicite-nos acesso antes de desenvolver com base nesta comparação.

vs

Qual usar, quando

Ambos cobrem basicamente o mesmo escopo - cerca de um milhão de tokens de contexto, entrada de texto e imagem, saída de texto, além de chat, código, ferramentas e raciocínio - mas o kimi-k3 custa um terço por token, com $3 para entrada e $15 para saída contra $10 e $50 do claude-fable-5-1, e ele aceita vídeo e permite até 1048576 tokens de saída em vez de 128000. Escolha o kimi-k3 para gerações longas, entrada de vídeo ou trabalho de alto volume onde a diferença de preço de 3.3x importa. Escolha o claude-fable-5-1 quando você quiser especificamente sua capacidade de thinking da Anthropic ou leituras de cache levemente mais baratas de $0.25 contra $0.3.

Benchmarks

Acima da médiaNenhum melhorClaude Fable 5.17 / 77 / 7Kimi K350 / 6113 / 61
Claude Fable 5.1 Kimi K3 outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
Terminal-Bench 2.1
N/A
88.3%
OSWorld-Verified
N/A
84.8%
Cybergym
N/A
80%
Finance Agent v2
N/A
54.4%
Harvey Lab-AA
N/A
nenhum outro modelo pontuou mais alto 94.6%
Humanity's Last Exam no tools
nenhum outro modelo pontuou mais alto 60.9%
43.5%
BrowseComp
N/A
nenhum outro modelo pontuou mais alto 91.2%
Video-MME (w. sub)
N/A
nenhum outro modelo pontuou mais alto 90%

Publicado pelos fornecedores: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preços

Claude Fable 5.1 Kimi K3 Δ
Entrada / 1M tokens $10 $3 3.3×
Saída / 1M tokens $50 $15 3.3×
Leitura de cache / 1M tokens $0.25 $0.3 0.83×
Escrita de cache 1.25x (5m) / 2x (1h) - -

Tarifas do catálogo em tempo real no momento do build; a página de cada modelo contém o cartão atual.

Onde eles se posicionam - preço de entrada por 1M tokens entre todos os 67 modelos de chat nesta unidade de cobrança (escala logarítmica)

Claude Fable 5.1 · $10 Kimi K3 · $3
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Capacidades

Claude Fable 5.1 Kimi K3
Uso de ferramentas sim sim
Controle de raciocínio sempre ativo sempre ativo
Saída estruturada sim sim
Cache de prompt explícito (você marca o prefixo) implícito (automático)
Tempo de vida do cache 5m default, 1h option não publicado
Prefixo mínimo em cache 1024 tokens não publicado

Especificações

Claude Fable 5.1 Kimi K3
Modalidades de entrada texto imagem texto imagem vídeo
Modalidades de saída texto texto
Lançamento 2026-09-01 -
Corte de conhecimento 2026-06 -
Janela de contexto 1M 1M
Saída máxima 128K 1M
Parâmetro de raciocínio output_config.effort (thinking is adaptive-only and always on) reasoning_effort (top-level; the thinking object is not accepted)
Valores aceitos
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
Padrão

thinking always on (adaptive)

effort
  • high
max

As especificações são transcritas da documentação de cada fornecedor; uma linha que um fornecedor não publica é omitida em vez de ser inferida. Fontes completas: Claude Fable 5.1 · Kimi K3

Alterne entre eles com uma linha

Ambos os IDs estão em todas as abas abaixo - o par de linhas destacado é a única edição. Mesmo endpoint, mesma chave, mesmo formato de requisição.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="kimi-k3",  # descomente esta linha, comente a linha acima
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Obtenha sua chave API →

FAQ

Qual é mais barato, Claude Fable 5.1 ou Kimi K3?

Kimi K3 é mais barato em entrada / 1m tokens ($3 vs $10, com 3.3× de diferença). Outras linhas podem apontar para o outro lado - a tabela acima traz o quadro completo, e o custo real depende do seu mix.

Posso fazer um teste A/B de Claude Fable 5.1 contra Kimi K3 sem duas integrações?

Sim. Ambos são servidos pelo mesmo endpoint compatível com OpenAI com uma única chave de API - a troca é uma alteração de uma linha na string do modelo, de modo que você pode rotear uma fração do tráfego para cada um e comparar as faturas diretamente.

Claude Fable 5.1 e Kimi K3 suportam prompt caching?

Sim - ambos cobram leituras em cache abaixo da sua taxa de entrada, então cargas de trabalho com warm-prefix custam menos do que as taxas listadas sugerem. As linhas exatas de leitura em cache estão na tabela de preços acima.

Comparações relacionadas

De nossos estudos medidos