Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Claude Fable 5.1 vs GLM-5.3-Flash

O Claude Fable 5.1 é disponibilizado por convite. Os valores abaixo são as tarifas em tempo real, mas as chamadas exigem uma permissão de workspace primeiro; solicite-nos acesso antes de desenvolver com base nesta comparação.

vs

Qual usar, quando

Ambos os modelos aceitam janelas de contexto de 1M de tokens e nenhum permite que você desative o pensamento, então a verdadeira divisão é preço e entradas: o glm-5.3-flash custa $0.15 na entrada e $0.5 na saída contra $10 e $50 para o claude-fable-5-1, sendo aproximadamente 67x e 100x mais barato, e ele aceita vídeo ao lado de texto e imagem enquanto também permite até 163840 tokens de saída versus 128000. Use o glm-5.3-flash para trabalhos de alto volume ou alimentados por vídeo onde o custo por milhão é importante, e por suas leituras de cache mais baratas de $0.03. Escolha o claude-fable-5-1 quando você quiser a geração mais recente da Anthropic, com um corte de conhecimento em 2026-06.

Benchmarks

Acima da médiaNenhum melhorClaude Fable 5.17 / 77 / 7GLM-5.3-Flash4 / 50 / 5
Claude Fable 5.1 GLM-5.3-Flash outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
Terminal-Bench 2.1
N/A
84.3%
OSWorld 2.0 partial
77.9%
N/A
GDPval-AA v2 Elo · 1711-1853 segundo Anthropic · 2026-09-05
nenhum outro modelo pontuou mais alto 1853
N/A
Humanity's Last Exam with tools
nenhum outro modelo pontuou mais alto 65%
55.3%
Agents' Last Exam
N/A
26.3%

Publicado pelos fornecedores: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preços

Claude Fable 5.1 GLM-5.3-Flash Δ
Entrada / 1M tokens $10 $0.15 67×
Saída / 1M tokens $50 $0.5 100×
Leitura de cache / 1M tokens $0.25 $0.03 8.3×
Escrita de cache 1.25x (5m) / 2x (1h) - -

Tarifas do catálogo em tempo real no momento do build; a página de cada modelo contém o cartão atual.

Onde eles se posicionam - preço de entrada por 1M tokens entre todos os 67 modelos de chat nesta unidade de cobrança (escala logarítmica)

$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Capacidades

Claude Fable 5.1 GLM-5.3-Flash
Uso de ferramentas sim sim
Controle de raciocínio sempre ativo sempre ativo
Saída estruturada sim sim
Cache de prompt explícito (você marca o prefixo) implícito (automático)
Tempo de vida do cache 5m default, 1h option não publicado
Prefixo mínimo em cache 1024 tokens não publicado

Especificações

Claude Fable 5.1 GLM-5.3-Flash
Modalidades de entrada texto imagem texto imagem vídeo
Modalidades de saída texto texto
Lançamento 2026-09-01 -
Corte de conhecimento 2026-06 -
Janela de contexto 1M 1M
Saída máxima 128K 164K
Parâmetro de raciocínio output_config.effort (thinking is adaptive-only and always on) reasoning_effort
Valores aceitos
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
Padrão

thinking always on (adaptive)

effort
  • high
max

As especificações são transcritas da documentação de cada fornecedor; uma linha que um fornecedor não publica é omitida em vez de ser inferida. Fontes completas: Claude Fable 5.1 · GLM-5.3-Flash

Alterne entre eles com uma linha

Ambos os IDs estão em todas as abas abaixo - o par de linhas destacado é a única edição. Mesmo endpoint, mesma chave, mesmo formato de requisição.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="glm-5.3-flash",  # descomente esta linha, comente a linha acima
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Obtenha sua chave API →

FAQ

Qual é mais barato, Claude Fable 5.1 ou GLM-5.3-Flash?

GLM-5.3-Flash é mais barato em entrada / 1m tokens ($0.15 vs $10, com 67× de diferença). Outras linhas podem apontar para o outro lado - a tabela acima traz o quadro completo, e o custo real depende do seu mix.

Posso fazer um teste A/B de Claude Fable 5.1 contra GLM-5.3-Flash sem duas integrações?

Sim. Ambos são servidos pelo mesmo endpoint compatível com OpenAI com uma única chave de API - a troca é uma alteração de uma linha na string do modelo, de modo que você pode rotear uma fração do tráfego para cada um e comparar as faturas diretamente.

Claude Fable 5.1 e GLM-5.3-Flash suportam prompt caching?

Sim - ambos cobram leituras em cache abaixo da sua taxa de entrada, então cargas de trabalho com warm-prefix custam menos do que as taxas listadas sugerem. As linhas exatas de leitura em cache estão na tabela de preços acima.

Comparações relacionadas

De nossos estudos medidos