Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Claude Fable 5.1 vs GLM-5.3

O Claude Fable 5.1 é disponibilizado por convite. Os valores abaixo são as tarifas em tempo real, mas as chamadas exigem uma permissão de workspace primeiro; solicite-nos acesso antes de desenvolver com base nesta comparação.

vs

Qual usar, quando

Tanto o claude-fable-5-1 quanto o glm-5.3 oferecem um contexto de 1,000,000 de tokens com uso de ferramentas e raciocínio, e leituras de cache quase idênticas ($0.25 versus $0.26), então a verdadeira divisão é entrada de imagem e preço: o claude-fable-5-1 aceita texto e imagem, enquanto o glm-5.3 é apenas texto e custa cerca de 7.1x menos na entrada ($1.4 versus $10) e cerca de 11.4x menos na saída ($4.4 versus $50). Escolha o claude-fable-5-1 quando uma tarefa precisar de imagens ao lado de sua capacidade de pensamento explícito; escolha o glm-5.3 para trabalhos com texto de alto volume e contexto longo, onde sua saída máxima ligeiramente maior de 131,072 tokens também ajuda.

Benchmarks

Acima da médiaNenhum melhorClaude Fable 5.17 / 77 / 7GLM-5.314 / 161 / 16
Claude Fable 5.1 GLM-5.3 outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
Terminal-Bench 2.1
N/A
88.2%
OSWorld 2.0 partial
77.9%
N/A
Cybergym
N/A
nenhum outro modelo pontuou mais alto 84.5%
GDPval-AA v2 Elo · 1711-1853 segundo Anthropic · 2026-09-05
nenhum outro modelo pontuou mais alto 1853
N/A
Humanity's Last Exam with tools
nenhum outro modelo pontuou mais alto 65%
62.5%
Agents' Last Exam
N/A
28.5%

Publicado pelos fornecedores: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preços

Claude Fable 5.1 GLM-5.3 Δ
Entrada / 1M tokens $10 $1.4 7.1×
Saída / 1M tokens $50 $4.4 11×
Leitura de cache / 1M tokens $0.25 $0.26 0.96×
Escrita de cache 1.25x (5m) / 2x (1h) - -

Tarifas do catálogo em tempo real no momento do build; a página de cada modelo contém o cartão atual.

Onde eles se posicionam - preço de entrada por 1M tokens entre todos os 67 modelos de chat nesta unidade de cobrança (escala logarítmica)

Claude Fable 5.1 · $10 GLM-5.3 · $1.4
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Capacidades

Claude Fable 5.1 GLM-5.3
Uso de ferramentas sim sim
Controle de raciocínio sempre ativo sempre ativo
Saída estruturada sim sim
Cache de prompt explícito (você marca o prefixo) implícito (automático)
Tempo de vida do cache 5m default, 1h option não publicado
Prefixo mínimo em cache 1024 tokens não publicado

Especificações

Claude Fable 5.1 GLM-5.3
Modalidades de entrada texto imagem texto
Modalidades de saída texto texto
Lançamento 2026-09-01 -
Corte de conhecimento 2026-06 -
Janela de contexto 1M 1M
Saída máxima 128K 131K
Parâmetro de raciocínio output_config.effort (thinking is adaptive-only and always on) reasoning_effort
Valores aceitos
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
Padrão

thinking always on (adaptive)

effort
  • high
max

As especificações são transcritas da documentação de cada fornecedor; uma linha que um fornecedor não publica é omitida em vez de ser inferida. Fontes completas: Claude Fable 5.1 · GLM-5.3

Alterne entre eles com uma linha

Ambos os IDs estão em todas as abas abaixo - o par de linhas destacado é a única edição. Mesmo endpoint, mesma chave, mesmo formato de requisição.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="glm-5.3",  # descomente esta linha, comente a linha acima
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Obtenha sua chave API →

FAQ

Qual é mais barato, Claude Fable 5.1 ou GLM-5.3?

GLM-5.3 é mais barato em entrada / 1m tokens ($1.4 vs $10, com 7.1× de diferença). Outras linhas podem apontar para o outro lado - a tabela acima traz o quadro completo, e o custo real depende do seu mix.

Posso fazer um teste A/B de Claude Fable 5.1 contra GLM-5.3 sem duas integrações?

Sim. Ambos são servidos pelo mesmo endpoint compatível com OpenAI com uma única chave de API - a troca é uma alteração de uma linha na string do modelo, de modo que você pode rotear uma fração do tráfego para cada um e comparar as faturas diretamente.

Claude Fable 5.1 e GLM-5.3 suportam prompt caching?

Sim - ambos cobram leituras em cache abaixo da sua taxa de entrada, então cargas de trabalho com warm-prefix custam menos do que as taxas listadas sugerem. As linhas exatas de leitura em cache estão na tabela de preços acima.

Comparações relacionadas

De nossos estudos medidos