新人 免费注册,送 10 次调用,最高 $1,免绑卡。

Claude Fable 5.1 vs GLM-5.3-Flash

Claude Fable 5.1 采用邀请制提供。下方数据为其实时费率,但调用前需先获得工作区授权;在基于此对比进行开发前,请向我们申请访问权限。

vs

何时用哪一个

两个模型均支持 1M-token 的上下文窗口,且都不允许关闭思考功能,因此真正的区别在于价格和输入:glm-5.3-flash 的输入为 $0.15,输出为 $0.5,而 claude-fable-5-1 分别为 $10 和 $50,便宜约 67x 和 100x,并且它在接受文本和图像的同时还接受视频,允许高达 163840 个输出 token,而后者为 128000。当处理高吞吐量或基于视频输入的工作且关注每百万成本时,请选择 glm-5.3-flash,它的 $0.03 缓存读取也更便宜。如果你需要 Anthropic 的更新一代模型且知识截止日期为 2026-06,请选择 claude-fable-5-1。

Benchmark 成绩

高于同侪均值无人分数更高Claude Fable 5.17 / 77 / 7GLM-5.3-Flash4 / 50 / 5
Claude Fable 5.1 GLM-5.3-Flash 其他被测模型 同侪均值 无人分数更高
Terminal-Bench 2.1
N/A
84.3%
OSWorld 2.0 partial
77.9%
N/A
GDPval-AA v2 Elo · 1711-1853 据 Anthropic 公布 · 2026-09-05
无人分数更高 1853
N/A
Humanity's Last Exam with tools
无人分数更高 65%
55.3%
Agents' Last Exam
N/A
26.3%

厂商公布: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

定价

Claude Fable 5.1 GLM-5.3-Flash Δ
输入 / 1M tokens $10 $0.15 67×
输出 / 1M tokens $50 $0.5 100×
缓存读取 / 1M tokens $0.25 $0.03 8.3×
缓存写入 1.25x (5m) / 2x (1h) - -

费率取自构建时的实时目录;每个模型页面均附有当前的费率卡。

它们的位置 — 以该计费单位计费的所有 67 个 聊天 模型的 每 1M token 的输入价格(对数刻度)

$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

能力

Claude Fable 5.1 GLM-5.3-Flash
工具使用
思考控制 始终开启 始终开启
结构化输出
提示词缓存 显式(由您标记前缀) 隐式(自动)
缓存生存时间 5m default, 1h option 未公开
最小缓存前缀 1024 个 token 未公开

规格

Claude Fable 5.1 GLM-5.3-Flash
输入模态 文本 图像 文本 图像 视频
输出模态 文本 文本
发布日期 2026-09-01 -
知识截止日期 2026-06 -
上下文窗口 1M 1M
最大输出 128K 164K
思考参数 output_config.effort (thinking is adaptive-only and always on) reasoning_effort
允许的值
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
默认值

thinking always on (adaptive)

effort
  • high
max

规格转录自各供应商的文档;若供应商未发布某项数据,则直接省略该行,而非进行推断。 完整来源: Claude Fable 5.1 · GLM-5.3-Flash

只需一行代码即可在它们之间切换

两个 ID 都包含在下方的每个选项卡中 — 高亮显示的两行是唯一的修改。相同的端点,相同的密钥,相同的请求结构。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="glm-5.3-flash",  # 取消注释此行,注释上一行
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

获取 API 密钥 →

常见问题

Claude Fable 5.1 和 GLM-5.3-Flash 哪个更便宜?

在 输入 / 1m tokens 方面,GLM-5.3-Flash 更便宜($0.15 对比 $10,相差 67×)。其他行可能得出相反的结论——上方表格提供了完整信息,实际成本取决于你的组合使用情况。

我可以在不进行两次集成的情况下,对 Claude Fable 5.1 和 GLM-5.3-Flash 进行 A/B 测试吗?

可以。两者均通过同一个兼容 OpenAI 的端点提供服务,并使用同一把 API 密钥——切换只需更改一行模型字符串,因此你可以将一部分流量路由到各个模型并直接比较账单。

Claude Fable 5.1 和 GLM-5.3-Flash 支持提示词缓存吗?

是的 —— 两者对缓存读取的计费均低于其输入费率,因此热前缀工作负载的成本低于标价。准确的缓存读取行位于上方的定价表中。

相关对比

来自我们的实测研究