新人 免费注册,送 10 次调用,最高 $1,免绑卡。

Claude Fable 5.1 vs Kimi K3

Claude Fable 5.1 采用邀请制提供。下方数据为其实时费率,但调用前需先获得工作区授权;在基于此对比进行开发前,请向我们申请访问权限。

vs

何时用哪一个

两者涵盖的范围大致相同——约一百万 token 的上下文,支持文本和图像输入、文本输出,加上 chat、code、tools 和 reasoning 功能——但 kimi-k3 的每 token 成本仅为三分之一,输入 $3、输出 $15,而 claude-fable-5-1 为 $10 和 $50,并且它接受视频输入,允许高达 1048576 个输出 token,而后者为 128000。在长生成、视频输入或 3.3x 价格差距至关重要的高吞吐量任务中,请选择 kimi-k3。当你特别需要其 Anthropic 的 thinking 能力,或更看重其略微便宜的 $0.25 缓存读取价格(对比 $0.3)时,请选择 claude-fable-5-1。

Benchmark 成绩

高于同侪均值无人分数更高Claude Fable 5.17 / 77 / 7Kimi K350 / 6113 / 61
Claude Fable 5.1 Kimi K3 其他被测模型 同侪均值 无人分数更高
Terminal-Bench 2.1
N/A
88.3%
OSWorld-Verified
N/A
84.8%
Cybergym
N/A
80%
Finance Agent v2
N/A
54.4%
Harvey Lab-AA
N/A
无人分数更高 94.6%
Humanity's Last Exam no tools
无人分数更高 60.9%
43.5%
BrowseComp
N/A
无人分数更高 91.2%
Video-MME (w. sub)
N/A
无人分数更高 90%

厂商公布: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

定价

Claude Fable 5.1 Kimi K3 Δ
输入 / 1M tokens $10 $3 3.3×
输出 / 1M tokens $50 $15 3.3×
缓存读取 / 1M tokens $0.25 $0.3 0.83×
缓存写入 1.25x (5m) / 2x (1h) - -

费率取自构建时的实时目录;每个模型页面均附有当前的费率卡。

它们的位置 — 以该计费单位计费的所有 67 个 聊天 模型的 每 1M token 的输入价格(对数刻度)

Claude Fable 5.1 · $10 Kimi K3 · $3
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

能力

Claude Fable 5.1 Kimi K3
工具使用
思考控制 始终开启 始终开启
结构化输出
提示词缓存 显式(由您标记前缀) 隐式(自动)
缓存生存时间 5m default, 1h option 未公开
最小缓存前缀 1024 个 token 未公开

规格

Claude Fable 5.1 Kimi K3
输入模态 文本 图像 文本 图像 视频
输出模态 文本 文本
发布日期 2026-09-01 -
知识截止日期 2026-06 -
上下文窗口 1M 1M
最大输出 128K 1M
思考参数 output_config.effort (thinking is adaptive-only and always on) reasoning_effort (top-level; the thinking object is not accepted)
允许的值
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
默认值

thinking always on (adaptive)

effort
  • high
max

规格转录自各供应商的文档;若供应商未发布某项数据,则直接省略该行,而非进行推断。 完整来源: Claude Fable 5.1 · Kimi K3

只需一行代码即可在它们之间切换

两个 ID 都包含在下方的每个选项卡中 — 高亮显示的两行是唯一的修改。相同的端点,相同的密钥,相同的请求结构。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="kimi-k3",  # 取消注释此行,注释上一行
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

获取 API 密钥 →

常见问题

Claude Fable 5.1 和 Kimi K3 哪个更便宜?

在 输入 / 1m tokens 方面,Kimi K3 更便宜($3 对比 $10,相差 3.3×)。其他行可能得出相反的结论——上方表格提供了完整信息,实际成本取决于你的组合使用情况。

我可以在不进行两次集成的情况下,对 Claude Fable 5.1 和 Kimi K3 进行 A/B 测试吗?

可以。两者均通过同一个兼容 OpenAI 的端点提供服务,并使用同一把 API 密钥——切换只需更改一行模型字符串,因此你可以将一部分流量路由到各个模型并直接比较账单。

Claude Fable 5.1 和 Kimi K3 支持提示词缓存吗?

是的 —— 两者对缓存读取的计费均低于其输入费率,因此热前缀工作负载的成本低于标价。准确的缓存读取行位于上方的定价表中。

相关对比

来自我们的实测研究