新人 免费注册,送 10 次调用,最高 $1,免绑卡。

Claude Fable 5.1 vs Gemini 3.6 Flash

Claude Fable 5.1 采用邀请制提供。下方数据为其实时费率,但调用前需先获得工作区授权;在基于此对比进行开发前,请向我们申请访问权限。

vs

何时用哪一个

两个模型具有大致相同的上下文大小 - claude-fable-5-1 为 1000000 token,而 gemini-3.6-flash 为 1048576 token - 因此真正的区别在于价格、输出空间和输入类型。claude-fable-5-1 在输入上贵约 6.7x(每百万 token $10 对 $1.5),在输出上也贵约 6.7x($50 对 $7.5),但它将最大输出上限翻倍至 128000 token,并带有思考和推理标志以及 2026-06 截止时间。选择 gemini-3.6-flash 处理大批量的文本、图像、视频或音频工作(音频输入每百万 $5),选择 claude-fable-5-1 进行长时间的重推理生成任务。

Benchmark 成绩

高于同侪均值无人分数更高Claude Fable 5.17 / 77 / 7Gemini 3.6 Flash5 / 181 / 18
Claude Fable 5.1 Gemini 3.6 Flash 其他被测模型 同侪均值 无人分数更高
Terminal-Bench 2.1
N/A
78%
BioMysteryBench hard
N/A
41.2%
OSWorld 2.0
N/A
33.8%
GDPval-AA v2 Elo · 1711-1853 据 Anthropic 公布 · 2026-09-05
无人分数更高 1853
N/A
Harvey Lab-AA
N/A
85.1%
Humanity's Last Exam no tools
无人分数更高 60.9%
N/A
AutomationBench
无人分数更高 31.4%
17%
LVBench
N/A
84.2%

厂商公布: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

定价

Claude Fable 5.1 Gemini 3.6 Flash Δ
输入 / 1M tokens $10 $1.5 6.7×
输出 / 1M tokens $50 $7.5 6.7×
缓存读取 / 1M tokens $0.25 $0.15 1.7×
缓存写入 1.25x (5m) / 2x (1h) - -

费率取自构建时的实时目录;每个模型页面均附有当前的费率卡。

它们的位置 — 以该计费单位计费的所有 67 个 聊天 模型的 每 1M token 的输入价格(对数刻度)

能力

Claude Fable 5.1 Gemini 3.6 Flash
工具使用
思考控制 始终开启 始终开启
结构化输出
提示词缓存 显式(由您标记前缀) 隐式 + 显式
缓存生存时间 5m default, 1h option 未公开
最小缓存前缀 1024 个 token 4096 个 token

规格

Claude Fable 5.1 Gemini 3.6 Flash
输入模态 文本 图像 文本 图像 音频 视频
输出模态 文本 文本
发布日期 2026-09-01 -
知识截止日期 2026-06 2026-03
上下文窗口 1M 1M
最大输出 128K 66K
思考参数 output_config.effort (thinking is adaptive-only and always on) thinkingLevel
允许的值
effort
  • low
  • medium
  • high
  • xhigh
  • max
  • minimal
  • low
  • medium
  • high
默认值

thinking always on (adaptive)

effort
  • high
medium

规格转录自各供应商的文档;若供应商未发布某项数据,则直接省略该行,而非进行推断。 完整来源: Claude Fable 5.1 · Gemini 3.6 Flash

只需一行代码即可在它们之间切换

两个 ID 都包含在下方的每个选项卡中 — 高亮显示的两行是唯一的修改。相同的端点,相同的密钥,相同的请求结构。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="gemini-3.6-flash",  # 取消注释此行,注释上一行
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

获取 API 密钥 →

常见问题

Claude Fable 5.1 和 Gemini 3.6 Flash 哪个更便宜?

在 输入 / 1m tokens 方面,Gemini 3.6 Flash 更便宜($1.5 对比 $10,相差 6.7×)。其他行可能得出相反的结论——上方表格提供了完整信息,实际成本取决于你的组合使用情况。

我可以在不进行两次集成的情况下,对 Claude Fable 5.1 和 Gemini 3.6 Flash 进行 A/B 测试吗?

可以。两者均通过同一个兼容 OpenAI 的端点提供服务,并使用同一把 API 密钥——切换只需更改一行模型字符串,因此你可以将一部分流量路由到各个模型并直接比较账单。

Claude Fable 5.1 和 Gemini 3.6 Flash 支持提示词缓存吗?

是的 —— 两者对缓存读取的计费均低于其输入费率,因此热前缀工作负载的成本低于标价。准确的缓存读取行位于上方的定价表中。

相关对比

来自我们的实测研究