新人 免费注册,送 10 次调用,最高 $1,免绑卡。

Claude Sonnet 4.5

发布于 2025-09-29

chat代码推理工具调用图像理解提示词缓存

Claude Sonnet 4.5 是仍在 Claude 平台上提供的上一代 Sonnet 模型。

输入
文本 图像 $3/M
输出
文本 $15/M
缓存读取
$0.3/M
上下文
200K
对比 GPT-4o
便宜约 40%
知识截止
2025-01

Benchmark 成绩

高于同侪均值1 / 6
Claude Sonnet 4.5 其他被测模型 同侪均值 无人分数更高
SciCode
45%
GPQA Diamond
83%

厂商公布: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

价格在同类中的位置

价格在 60 个同类模型中的位置

输入$3/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
输出$15/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
缓存读取$0.3/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

这条线显示该模型的价格,在 Synthorai 上同类模型里处于什么位置。两端标出了最便宜和最贵的那个。这里是基础价,批量、区域和缓存写入的折扣见价格页。

规格与限制

Token

上下文窗口(厂商规格) 200,000
最大输出(厂商规格) 64,000
知识截止 2025-01
训练数据截至 2025-07 知识截止 2025-01

提示词缓存

缓存方式 显式(需开启)
最低前缀 1,024
存活时间 默认 5 分钟,可选 1 小时
写入成本 1.25x (5m) / 2x (1h)

思考

厂商参数 thinking.type "enabled" + budget_tokens
可选值 budget_tokens at least 1,024 and below max_tokens; "adaptive" returns 400
默认值 关闭,除非请求显式开启,否则不进行思考 请求未指定时生效
可关闭 支持
思考行为 仅支持扩展思考,没有 effort 参数;早先轮次的思考块会被剥离,只保留最后一个;交错思考需要 interleaved-thinking-2025-05-14 beta 请求头
参数 reasoning_effort
取值 minimal · low · medium · high 网关侧参数面——以上方厂商映射为准

模型

模态 文本 + 图像 → 文本
  • 旧版模型
  • 1M 上下文 beta(context-1m-2025-08-07)已于 2026-04-30 下线,现上限为 200k 上下文 / 64k 最大输出

依据 Anthropic 官方文档 ↗

30 秒用上 Claude Sonnet 4.5

OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-sonnet-4-5",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

关于 Claude Sonnet 4.5

  • 它把同级较快的延迟与出色的推理结合,支持 200K token 上下文窗口、最高 64K 输出 token、扩展思考、视觉输入和完整的 Claude 工具调用栈,价格为每百万 token $3/$15。
  • Anthropic 把它介绍为面向复杂智能体与编码的最佳模型,在当时的多数任务上具备最高智能,而结构化输出也正是在这一版本首次以公开 beta 发布,随后才正式发布。
  • 在为负载做容量规划前有一项限制值得知道:它的 1M token 上下文 beta 已于 2026 年 4 月下线,超过标准 200K 窗口的请求现在会返回错误,而不是静默截断。
  • 它的思考是较旧的扩展思考风格,带显式 token 预算,自适应思考类型会返回错误,也没有 effort 参数;交错思考需要 beta 头,先前轮次的思考块会被剥离而非向后传递。
  • 提示词缓存从 1,024 token 前缀起。
  • Anthropic 现建议使用更新的 Sonnet 版本以获得更好性能,但对针对它调优的负载,Sonnet 4.5 仍是一个稳定的固定快照。
  • Synthorai 继续通过与目录中其他模型相同的 OpenAI 兼容 API 提供它。

常见问题

Claude Sonnet 4.5 API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $3/M 计算,仅这笔额度就足够对 Claude Sonnet 4.5 发起约 41 次 ~8K token 的请求。

Claude Sonnet 4.5 最擅长什么?

快延迟搭配强推理、每百万 $3/$15,200K 上下文、为已调优负载保留的稳定快照。完整能力请见「关于」部分,内容取自厂商官方发布说明。

Claude Sonnet 4.5 的价格是多少?

在 Synthorai 上,Claude Sonnet 4.5 输入 $3/百万 token、输出 $15/百万 token,即厂商牌价,无平台加价。缓存命中的输入 token 按 $0.3/M 计费。

Claude Sonnet 4.5 支持提示词缓存(prompt caching)吗?

支持,需主动开启:用 cache_control 断点标记稳定前缀。缓存命中的输入 token 按 $0.3/M 计费(未命中 $3/M);提示词需有 1,024 token 以上的稳定前缀才能命中缓存(TTL 默认 5 分钟,可选 1 小时)。 提示词缓存指南 →

如何开通 Claude Sonnet 4.5?

把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "claude-sonnet-4-5" 即可。一把 API key 通用网关上的全部模型。

Claude Sonnet 4.5 的知识截止日期是什么时候?

Claude Sonnet 4.5 的知识截止日期为 2025-01,依据厂商官方文档(数据核验于 2026-07-09)。

相关模型

对比

本页每个值都转录自厂商自己的文档(链接见上),并带有核对日期。价格在全目录范围内比较;各厂商定义不同的规格值,只说明差异而不作图表对比。此处没有任何由我们测量的数据,也不做评分。

获取 API 密钥 算算你的成本 →