新人 免费注册,送 10 次调用,最高 $1,免绑卡。
Seedance API 定价实测:精确推导视频 token 公式

Seedance API 定价实测:精确推导视频 token 公式

目录
  1. Seedance 各模型分别能做什么?
  2. 如何调用 Seedance API?
  3. 视频 token 到底是什么?
  4. Seedance 实际每秒多少钱?
  5. 4k 更便宜吗?价目表说是,账单说不是
  6. generate_audio 会改变什么?
  7. 异步视频计费如何运作?
  8. 常见问题

Seedance 按 token 对视频生成计费。与实际计量完全一致的公式是 encoded_width × encoded_height × (24 × seconds + 1) / 1024。其中有两点在我们能找到的文档里都没有说明:帧数需要 +1,而且编码尺寸与标称分辨率不同,例如 720p 按 1248×704 而不是 1280×720 计费。我们测试了 5 个 Seedance 模型和全部分辨率档位,共完成 27 次生成。每次的计费 token 数都能用这个公式精确算出。本文先梳理各模型的能力和两次请求式 API 调用流程,再给出推导后的公式、由此算出的每秒价格,以及价目表中容易误导人的两处信息。

TL;DR

  • Seedance 视频 token = 编码宽度 × 高度 × (24 × 秒数 + 1) / 1024;额外的 1 帧和编码尺寸均来自实测,文档中没有说明。
  • 720p 按 1248×704 计费,1080p 按 1920×1088 计费;宽高比不影响费用。
  • 同一个 4 秒视频在 1.5-pro 及以上所有档位产生的 token 数完全相同;费率为每百万 token $1.0 到 $7.0。
  • 4k 的费率为 $4.0/M,低于 1080p 的 $7.7/M,但每秒成本分别为 $0.78 和 $0.38,前者高出 2.1 倍。
  • generate_audio 不改变 token 数,但在 1.5-pro 上会让费率翻倍。

以下数据均于 2026-07-22 通过 Synthorai 网关的 /v1/videos 端点实测。该端点已上线完整的 Seedance 系列,并采用 ByteDance 标价;每个数字都有原始任务记录佐证。

Seedance 各模型分别能做什么?

档位只影响费率,不影响 token 计量方式。应先按能力选模型,再根据后文计算费用。同一个 4 秒 480p prompt 在 Seedance 2.0、2.0-fast、2.0-mini 和 1.5-pro 上产生的 token 数完全相同,均为 40,594;1.0-pro-fast 的像素网格略小,因此为 39,285。更高档位买到的是能力,但各模型的能力分布并不均匀:

分辨率时长音频图片输入seed / camera_fixed费率($/M token)
2.0480p-4k4-15s(+auto)✓ 原生首帧 + 尾帧$7.0(1080p $7.7 · 4k $4.0)
2.0-fast480p-720p4-15s(+auto)首帧 + 尾帧$5.6
2.0-mini480p-720p4-15s(+auto)首帧 + 尾帧$3.5
1.5-pro480p-1080p4-12s(+auto)可切换($1.2 / $2.4)首帧 + 尾帧$1.2-2.4
1.0-pro-fast480p-1080p2-12s仅首帧$1.0

选型前需要了解三个特殊点。首先,可复现性与模型档位正好相反:只有 1.x 模型支持 seedcamera_fixed。也就是说,最便宜的档位反而可控,旗舰模型却不支持。其次,每个模型都严格限制能力字段。向 1.0 模型发送 generate_audio 会返回明确的 400 错误(extension_not_supported)。因此,应按各模型的能力列表构造请求,不要让所有模型共用同一套请求结构。最后,只有 1.0-pro-fast 支持短至 2 秒的视频,这也是下文公式测量主要使用该模型的原因;更新的模型最短均为 4 秒。除表中能力外,在平台开放相关功能时,2.0 模型还支持上游参考文件输入,最多可传 9 张图片、3 个视频片段和 3 个音频文件。

如何调用 Seedance API?

视频生成采用异步任务 API。先发送一次 POST 创建任务,约 2 秒后返回;随后轮询任务 URL,直到任务完成。完整的 Python 调用流程如下:

import os, time, requests

BASE = "https://synthorai.io/v1"
auth = {"Authorization": f"Bearer {os.environ['SYNTHORAI_API_KEY']}"}

task = requests.post(f"{BASE}/videos", headers=auth, json={
    "model": "seedance-1-5-pro-251215",
    "prompt": "A paper boat drifting across a rain puddle, cinematic",
    "resolution": "720p", "ratio": "16:9",
    "duration": 5, "generate_audio": True,
}).json()                                    # returns in ~2s: {"id": "vid_...", "status": "queued", ...}

while task["status"] not in ("completed", "failed", "cancelled"):
    time.sleep(8)
    task = requests.get(f"{BASE}/videos/{task['id']}", headers=auth).json()

print(task["data"][0]["url"])                # signed MP4, valid 24h
print(task["usage"]["total_tokens"])         # the billing meter this post is about

如果不想轮询,可以在创建请求中加入 Prefer: wait=60 header。响应会一直等待,直到视频生成完成或等待窗口到期;若到期仍未完成,则退化为普通的轮询任务对象。在我们的测试中,480p 和 720p 视频的生成耗时从 20 秒到略超 2 分钟不等。任务完成后,usage.total_tokens 字段就是计费值。本文后续将分析哪些因素会影响它。

视频 token 到底是什么?

一个视频 token 代表固定数量的输出像素和时间。计费数量为 W × H × frames / 1024,其中帧数是 24 × seconds + 1,W×H 是编码器的实际尺寸,而不是分辨率档位上的标称尺寸。这两部分都是从计费数据中反推出来的。我们分别测试了每种分辨率下的 3 个时长,token 数全部精确落在一条直线上,残差为零。直线斜率对应每秒 token 数;在每个分辨率下,截距都恰好等于 1 帧的 token 数:480p 为 405,720p 为 858,1080p 为 2,040。再根据斜率求解 W×H,即可得到实际编码网格:

标称档位编码尺寸(实测)每秒 token 数额外 1 帧
480p864×480(1.0 系列)/ 864×496(1.5/2.0 系列)9,720 / 10,044405 / 418
720p1248×704(不是 1280×720)20,592858
1080p1920×1088(不是 1920×1080)48,9602,040
4k3840×2160(标称尺寸 = 编码尺寸)194,4008,100

还有一个独立交叉验证:ByteDance 广泛流传的 2.0 计算示例中,一个 15 秒视频约为 308,880 个 token。这个数字恰好是我们实测 720p 每秒 token 数的 15 倍,说明由 1.0 系列拟合出的 720p 编码网格同样适用于 2.0。不过,该营销示例的计算省略了 +1 帧。

这会带来两个实际影响。第一,宽高比不影响费用。在全部 9 组配对测试中,16:9 和 9:16 的计费 token 数完全相同,因此竖屏输出不会增加成本。第二,常见的估算公式 W × H × 24 × duration / 1024 不仅少算了 1 帧,还使用了错误的编码尺寸。这就是第三方估算通常与实际账单相差几个百分点的原因。

Seedance 实际每秒多少钱?

将实测的每秒 token 数乘以各档位标价,整个产品线就可以归纳为下面这组阶梯价格:

模型及分辨率$/秒(实测 token × 标价)
seedance-1.0-pro-fast @ 480p$0.0097
seedance-1.5-pro @ 480p,无音频$0.0121
seedance-1.0-pro-fast @ 720p$0.0206
seedance-1.5-pro @ 480p,含音频$0.0241
seedance-2.0-mini @ 480p$0.0352
seedance-1.0-pro-fast @ 1080p$0.0490
seedance-2.0-fast @ 480p$0.0563
seedance-2.0 @ 480p$0.0703
seedance-2.0 @ 4k$0.778

作为参照,根据公开价格追踪网站汇总的 2026 年 7 月标价,按秒计费的 Kling 约为 $0.07/s,Sora 2 约为 $0.10/s,Veo 3.1 约为 $0.40/s。Seedance 2.0 的 480p 档位与 Kling 价格相当,并且包含原生多轨音频;1.0-fast 则能以约为 Kling 七分之一的费率生成可用的 480p 视频。使用 2.0 生成 15 秒 720p 视频约需 $2.17,而使用 1.0-pro-fast 生成同样的视频只需 $0.31。

4k 更便宜吗?价目表说是,账单说不是

Seedance 2.0 的 4k 档位拥有最低的每 token 费率:每百万 token 为 $4.0,低于 1080p 的 $7.7,但它仍然是所有选项中最贵的。原因就在计费公式里:4k 每秒产生的 token 数约为 1080p 的 4 倍,分别是 194,400 和 48,960。因此,即便费率更低,4k 的每秒成本仍为 1080p 的 2.1 倍,分别是 $0.778/s 和 $0.377/s。我们用于验证的 4 秒 4k 视频产生了 785,700 个 token,4 秒视频费用为 $3.14。查看任何按 token 报价的价目表时,都应同时对照该分辨率的每秒 token 数。对于按 token 计费的视频生成,标价高低与实际账单可能完全相反。

generate_audio 会改变什么?

它改变的是费率,不是 token 数。在 1.5-pro 上,同一个 5 秒视频无论是否启用音频,计费量都是 50,638 个 token;无音频标价为 $1.2/M,启用音频后则翻倍至 $2.4/M。因此,带音频输出的成本正好是 2 倍,没有隐藏的 token 附加费。2.0 系列的音频已经包含在统一费率中,无需再计算开关差价。如果你的处理流程本来就会自行添加音乐,那么 1.5-pro 的无音频模式只需 $0.0121/s,是整个产品线中性价比很高的选择。

异步视频计费如何运作?

费用与前文展示的任务生命周期绑定:任务首次变为 completed 时只计费一次,轮询多少次都不会重复收费。取消规则符合实际执行状态:queued 任务可以直接取消且不收费;任务一旦进入 running 状态,上游就会拒绝删除并返回 409,只能等待任务结束。生成失败不收费。

根据 27 个任务的运行结果,还有三个运维层面的注意事项。第一,与 chat 的 usage.cost 不同,视频响应会返回 token 用量,但不会返回成本字段;预算需要按 token 数 × 所在档位费率计算。第二,输出以签名 URL 形式提供,有效期为 24 小时,应尽快转存到自己的存储系统。第三,需要控制创建任务的速率。每个 workspace 每分钟最多创建 6 个视频任务。每个 pending 任务都会按最坏情况预占余额,因此上游变慢时,如果短时间内集中创建大量任务,即使最终花费不超预算,也可能因临时额度不足而被拒绝。

常见问题

Seedance 2.0 API 现在真的可用吗?

是的。2026 年初那些关于中国区凭证、waitlist 和分阶段开放的信息已经过时。包括 2.0 在内的完整产品线都已上线 Synthorai 网关的 /v1/videos 端点,采用 ByteDance 标价(模型页面:Seedance 2.01.5-pro1.0-pro-fast),其他多个平台也已提供这些模型。如果某个页面仍称 Seedance 2.0 只能通过体验额度使用,那篇内容发布于 API 正式开放之前。

为什么不同服务商的 Seedance 价格差别这么大?

大多数转售商会把 token 计费转换为按秒或按视频的固定价格,并加入自己的利润和取整规则。这种转换掩盖了随分辨率和时长变化的 token 计算方式。本文公式是所有报价的计算基础:使用编码尺寸计算 W × H × (24s + 1) / 1024,再乘以官方费率,就能精确算出任意服务商的加价幅度。

不同宽高比或竖屏格式会额外收费吗?

不会。在我们测试的所有分辨率和时长下,16:9 与 9:16 的计费 token 数完全相同。只有分辨率和时长会改变计费量,而且费用与时长严格呈线性关系。

Seedance 2.5 呢?

已经发布,但我们跟踪的 API 尚未提供。token 公式以及档位与费率之间的结构很可能沿用;上线后,我们会重新执行同样的测试。

测量时间为 2026-07-22/23:通过 /v1/videos 在 5 个 Seedance 模型上完成了 27 次生成,token 数取自各任务的 usage 记录,费率取自 ByteDance 标价,能力矩阵取自线上 /v1/videos/models 目录。竞品每秒价格为标价,并非实测。所有实测点都与公式精确吻合;编码尺寸根据计费数据反推,因此如果 ByteDance 更换编码器,需要重新验证。其他模态的分析见:图像生成语音转文字语音会话文本 token

← 返回博客