🎁 新人 免费注册,送 10 次调用,最高 $1,免绑卡。

TTS-1

OpenAI 语音合成流式输出
输入$15/M
上下文4K

厂商牌价,无平台加价,按量付费。 以下为官方 list 价。登录客户可在 /console/pricing 查看含工作空间折扣的实际价格。

30 秒用上 TTS-1

OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="tts-1",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

规格与限制

音频

语言
大体沿用 Whisper 模型的语言支持:南非荷兰语、阿拉伯语、亚美尼亚语、阿塞拜疆语、白俄罗斯语、波斯尼亚语、保加利亚语、加泰罗尼亚语、中文、克罗地亚语、捷克语、丹麦语、荷兰语、英语、爱沙尼亚语、芬兰语、法语、加利西亚语、德语、希腊语、希伯来语、印地语、匈牙利语、冰岛语、印尼语、意大利语、日语、卡纳达语、哈萨克语、韩语、拉脱维亚语、立陶宛语、马其顿语、马来语、马拉地语、毛利语、尼泊尔语、挪威语、波斯语、波兰语、葡萄牙语、罗马尼亚语、俄语、塞尔维亚语、斯洛伐克语、斯洛文尼亚语、西班牙语、斯瓦希里语、瑞典语、他加禄语、泰米尔语、泰语、土耳其语、乌克兰语、乌尔都语、越南语和威尔士语,尽管音色是针对英语优化的
音频限制
  • 仅支持语音生成端点(v1/audio/speech),Chat Completions、Responses、Realtime、Batch 和微调均列为不支持
  • 输入文本上限 4096 个字符
  • 输出 mp3(默认)、opus、aac、flac、wav 或 pcm(原始 24 kHz 16-bit 有符号小端采样)
  • 通过分块传输编码实现实时播放

实时语音

语音
alloy、ash、coral、echo、fable、onyx、nova、sage 和 shimmer,比完整的 13 个 TTS 音色列表要少,且这些音色目前是针对英语优化的。

模型

模态
文本 → 音频
  • 为速度优化的文本转语音模型:OpenAI 将 tts-1 记载为相对 tts-1-hd 延迟更低、质量更低的选项。
  • 在 gpt-4o-mini-tts 上用于调控口音、情绪、语调和语气的 instructions 参数,对 tts-1 和 tts-1-hd 无效。

依据 OpenAI 官方文档 ↗

关于 TTS-1

为速度与实时文本转语音场景优化
延迟低于 tts-1-hd,质量也更低
没有 instructions 参数,也没有 sse 流式格式

TTS-1 是 OpenAI 为速度优化的文本转语音模型。

  • 其模型页描述它把文本转换为听起来自然的口语文本,并针对实时文本转语音场景调优,而文本转语音指南直白地划出家族分界:tts-1 提供更低的延迟,但质量低于 tts-1-hd。
  • 它是单一用途模型,仅在 Audio API 的 speech 端点上受支持,不走其他任何路由,接受文本输入并返回音频,价格为每百万字符 $15。
  • 它可用九种音色,少于 Speech 端点合计提供的十三种:alloy、ash、coral、echo、fable、onyx、nova、sage 和 shimmer。
  • 输出默认为 MP3,也可选 Opus、AAC、FLAC、WAV 或 24 kHz 原始 PCM,OpenAI 建议用 WAV 或 PCM 以获得最快响应;语速可在 0.25 到 4.0 之间调整,默认 1.0,音频可用分块传输编码流式返回,因此播放可以在完整文件生成前开始。
  • 有两项限制把这一代与更新的一代区分开,也会让照搬来的代码出错:用于引导口音、情绪和表达方式的 instructions 参数在 tts-1 和 tts-1-hd 上不起作用,sse 流式格式在这里也不受支持。
  • 语言覆盖大体沿用 Whisper 的五十多种语言列表,不过音色本身是针对英语优化的,OpenAI 的使用政策要求告知终端用户该语音由 AI 生成。
  • Synthorai 通过其 OpenAI 兼容的 /v1/audio/speech 端点提供 TTS-1,现有语音客户端无需修改即可使用。

常见问题

TTS-1 API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $15/M 计算,仅这笔额度就足够对 TTS-1 发起约 16 次 ~4K token 的请求。

TTS-1 最擅长什么?

为速度与实时文本转语音场景优化、延迟低于 tts-1-hd,质量也更低、没有 instructions 参数,也没有 sse 流式格式。完整能力请见「关于」部分,内容取自厂商官方发布说明。

TTS-1 的价格是多少?

在 Synthorai 上,TTS-1 输入 $15/百万 token、输出 $0/百万 token,即厂商牌价,无平台加价。

TTS-1 支持提示词缓存(prompt caching)吗?

TTS-1 目前在 Synthorai 上没有缓存读取折扣。网关上的其他模型仍支持提示词缓存,可在价格表中查看支持缓存的替代模型。 各厂商缓存对比 →

如何开通 TTS-1?

把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "tts-1" 即可。一把 API key 通用网关上的全部模型。

相关模型

免费获取 API key 算算你的成本 →