新人 免费注册,送 10 次调用,最高 $1,无需绑卡。

Fun-ASR vs Fun-ASR Flash

vs

什么时候选哪个

同为每音频分钟 $0.0021,所以要按形态而非价格来挑:fun-asr 是异步文件模型——最长 12 小时、2GB,带说话人分离、热词和句/词级时间戳——而 fun-asr-flash 同步返回,上限 5 分钟、2GB,支持流式和领域术语上下文注入,但没有分离也没有时间戳。两者的 30 语言列表相同。录音选 fun-asr,需要在请求内拿到结果的短音频选 fun-asr-flash。

价格

Fun-ASR Fun-ASR Flash Δ
每分钟音频 $0.0021 $0.0021 =

价格取自构建时的实时目录,最新价格见各模型页面。

两个模型所处的位置:全部 12 个按同一单位计费的语音转文字模型的每分钟音频价格分布(对数刻度)

Fun-ASR · $0.0021 Fun-ASR Flash · $0.0021

能力

Fun-ASR Fun-ASR Flash
说话人分离 是 否
流式输出 否 是
时间戳 是 -

规格

Fun-ASR Fun-ASR Flash
输入模态 音频 音频
输出模态 文本 文本
发布日期 2025-08-22 2026-06
限制

Async file transcription up to 12h / 2GB

hotwords + speaker diarization

sentence/word timestamps

30+ languages incl. Chinese dialects

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

语言 Multilingual with dialects, 30 languages: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

规格照录自各供应商的文档;供应商没有公布的项目,对应的行直接省略,不做推断。 完整来源: Fun-ASR · Fun-ASR Flash

改一行代码就能在两个模型之间切换

下方每个标签页里都有两个模型 ID,高亮的那两行是唯一要改的地方。端点不变,API key 不变,请求结构也不变。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr",
    # model="fun-asr-flash",  # 取消注释此行,注释上一行
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

获取 API key →

常见问题

Fun-ASR 和 Fun-ASR Flash 哪个更便宜?

两个模型的「每分钟音频」价格相同($0.0021),所以这一项上价格分不出高下,请看下方的规格与能力。

不用分别集成两次,就能对 Fun-ASR 和 Fun-ASR Flash 做 A/B 测试吗?

可以。两个模型走同一个 OpenAI 兼容端点,用同一个 API key,切换时只要改一行里的模型名,所以可以给两个模型各分一部分流量,直接对比账单。

Fun-ASR 和 Fun-ASR Flash 支持说话人分离吗?

上方的能力表格按各供应商的官方文档,逐个模型回答了这个问题。说话人分离、流式输出和时间戳三项分开列出,因为不同模型在这三项上的支持情况都不一样。

相关对比

我们的实测研究