新帳號 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Fun-ASR Flash vs Seed ASR

vs

什麼情況選哪一個

每分鐘費率的差距只在捨入誤差範圍內($0.0021 對 $0.002),於是選擇完全取決於能力:seed-asr-bigmodel 在音訊檔案 API 上做語者分離(文件標註 10 人以內效果最佳),回傳句級和詞級時間戳,單一檔案最長 5 小時;fun-asr-flash 只支援同步,上限 5 分鐘、2GB,沒有分離,但有面向領域術語的脈絡注入。要短音訊快速回傳選 fun-asr-flash,長錄音或多語者選 seed-asr-bigmodel。

定價

Fun-ASR Flash Seed ASR Δ
每分鐘音訊 $0.0021 $0.002 1×

費率取自網站建置時的即時目錄;各模型頁面都列有最新的價目。

兩者的相對位置:每分鐘音訊的價格,涵蓋同一計費單位下全部 12 個語音轉文字模型(對數尺度)

Fun-ASR Flash · $0.0021 Seed ASR · $0.002

功能

Fun-ASR Flash Seed ASR
語者分離 否 是
串流 是 是
時間戳記 - 是

規格

Fun-ASR Flash Seed ASR
輸入模態 音訊 音訊
輸出模態 文字 文字
發布日期 2026-06 2025-12-05
限制

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

Async audio-file mode: <512MB, <5 hours, OPUS/WAV/MP3/SPX/OGG/AMR/AAC/M4A (raw PCM also accepted), results returned within 3 hours and retained 7 days

speaker diarization via enable_speaker_info (audio-file API only, best with <=10 speakers, no diarization on the streaming API)

sentence + word segmentation with start_time/end_time via show_utterances

language identification via enable_lid

hotwords/context up to 800 tokens and 20 rounds

per-call billing

語言 Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

With `language` empty the model covers Mandarin, English, Cantonese, Shanghainese, Minnan, Sichuan and Shaanxi dialects

39 language keys can be pinned explicitly (en-US, zh-CN, yue-CN, ja-JP, ko-KR, id-ID, es-MX, pt-BR, de-DE, fr-FR, fil-PH, ms-MY, th-TH, ar-SA, it-IT, bn-BD, el-GR, nl-NL, ru-RU, tr-TR, vi-VN, pl-PL, ro-RO, uk-UA, az-AZ, bg-BG, cs-CZ, da-DK, fi-FI, hi-IN, hu-HU, kk-KZ, km-KH, my-MM, no-NO, pa-PK, sv-SE, sw-KE, ur-PK), plus optional auto-detection (enable_auto_lang)

規格摘錄自各供應商的文件;供應商沒有公布的項目就直接略過,不自行推測。 完整來源: Fun-ASR Flash · Seed ASR

改一行程式碼就能在兩者之間切換

下面每個頁籤都列了這兩個模型 ID,要改的只有醒目標示的那兩行。端點、金鑰和請求格式都不變。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    # model="seed-asr-bigmodel",  # 取消這一行的註解,並把上一行註解掉
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

取得 API 金鑰 →

常見問題

Fun-ASR Flash 和 Seed ASR 哪個比較便宜?

以「每分鐘音訊」來看,Seed ASR 比較便宜($0.002 對 $0.0021,相差 1.0×)。其他項目的結果可能相反,完整價目請看上表;實際成本要看你的用量組合。

可以只串接一次,就對 Fun-ASR Flash 和 Seed ASR 做 A/B 測試嗎?

可以。兩個模型都走同一個 OpenAI 相容端點,用的也是同一把 API 金鑰,切換時只要改一行裡的模型名稱字串。你可以把一部分流量分別導到兩邊,再直接比較帳單。

Fun-ASR Flash 和 Seed ASR 支援語者分離嗎?

上方的功能表依各供應商的官方文件,逐一列出每個模型的支援情況。語者分離、串流和時間戳記分開列,是因為這三項各模型的支援程度都不一樣。

相關比較