🎁 新用戶 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Fun-ASR Flash vs Seed ASR

vs

何時該用哪一個 — 綜合評斷,而非基準測試數據表

每分鐘費率的差距只在捨入誤差範圍內($0.0021 對 $0.002),於是選擇完全取決於能力:seed-asr-bigmodel 在音訊檔案 API 上做語者分離(文件標註 10 人以內效果最佳),回傳句級和詞級時間戳,單一檔案最長 5 小時;fun-asr-flash 只支援同步,上限 5 分鐘、2GB,沒有分離,但有面向領域術語的脈絡注入。要短音訊快速回傳選 fun-asr-flash,長錄音或多語者選 seed-asr-bigmodel。

定價

Fun-ASR Flash Seed ASR Δ
每分鐘音訊 $0.0021 $0.002

費率取自建置時的即時目錄;各模型頁面皆附有目前的費率卡。

它們的相對位置 — 在此計費單位下,所有 11 個 語音轉文字 模型的 每分鐘語音的價格(對數尺度)

Fun-ASR Flash · $0.0021 Seed ASR · $0.002
$0.002 · Fun-ASR Realtime $0.016 · Chirp 2

能力

Fun-ASR Flash Seed ASR
語者分段
串流
時間戳記

規格

Fun-ASR Flash Seed ASR
輸入模態 音訊 音訊
輸出模態 文字 文字
發布日期 2026-06
限制

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

Async audio-file mode: <512MB, <5 hours, OPUS/WAV/MP3/SPX/OGG/AMR/AAC/M4A (raw PCM also accepted), results returned within 3 hours and retained 7 days

speaker diarization via enable_speaker_info (audio-file API only, best with <=10 speakers, no diarization on the streaming API)

sentence + word segmentation with start_time/end_time via show_utterances

language identification via enable_lid

hotwords/context up to 800 tokens and 20 rounds

per-call billing

語言 Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

With `language` empty the model covers Mandarin, English, Cantonese, Shanghainese, Minnan, Sichuan and Shaanxi dialects

39 language keys can be pinned explicitly (en-US, zh-CN, yue-CN, ja-JP, ko-KR, id-ID, es-MX, pt-BR, de-DE, fr-FR, fil-PH, ms-MY, th-TH, ar-SA, it-IT, bn-BD, el-GR, nl-NL, ru-RU, tr-TR, vi-VN, pl-PL, ro-RO, uk-UA, az-AZ, bg-BG, cs-CZ, da-DK, fi-FI, hi-IN, hu-HU, kk-KZ, km-KH, my-MM, no-NO, pa-PK, sv-SE, sw-KE, ur-PK), plus optional auto-detection (enable_auto_lang)

規格摘錄自各供應商的文件;供應商未發布的資料列會直接省略,而非自行推測。 完整來源: Fun-ASR Flash · Seed ASR

只需一行程式碼即可在兩者間切換

以下每個頁籤中都有這兩個 ID — 醒目提示的這兩行是唯一的修改處。相同的端點,相同的金鑰,相同的請求結構。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    # model="seed-asr-bigmodel",  # 取消註解此行,並註解上一行
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

取得 API 金鑰 →

常見問題

Fun-ASR Flash 和 Seed ASR 哪個比較便宜?

Seed ASR 在 每分鐘音訊 上較便宜($0.002 對比 $0.0021,相差 1.0×)。其他項目可能呈現相反結果 — 上表提供完整資訊,實際成本取決於您的使用組合。

我可以在不進行兩次整合的情況下,對 Fun-ASR Flash 和 Seed ASR 進行 A/B 測試嗎?

可以。兩者皆透過同一個相容 OpenAI 的端點提供服務,並使用同一把 API 金鑰 — 切換只需更改一行的模型字串,因此您可以將部分流量分別導向兩者並直接比較帳單。

Fun-ASR Flash 和 Seed ASR 支援語者分段嗎?

上方的功能表根據各廠商的官方文件回答了每個模型的支援情況 — 語者分段、串流與時間戳記是分開列出的,因為模型在這三方面的支援皆有所不同。

相關比較