Fun-ASR vs Fun-ASR Flash
何時該用哪一個 — 綜合評斷,而非基準測試數據表
同為每音訊分鐘 $0.0021,所以要按形態而非價格來挑:fun-asr 是非同步檔案模型——最長 12 小時、2GB,帶語者分離、熱詞和句/詞級時間戳——而 fun-asr-flash 同步回傳,上限 5 分鐘、2GB,支援串流和領域術語脈絡注入,但沒有分離也沒有時間戳。兩者的 30 語言列表相同。錄音選 fun-asr,需要在請求內拿到結果的短音訊選 fun-asr-flash。
定價
| Fun-ASR | Fun-ASR Flash | Δ | |
|---|---|---|---|
| 每分鐘音訊 | $0.0021 | $0.0021 | = |
費率取自建置時的即時目錄;各模型頁面皆附有目前的費率卡。
它們的相對位置 — 在此計費單位下,所有 11 個 語音轉文字 模型的 每分鐘語音的價格(對數尺度)
能力
| Fun-ASR | Fun-ASR Flash | |
|---|---|---|
| 語者分段 | 是 | 否 |
| 串流 | 否 | 是 |
| 時間戳記 | 是 | — |
規格
| Fun-ASR | Fun-ASR Flash | |
|---|---|---|
| 輸入模態 | 音訊 | 音訊 |
| 輸出模態 | 文字 | 文字 |
| 發布日期 | 2025-08-22 | 2026-06 |
| 限制 | Async file transcription up to 12h / 2GB hotwords + speaker diarization sentence/word timestamps 30+ languages incl. Chinese dialects | Synchronous fast recognition, <=5 min / <=2GB per audio context injection for domain terms 30+ languages no diarization |
| 語言 | Multilingual with dialects, 30 languages: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak | Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak |
規格摘錄自各供應商的文件;供應商未發布的資料列會直接省略,而非自行推測。 完整來源: Fun-ASR · Fun-ASR Flash
只需一行程式碼即可在兩者間切換
以下每個頁籤中都有這兩個 ID — 醒目提示的這兩行是唯一的修改處。相同的端點,相同的金鑰,相同的請求結構。
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="fun-asr",
# model="fun-asr-flash", # 取消註解此行,並註解上一行
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "fun-asr",
// model: "fun-asr-flash", // 取消註解此行,並註解上一行
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="fun-asr" \
# -F model="fun-asr-flash" \ # 取消註解此行,並註解上一行
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "fun-asr",
// Model: "fun-asr-flash", // 取消註解此行,並註解上一行
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("fun-asr")
// .model("fun-asr-flash") // 取消註解此行,並註解上一行
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());常見問題
Fun-ASR 和 Fun-ASR Flash 哪個比較便宜?
兩者列出的 每分鐘音訊 相同($0.0021),因此價格無法決定勝負 — 請參閱下方的規格與功能。
我可以在不進行兩次整合的情況下,對 Fun-ASR 和 Fun-ASR Flash 進行 A/B 測試嗎?
可以。兩者皆透過同一個相容 OpenAI 的端點提供服務,並使用同一把 API 金鑰 — 切換只需更改一行的模型字串,因此您可以將部分流量分別導向兩者並直接比較帳單。
Fun-ASR 和 Fun-ASR Flash 支援語者分段嗎?
上方的功能表根據各廠商的官方文件回答了每個模型的支援情況 — 語者分段、串流與時間戳記是分開列出的,因為模型在這三方面的支援皆有所不同。