Fun-ASR vs Fun-ASR Flash
什麼情況選哪一個
同為每音訊分鐘 $0.0021,所以要按形態而非價格來挑:fun-asr 是非同步檔案模型——最長 12 小時、2GB,帶語者分離、熱詞和句/詞級時間戳——而 fun-asr-flash 同步回傳,上限 5 分鐘、2GB,支援串流和領域術語脈絡注入,但沒有分離也沒有時間戳。兩者的 30 語言列表相同。錄音選 fun-asr,需要在請求內拿到結果的短音訊選 fun-asr-flash。
定價
| Fun-ASR | Fun-ASR Flash | Δ | |
|---|---|---|---|
| 每分鐘音訊 | $0.0021 | $0.0021 | = |
費率取自網站建置時的即時目錄;各模型頁面都列有最新的價目。
兩者的相對位置:每分鐘音訊的價格,涵蓋同一計費單位下全部 12 個語音轉文字模型(對數尺度)
功能
| Fun-ASR | Fun-ASR Flash | |
|---|---|---|
| 語者分離 | 是 | 否 |
| 串流 | 否 | 是 |
| 時間戳記 | 是 | - |
規格
| Fun-ASR | Fun-ASR Flash | |
|---|---|---|
| 輸入模態 | 音訊 | 音訊 |
| 輸出模態 | 文字 | 文字 |
| 發布日期 | 2025-08-22 | 2026-06 |
| 限制 | Async file transcription up to 12h / 2GB hotwords + speaker diarization sentence/word timestamps 30+ languages incl. Chinese dialects | Synchronous fast recognition, <=5 min / <=2GB per audio context injection for domain terms 30+ languages no diarization |
| 語言 | Multilingual with dialects, 30 languages: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak | Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak |
規格摘錄自各供應商的文件;供應商沒有公布的項目就直接略過,不自行推測。 完整來源: Fun-ASR · Fun-ASR Flash
改一行程式碼就能在兩者之間切換
下面每個頁籤都列了這兩個模型 ID,要改的只有醒目標示的那兩行。端點、金鑰和請求格式都不變。
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="fun-asr",
# model="fun-asr-flash", # 取消這一行的註解,並把上一行註解掉
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "fun-asr",
// model: "fun-asr-flash", // 取消這一行的註解,並把上一行註解掉
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="fun-asr" \
# -F model="fun-asr-flash" \ # 取消這一行的註解,並把上一行註解掉
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "fun-asr",
// Model: "fun-asr-flash", // 取消這一行的註解,並把上一行註解掉
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("fun-asr")
// .model("fun-asr-flash") // 取消這一行的註解,並把上一行註解掉
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());常見問題
Fun-ASR 和 Fun-ASR Flash 哪個比較便宜?
兩者的「每分鐘音訊」相同($0.0021),這一項分不出高下,請看下方的規格與功能。
可以只串接一次,就對 Fun-ASR 和 Fun-ASR Flash 做 A/B 測試嗎?
可以。兩個模型都走同一個 OpenAI 相容端點,用的也是同一把 API 金鑰,切換時只要改一行裡的模型名稱字串。你可以把一部分流量分別導到兩邊,再直接比較帳單。
Fun-ASR 和 Fun-ASR Flash 支援語者分離嗎?
上方的功能表依各供應商的官方文件,逐一列出每個模型的支援情況。語者分離、串流和時間戳記分開列,是因為這三項各模型的支援程度都不一樣。