Chirp 3 vs Fun-ASR Flash
什麼情況選哪一個
兩者都按音訊分鐘計費,fun-asr-flash 便宜 7.6 倍,$0.0021 對 $0.016——但它是較窄的工具:僅同步辨識,單一檔案最長 5 分鐘或 2GB,30 多種語言,不做語者分離。chirp-3 涵蓋 29 個 GA 加 82 個預覽語言區,批次處理最長一小時並支援即時串流,還能在 14 種語言上做分離。大批量短音訊選 fun-asr-flash;需要分離、長檔案或更寬的語言區列表時選 chirp-3。
定價
| Chirp 3 | Fun-ASR Flash | Δ | |
|---|---|---|---|
| 每分鐘音訊 | $0.016 | $0.0021 | 7.6× |
費率取自網站建置時的即時目錄;各模型頁面都列有最新的價目。
兩者的相對位置:每分鐘音訊的價格,涵蓋同一計費單位下全部 12 個語音轉文字模型(對數尺度)
功能
| Chirp 3 | Fun-ASR Flash | |
|---|---|---|
| 語者分離 | 是 | 否 |
| 串流 | 是 | 是 |
| 時間戳記 | 是 | - |
規格
| Chirp 3 | Fun-ASR Flash | |
|---|---|---|
| 輸入模態 | 音訊 | 音訊 |
| 輸出模態 | 文字 | 文字 |
| 發布日期 | 2025-10-13 | 2026-06 |
| 限制 | Auto-detected audio decoding sync Recognize <1 min, BatchRecognize 1 min - 1 hr (<=20 min with word timestamps), StreamingRecognize for real-time speaker diarization in BatchRecognize and Recognize (14 languages) utterance-level timestamps (StreamingRecognize only), word-level timestamps listed as unsupported language-agnostic transcription 29 GA + 82 preview locales | Synchronous fast recognition, <=5 min / <=2GB per audio context injection for domain terms 30+ languages no diarization |
| 語言 | 29 GA + 82 Preview locales (111 total) across StreamingRecognize, Recognize and BatchRecognize diarization covers 14 of them | Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak |
規格摘錄自各供應商的文件;供應商沒有公布的項目就直接略過,不自行推測。 完整來源: Chirp 3 · Fun-ASR Flash
改一行程式碼就能在兩者之間切換
下面每個頁籤都列了這兩個模型 ID,要改的只有醒目標示的那兩行。端點、金鑰和請求格式都不變。
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="chirp-3",
# model="fun-asr-flash", # 取消這一行的註解,並把上一行註解掉
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "chirp-3",
// model: "fun-asr-flash", // 取消這一行的註解,並把上一行註解掉
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="chirp-3" \
# -F model="fun-asr-flash" \ # 取消這一行的註解,並把上一行註解掉
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "chirp-3",
// Model: "fun-asr-flash", // 取消這一行的註解,並把上一行註解掉
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("chirp-3")
// .model("fun-asr-flash") // 取消這一行的註解,並把上一行註解掉
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());常見問題
Chirp 3 和 Fun-ASR Flash 哪個比較便宜?
以「每分鐘音訊」來看,Fun-ASR Flash 比較便宜($0.0021 對 $0.016,相差 7.6×)。其他項目的結果可能相反,完整價目請看上表;實際成本要看你的用量組合。
可以只串接一次,就對 Chirp 3 和 Fun-ASR Flash 做 A/B 測試嗎?
可以。兩個模型都走同一個 OpenAI 相容端點,用的也是同一把 API 金鑰,切換時只要改一行裡的模型名稱字串。你可以把一部分流量分別導到兩邊,再直接比較帳單。
Chirp 3 和 Fun-ASR Flash 支援語者分離嗎?
上方的功能表依各供應商的官方文件,逐一列出每個模型的支援情況。語者分離、串流和時間戳記分開列,是因為這三項各模型的支援程度都不一樣。