Fun-ASR vs Fun-ASR Flash
Welches und wann — kuratiertes Fazit, keine Benchmark-Tabelle
Gleiche $0.0021 pro Audiominute, wählen Sie also nach Form statt nach Preis: fun-asr ist das asynchrone Dateimodell — bis zu 12 Stunden und 2GB, mit Sprechertrennung, Hotwords und Zeitstempeln auf Satz- und Wortebene — während fun-asr-flash synchron antwortet, gedeckelt bei 5 Minuten und 2GB, mit Streaming und Kontextinjektion für Fachbegriffe, aber ohne Trennung und ohne Zeitstempel. Die Liste von 30 Sprachen ist auf beiden gleich. Nehmen Sie fun-asr für Aufnahmen, fun-asr-flash für kurze Clips, die in der Anfrage beantwortet werden.
Preise
| Fun-ASR | Fun-ASR Flash | Δ | |
|---|---|---|---|
| Pro Audiominute | $0.0021 | $0.0021 | = |
Preise aus dem Live-Katalog zum Zeitpunkt des Builds; jede Modellseite enthält die aktuelle Übersicht.
Wo sie stehen — Preis pro Audiominute über alle 11 Speech-to-Text-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)
Fähigkeiten
| Fun-ASR | Fun-ASR Flash | |
|---|---|---|
| Sprecherdiarisierung | ja | nein |
| Streaming | nein | ja |
| Zeitstempel | ja | — |
Spezifikationen
| Fun-ASR | Fun-ASR Flash | |
|---|---|---|
| Input-Modalitäten | Audio | Audio |
| Ausgabemodalitäten | Text | Text |
| Veröffentlicht | 2025-08-22 | 2026-06 |
| Limits | Async file transcription up to 12h / 2GB hotwords + speaker diarization sentence/word timestamps 30+ languages incl. Chinese dialects | Synchronous fast recognition, <=5 min / <=2GB per audio context injection for domain terms 30+ languages no diarization |
| Sprachen | Multilingual with dialects, 30 languages: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak | Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak |
Die Spezifikationen sind aus der Dokumentation der jeweiligen Anbieter übernommen; eine Zeile, die ein Anbieter nicht veröffentlicht, wird weggelassen und nicht abgeleitet. Vollständige Quellen: Fun-ASR · Fun-ASR Flash
Mit einer Zeile zwischen ihnen wechseln
Beide IDs befinden sich in jedem Tab unten — das hervorgehobene Zeilenpaar ist die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiche Request-Struktur.
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="fun-asr",
# model="fun-asr-flash", # diese Zeile einkommentieren, die darüberliegende auskommentieren
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "fun-asr",
// model: "fun-asr-flash", // diese Zeile einkommentieren, die darüberliegende auskommentieren
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="fun-asr" \
# -F model="fun-asr-flash" \ # diese Zeile einkommentieren, die darüberliegende auskommentieren
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "fun-asr",
// Model: "fun-asr-flash", // diese Zeile einkommentieren, die darüberliegende auskommentieren
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("fun-asr")
// .model("fun-asr-flash") // diese Zeile einkommentieren, die darüberliegende auskommentieren
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());FAQ
Welches ist günstiger, Fun-ASR oder Fun-ASR Flash?
Sie listen dieselbe pro audiominute ($0.0021), daher ist der Preis hier nicht ausschlaggebend — siehe die Spezifikationen und Fähigkeiten unten.
Kann ich Fun-ASR gegen Fun-ASR Flash ohne zwei Integrationen A/B-testen?
Ja. Beide werden über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel bereitgestellt — der Wechsel ist eine einzeilige Änderung des Modell-Strings, sodass Sie einen Bruchteil des Traffics an jedes Modell leiten und die Rechnungen direkt vergleichen können.
Unterstützen Fun-ASR und Fun-ASR Flash Sprecherdiarisierung?
Die obige Fähigkeitentabelle beantwortet dies pro Modell, direkt aus der Dokumentation des jeweiligen Anbieters — Diarisierung, Streaming und Zeitstempel sind separat aufgeführt, da sich die Modelle bei allen dreien unterscheiden.