Fun-ASR Flash ist die schnelle Offline-Variante in Alibabas Fun-ASR-Spracherkennungsfamilie, gebaut für die Transkription kurzer Aufnahmen von bis zu fünf Minuten.
- Eingabe
- Audio
- Ausgabe
- Text
- Preis
- $0.0021/min
Preis im Vergleich
Preisposition unter 11 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Audio
| Sprachen | Mehrsprachig mit Dialekten, dieselbe Liste aus 30 Sprachen wie bei den Fun-ASR-Hauptversionen: Chinesisch (Mandarin, Kantonesisch, Wu, Hokkien, Hakka, Gan, Xiang, Jin sowie regionale Akzente), Englisch, Japanisch, Koreanisch, Vietnamesisch, Thailändisch, Indonesisch, Malaiisch, Filipino, Hindi, Arabisch, Französisch, Deutsch, Spanisch, Portugiesisch, Russisch, Italienisch, Niederländisch, Schwedisch, Dänisch, Finnisch, Norwegisch, Griechisch, Polnisch, Tschechisch, Ungarisch, Rumänisch, Bulgarisch, Kroatisch, Slowakisch |
|---|---|
| Audio-Limits |
|
| Sprecher-Diarisierung | Nein |
| Streaming-Transkription | Ja |
Modell
| Modalitäten | Audio → Text |
|---|
Schnelle synchrone Stufe der Fun-ASR-Familie.
Fun-ASR Flash in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/audio/transcriptions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="fun-asr-flash",
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "fun-asr-flash",
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="fun-asr-flash" \
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "fun-asr-flash",
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("fun-asr-flash")
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());Über Fun-ASR Flash
- Ihr unterscheidendes Merkmal ist laut offizieller Dokumentation die prompt-basierte Kontextinjektion: Statt Hotword-Listen zu pflegen, geben Sie Fachterminologie direkt in einem Prompt an, um die Erkennungsgenauigkeit zu steuern.
- Es ist das einzige Modell der Familie, für das dies dokumentiert ist, und akzeptiert bis zu fünf Kontextrunden mit jeweils einigen hundert Zeichen, was zu Terminologie passt, die sich pro Aufruf statt pro Projekt ändert.
- Es behält die breite Sprachabdeckung der Familie und umfasst Chinesisch mit regionalen Dialekten, Englisch, Japanisch, Koreanisch sowie viele europäische und südostasiatische Sprachen.
- Der Rest des Tauschs gegenüber dem Basismodell ist ebenso konkret: Aufrufe sind synchron mit gestreamten Ergebnissen statt nach dem Muster einreichen und abfragen, sodass ein kurzer Clip inline zurückkommt statt über eine Task-ID, doch die Obergrenze von fünf Minuten ersetzt die von zwölf Stunden (das Limit von 2 GB pro Datei bleibt, sodass hier die Dauer bindet), und Sprecher-Diarisierung ist nicht verfügbar.
- Zusammengelesen ist die Wahl innerhalb der Familie klar: Fun-ASR für lange Archive mit mehreren Sprechern und stabilem Vokabular, Fun-ASR Flash für kurze Clips, die eine schnelle Antwort und Terminologie pro Anfrage brauchen.
- Auf Synthorai ist es über die standardmäßige OpenAI-kompatible API-Oberfläche verfügbar.
FAQ
Lässt sich die Fun-ASR Flash API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Das reicht, um Fun-ASR Flash mit Ihrem realen Workload auszuprobieren, bevor Sie eine Zahlungsmethode hinterlegen.
Worin ist Fun-ASR Flash am besten?
Prompt-basierte Kontext-Injektion statt Hotwords; transkribiert kurze Aufnahmen von bis zu fünf Minuten; breite Abdeckung inklusive chinesischer regionaler Dialekte. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet Fun-ASR Flash?
Fun-ASR Flash kostet auf Synthorai $0.0021 pro transkribierter Audiominute. Nutzungsbasierte Abrechnung, ohne Plattform-Aufschlag, ohne Abo.
Welche Sprachen unterstützt Fun-ASR Flash?
Fun-ASR Flash unterstützt Mehrsprachig mit Dialekten, dieselbe Liste aus 30 Sprachen wie bei den Fun-ASR-Hauptversionen: Chinesisch (Mandarin, Kantonesisch, Wu, Hokkien, Hakka, Gan, Xiang, Jin sowie regionale Akzente), Englisch, Japanisch, Koreanisch, Vietnamesisch, Thailändisch, Indonesisch, Malaiisch, Filipino, Hindi, Arabisch, Französisch, Deutsch, Spanisch, Portugiesisch, Russisch, Italienisch, Niederländisch, Schwedisch, Dänisch, Finnisch, Norwegisch, Griechisch, Polnisch, Tschechisch, Ungarisch, Rumänisch, Bulgarisch, Kroatisch, Slowakisch. Auf Synthorai rufen Sie das Modell über POST /v1/audio/transcriptions auf, das OpenAI-Transkriptions-API-Format.
Wie erhalte ich Zugang zu Fun-ASR Flash?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="fun-asr-flash", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.