Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Fun-ASR Flash

Veröffentlicht 2026-06

transcription

Fun-ASR Flash ist die schnelle Offline-Variante in Alibabas Fun-ASR-Spracherkennungsfamilie, gebaut für die Transkription kurzer Aufnahmen von bis zu fünf Minuten.

Eingabe
Audio
Ausgabe
Text
Preis
$0.0021/min

Preis im Vergleich

Preisposition unter 11 vergleichbaren Modellen

Pro Minute$0.0021/min
$0.002 · Fun-ASR Realtime Chirp 2 · $0.016

Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.

Spezifikationen & Limits

Audio

Sprachen Mehrsprachig mit Dialekten, dieselbe Liste aus 30 Sprachen wie bei den Fun-ASR-Hauptversionen: Chinesisch (Mandarin, Kantonesisch, Wu, Hokkien, Hakka, Gan, Xiang, Jin sowie regionale Akzente), Englisch, Japanisch, Koreanisch, Vietnamesisch, Thailändisch, Indonesisch, Malaiisch, Filipino, Hindi, Arabisch, Französisch, Deutsch, Spanisch, Portugiesisch, Russisch, Italienisch, Niederländisch, Schwedisch, Dänisch, Finnisch, Norwegisch, Griechisch, Polnisch, Tschechisch, Ungarisch, Rumänisch, Bulgarisch, Kroatisch, Slowakisch
Audio-Limits
  • Synchrone Schnellerkennung, <=5 Min. / <=2GB pro Audio
  • Kontext-Injektion für Fachbegriffe
  • 30+ Sprachen
  • keine Diarisierung
Sprecher-Diarisierung Nein
Streaming-Transkription Ja

Modell

Modalitäten Audio → Text

Schnelle synchrone Stufe der Fun-ASR-Familie.

laut Offizielle Alibaba-Dokumentation ↗

Fun-ASR Flash in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Über Fun-ASR Flash

  • Ihr unterscheidendes Merkmal ist laut offizieller Dokumentation die prompt-basierte Kontextinjektion: Statt Hotword-Listen zu pflegen, geben Sie Fachterminologie direkt in einem Prompt an, um die Erkennungsgenauigkeit zu steuern.
  • Es ist das einzige Modell der Familie, für das dies dokumentiert ist, und akzeptiert bis zu fünf Kontextrunden mit jeweils einigen hundert Zeichen, was zu Terminologie passt, die sich pro Aufruf statt pro Projekt ändert.
  • Es behält die breite Sprachabdeckung der Familie und umfasst Chinesisch mit regionalen Dialekten, Englisch, Japanisch, Koreanisch sowie viele europäische und südostasiatische Sprachen.
  • Der Rest des Tauschs gegenüber dem Basismodell ist ebenso konkret: Aufrufe sind synchron mit gestreamten Ergebnissen statt nach dem Muster einreichen und abfragen, sodass ein kurzer Clip inline zurückkommt statt über eine Task-ID, doch die Obergrenze von fünf Minuten ersetzt die von zwölf Stunden (das Limit von 2 GB pro Datei bleibt, sodass hier die Dauer bindet), und Sprecher-Diarisierung ist nicht verfügbar.
  • Zusammengelesen ist die Wahl innerhalb der Familie klar: Fun-ASR für lange Archive mit mehreren Sprechern und stabilem Vokabular, Fun-ASR Flash für kurze Clips, die eine schnelle Antwort und Terminologie pro Anfrage brauchen.
  • Auf Synthorai ist es über die standardmäßige OpenAI-kompatible API-Oberfläche verfügbar.

FAQ

Lässt sich die Fun-ASR Flash API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Das reicht, um Fun-ASR Flash mit Ihrem realen Workload auszuprobieren, bevor Sie eine Zahlungsmethode hinterlegen.

Worin ist Fun-ASR Flash am besten?

Prompt-basierte Kontext-Injektion statt Hotwords; transkribiert kurze Aufnahmen von bis zu fünf Minuten; breite Abdeckung inklusive chinesischer regionaler Dialekte. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet Fun-ASR Flash?

Fun-ASR Flash kostet auf Synthorai $0.0021 pro transkribierter Audiominute. Nutzungsbasierte Abrechnung, ohne Plattform-Aufschlag, ohne Abo.

Welche Sprachen unterstützt Fun-ASR Flash?

Fun-ASR Flash unterstützt Mehrsprachig mit Dialekten, dieselbe Liste aus 30 Sprachen wie bei den Fun-ASR-Hauptversionen: Chinesisch (Mandarin, Kantonesisch, Wu, Hokkien, Hakka, Gan, Xiang, Jin sowie regionale Akzente), Englisch, Japanisch, Koreanisch, Vietnamesisch, Thailändisch, Indonesisch, Malaiisch, Filipino, Hindi, Arabisch, Französisch, Deutsch, Spanisch, Portugiesisch, Russisch, Italienisch, Niederländisch, Schwedisch, Dänisch, Finnisch, Norwegisch, Griechisch, Polnisch, Tschechisch, Ungarisch, Rumänisch, Bulgarisch, Kroatisch, Slowakisch. Auf Synthorai rufen Sie das Modell über POST /v1/audio/transcriptions auf, das OpenAI-Transkriptions-API-Format.

Wie erhalte ich Zugang zu Fun-ASR Flash?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="fun-asr-flash", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Verwandte Modelle

Vergleichen

Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.

API-Schlüssel abrufen Ihre Kosten vergleichen →