Neu Kostenlos registrieren und 10 Aufrufe gratis nutzen. Bis zu 1 $, ohne Kreditkarte.

Fun-ASR vs Fun-ASR Flash

vs

Welches Modell wofür

Gleiche $0.0021 pro Audiominute, wählen Sie also nach Form statt nach Preis: fun-asr ist das asynchrone Dateimodell - bis zu 12 Stunden und 2GB, mit Sprechertrennung, Hotwords und Zeitstempeln auf Satz- und Wortebene - während fun-asr-flash synchron antwortet, gedeckelt bei 5 Minuten und 2GB, mit Streaming und Kontextinjektion für Fachbegriffe, aber ohne Trennung und ohne Zeitstempel. Die Liste von 30 Sprachen ist auf beiden gleich. Nehmen Sie fun-asr für Aufnahmen, fun-asr-flash für kurze Clips, die in der Anfrage beantwortet werden.

Preise

Fun-ASR Fun-ASR Flash Δ
Pro Audiominute $0.0021 $0.0021 =

Preise aus dem Live-Katalog, Stand des letzten Builds. Die aktuellen Preise stehen auf der jeweiligen Modellseite.

Einordnung: Preis pro Audiominute aller 12 Speech-to-Text-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

Fun-ASR · $0.0021 Fun-ASR Flash · $0.0021

Fähigkeiten

Fun-ASR Fun-ASR Flash
Sprecherdiarisierung ja nein
Streaming nein ja
Zeitstempel ja -

Spezifikationen

Fun-ASR Fun-ASR Flash
Eingabemodalitäten Audio Audio
Ausgabemodalitäten Text Text
Veröffentlicht 2025-08-22 2026-06
Limits

Async file transcription up to 12h / 2GB

hotwords + speaker diarization

sentence/word timestamps

30+ languages incl. Chinese dialects

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

Sprachen Multilingual with dialects, 30 languages: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

Die Spezifikationen stammen aus der Dokumentation des jeweiligen Anbieters. Veröffentlicht ein Anbieter eine Angabe nicht, lassen wir die Zeile weg, statt sie zu schätzen. Vollständige Quellen: Fun-ASR · Fun-ASR Flash

Eine Zeile genügt für den Wechsel

Beide IDs stehen in jedem Tab unten. Die beiden hervorgehobenen Zeilen sind die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiches Anfrageformat.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr",
    # model="fun-asr-flash",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

API-Schlüssel erstellen →

FAQ

Welches Modell ist günstiger: Fun-ASR oder Fun-ASR Flash?

Bei Pro Audiominute kosten beide gleich viel ($0.0021). Der Preis entscheidet hier also nichts; ausschlaggebend sind die Spezifikationen und Fähigkeiten weiter unten.

Kann ich Fun-ASR gegen Fun-ASR Flash A/B-testen, ohne zweimal zu integrieren?

Ja. Beide laufen über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel. Für den Wechsel ändern Sie nur eine Zeile, den Modellnamen. So können Sie einen Teil des Traffics an jedes Modell schicken und die Kosten direkt vergleichen.

Unterstützen Fun-ASR und Fun-ASR Flash Sprecherdiarisierung?

Das beantwortet die Tabelle der Fähigkeiten oben für jedes Modell einzeln, direkt aus der Dokumentation des jeweiligen Anbieters. Diarisierung, Streaming und Zeitstempel stehen dort getrennt, weil sich die Modelle in allen drei Punkten unterscheiden.

Verwandte Vergleiche

Aus unseren Studien mit eigenen Messungen