Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Fun-ASR Flash vs Seed ASR

vs

Lequel choisir, et quand

Les tarifs à la minute ne diffèrent que d'un arrondi ($0.0021 contre $0.002), ce qui met le choix entièrement sur les capacités : seed-asr-bigmodel diarise sur son API de fichiers audio (documentée comme optimale à 10 locuteurs ou moins), renvoie des horodatages à la phrase et au mot et accepte jusqu'à 5 heures par fichier, tandis que fun-asr-flash est synchrone seulement, plafonné à 5 minutes et 2GB, sans diarisation mais avec injection de termes métier en contexte. Prenez fun-asr-flash pour un retour rapide sur clips courts, seed-asr-bigmodel pour tout ce qui est long ou multi-locuteurs.

Tarifs

Fun-ASR Flash Seed ASR Δ
Par minute d'audio $0.0021 $0.002 1×

Tarifs relevés dans le catalogue en direct à la génération du site ; la page de chaque modèle affiche la grille tarifaire à jour.

Leur position : prix par minute d'audio, parmi les 12 modèles de transcription vocale facturés dans cette unité (échelle logarithmique)

Fun-ASR Flash · $0.0021 Seed ASR · $0.002

Capacités

Fun-ASR Flash Seed ASR
Diarisation des locuteurs non oui
Streaming oui oui
Horodatages - oui

Spécifications

Fun-ASR Flash Seed ASR
Modalités d'entrée audio audio
Modalités de sortie texte texte
Date de sortie 2026-06 2025-12-05
Limites

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

Async audio-file mode: <512MB, <5 hours, OPUS/WAV/MP3/SPX/OGG/AMR/AAC/M4A (raw PCM also accepted), results returned within 3 hours and retained 7 days

speaker diarization via enable_speaker_info (audio-file API only, best with <=10 speakers, no diarization on the streaming API)

sentence + word segmentation with start_time/end_time via show_utterances

language identification via enable_lid

hotwords/context up to 800 tokens and 20 rounds

per-call billing

Langues Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

With `language` empty the model covers Mandarin, English, Cantonese, Shanghainese, Minnan, Sichuan and Shaanxi dialects

39 language keys can be pinned explicitly (en-US, zh-CN, yue-CN, ja-JP, ko-KR, id-ID, es-MX, pt-BR, de-DE, fr-FR, fil-PH, ms-MY, th-TH, ar-SA, it-IT, bn-BD, el-GR, nl-NL, ru-RU, tr-TR, vi-VN, pl-PL, ro-RO, uk-UA, az-AZ, bg-BG, cs-CZ, da-DK, fi-FI, hi-IN, hu-HU, kk-KZ, km-KH, my-MM, no-NO, pa-PK, sv-SE, sw-KE, ur-PK), plus optional auto-detection (enable_auto_lang)

Les spécifications sont reprises de la documentation de chaque fournisseur ; quand un fournisseur ne publie pas une valeur, la ligne est omise et non déduite. Sources complètes : Fun-ASR Flash · Seed ASR

Passez de l'un à l'autre en changeant une seule ligne

Les deux identifiants figurent dans chaque onglet ci-dessous : les deux lignes surlignées sont le seul changement. Même endpoint, même clé, même format de requête.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    # model="seed-asr-bigmodel",  # décommentez cette ligne, commentez celle du dessus
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Obtenez votre clé API →

FAQ

Lequel est le moins cher, Fun-ASR Flash ou Seed ASR ?

Seed ASR est moins cher sur la ligne « Par minute d'audio » ($0.002 contre $0.0021, soit un écart de 1.0×). D'autres lignes peuvent dire l'inverse : le tableau ci-dessus donne la grille tarifaire complète, et le coût réel dépend de la composition de votre trafic.

Puis-je faire un test A/B entre Fun-ASR Flash et Seed ASR sans deux intégrations ?

Oui. Les deux passent par le même endpoint compatible OpenAI, avec une seule clé API. Pour passer de l'un à l'autre, il suffit de changer l'identifiant du modèle, soit une ligne : vous pouvez donc envoyer une part du trafic à chacun et comparer directement les factures.

Fun-ASR Flash et Seed ASR prennent-ils en charge la diarisation des locuteurs ?

Le tableau des capacités ci-dessus répond modèle par modèle, d'après la documentation de chaque fournisseur. La diarisation, le streaming et les horodatages y figurent séparément, car les modèles diffèrent sur ces trois points.

Comparatifs associés

Nos études, mesures à l'appui