Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Fun-ASR Flash

Rilasciato 2026-06

transcription

Fun-ASR Flash è la variante offline rapida della famiglia di riconoscimento vocale Fun-ASR di Alibaba, costruita per trascrivere registrazioni brevi fino a cinque minuti.

Input
audio
Output
testo
Prezzo
$0.0021/min

Il prezzo nel contesto

Posizione del prezzo tra 11 modelli comparabili

Al minuto$0.0021/min
$0.002 · Fun-ASR Realtime Chirp 2 · $0.016

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Audio

Lingue Multilingue con dialetti, stesso elenco di 30 lingue delle versioni principali di Fun-ASR: cinese (mandarino, cantonese, wu, hokkien, hakka, gan, xiang, jin più accenti regionali), inglese, giapponese, coreano, vietnamita, thai, indonesiano, malese, filippino, hindi, arabo, francese, tedesco, spagnolo, portoghese, russo, italiano, olandese, svedese, danese, finlandese, norvegese, greco, polacco, ceco, ungherese, rumeno, bulgaro, croato, slovacco
Limiti audio
  • Riconoscimento sincrono veloce, <=5 min / <=2GB per audio
  • iniezione di contesto per la terminologia di dominio
  • oltre 30 lingue
  • nessuna diarizzazione
Diarizzazione No
Trascrizione in streaming

Modello

Modalità audio → testo

Livello sincrono veloce della famiglia Fun-ASR.

fonte: documentazione ufficiale Alibaba ↗

Usa Fun-ASR Flash in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Informazioni su Fun-ASR Flash

  • La sua caratteristica distintiva, secondo la documentazione ufficiale, è l'iniezione di contesto tramite prompt: invece di mantenere liste di hotword, si fornisce la terminologia di dominio direttamente in un prompt per guidare l'accuratezza del riconoscimento.
  • È l'unico modello della famiglia documentato per questo e accetta fino a cinque round di contesto da qualche centinaio di caratteri ciascuno, il che si adatta a terminologia che cambia da chiamata a chiamata anziché da progetto a progetto.
  • Mantiene l'ampia copertura linguistica della famiglia, che spazia dal cinese con i dialetti regionali all'inglese, al giapponese, al coreano e a molte lingue europee e del Sud-est asiatico.
  • Il resto dello scambio rispetto al modello base è altrettanto concreto: le chiamate sono sincrone con risultati in streaming anziché a invio e interrogazione, quindi una clip breve torna inline invece che tramite un id di task, ma il tetto di cinque minuti sostituisce quello di dodici ore (il limite di 2 GB per file resta, quindi qui è la durata a vincolare), e la diarizzazione dei parlanti non è disponibile.
  • Nel complesso la scelta all'interno della famiglia è netta: Fun-ASR per archivi lunghi e multi-parlante con vocabolario stabile, Fun-ASR Flash per clip brevi che richiedono una risposta rapida e terminologia per singola richiesta.
  • Su Synthorai è disponibile tramite la consueta superficie API compatibile OpenAI.

FAQ

L'API di Fun-ASR Flash si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare Fun-ASR Flash sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.

In cosa eccelle Fun-ASR Flash?

Iniezione di contesto basata su prompt anziché hotword; trascrizione di registrazioni brevi fino a cinque minuti; ampia copertura inclusi i dialetti regionali cinesi. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa Fun-ASR Flash?

Su Synthorai, Fun-ASR Flash costa $0.0021 per minuto di audio trascritto: pagamento a consumo, senza ricarico della piattaforma, senza abbonamento.

Quali lingue supporta Fun-ASR Flash?

Fun-ASR Flash supporta Multilingue con dialetti, stesso elenco di 30 lingue delle versioni principali di Fun-ASR: cinese (mandarino, cantonese, wu, hokkien, hakka, gan, xiang, jin più accenti regionali), inglese, giapponese, coreano, vietnamita, thai, indonesiano, malese, filippino, hindi, arabo, francese, tedesco, spagnolo, portoghese, russo, italiano, olandese, svedese, danese, finlandese, norvegese, greco, polacco, ceco, ungherese, rumeno, bulgaro, croato, slovacco. Su Synthorai lo chiami via POST /v1/audio/transcriptions, lo stesso formato dell'API di trascrizione di OpenAI.

Come ottengo l'accesso a Fun-ASR Flash?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="fun-asr-flash" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →