Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Fun-ASR MTL

Rilasciato 2025-08

transcription

Fun-ASR MTL è il membro multilingue e multi-task della famiglia Fun-ASR di Alibaba per la trascrizione di file registrati.

Input
audio
Output
testo
Prezzo
$0.0021/min

Il prezzo nel contesto

Posizione del prezzo tra 11 modelli comparabili

Al minuto$0.0021/min
$0.002 · Fun-ASR Realtime Chirp 2 · $0.016

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Audio

Lingue Multilingue con dialetti: 30 lingue, con il cinese limitato a mandarino e cantonese (nessuna copertura più ampia di dialetti o accenti). Cinese (mandarino, cantonese), inglese, giapponese, coreano, vietnamita, thai, indonesiano, malese, filippino, hindi, arabo, francese, tedesco, spagnolo, portoghese, russo, italiano, olandese, svedese, danese, finlandese, norvegese, greco, polacco, ceco, ungherese, rumeno, bulgaro, croato, slovacco
Limiti audio
  • Trascrizione asincrona multilingue fino a 12h / 2GB
  • hotword + diarizzazione
  • timestamp di frase/parola (sempre attivi)
  • 30 lingue, cinese limitato a mandarino + cantonese
Diarizzazione
Trascrizione in streaming No
Timestamp

Modello

Modalità audio → testo
  • Livello multilingue e multi-task della famiglia Fun-ASR
  • l'attuale riferimento della API HTTP elenca le stesse 30 lingue del modello base, con il cinese limitato a mandarino e cantonese

fonte: documentazione ufficiale Alibaba ↗

Usa Fun-ASR MTL in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-mtl",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Informazioni su Fun-ASR MTL

  • Come il modello base elabora offline file audio fino a 12 ore e 2 GB, e la documentazione ufficiale elenca il supporto per la personalizzazione con hotword e per la diarizzazione dei parlanti, con un riconoscimento che spazia dal cinese (mandarino e cantonese) all'inglese, al giapponese, al coreano e a un'ampia gamma di lingue europee e del Sud-est asiatico.
  • Punta ai carichi di lavoro che mescolano lingue e richiedono l'identificazione dei parlanti dentro un'unica pipeline.
  • La sua storia ne spiega l'esistenza: al lancio della famiglia, lo snapshot Fun-ASR allora corrente copriva solo cinese e inglese, e MTL era la variante che vi aggiungeva sopra cantonese, giapponese, thailandese, vietnamita e indonesiano.
  • Da allora il modello base è stato aggiornato e il riferimento dell'API HTTP elenca ora lo stesso ampio insieme di lingue per entrambi, quindi i due sono convergiti.
  • Le pagine di Alibaba non tracciano più una linea esplicita di capacità tra loro.
  • Tutto il resto segue la famiglia: trascrizione asincrona a invio e interrogazione, tabelle di hotword per il vocabolario di dominio stabile, diarizzazione opzionale con un numero di parlanti dichiarato e timestamp a livello di frase e di parola in millisecondi.
  • Il riconoscimento delle emozioni non fa parte di questa linea e, come per il modello gemello, la documentazione nota che viene letta solo la prima voce di una lista di suggerimenti di lingua.
  • Il nome stabile del modello si risolve in uno snapshot datato, quindi conviene fissare lo snapshot se la copertura linguistica è importante.
  • Synthorai instrada le richieste verso di esso tramite il familiare endpoint compatibile OpenAI.

FAQ

L'API di Fun-ASR MTL si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare Fun-ASR MTL sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.

In cosa eccelle Fun-ASR MTL?

Carichi di lavoro multilingue con identificazione dei parlanti; elaborazione offline di file fino a 12 ore; copertura di lingue europee e del Sud-est asiatico. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa Fun-ASR MTL?

Su Synthorai, Fun-ASR MTL costa $0.0021 per minuto di audio trascritto: pagamento a consumo, senza ricarico della piattaforma, senza abbonamento.

Quali lingue supporta Fun-ASR MTL?

Fun-ASR MTL supporta Multilingue con dialetti: 30 lingue, con il cinese limitato a mandarino e cantonese (nessuna copertura più ampia di dialetti o accenti). Cinese (mandarino, cantonese), inglese, giapponese, coreano, vietnamita, thai, indonesiano, malese, filippino, hindi, arabo, francese, tedesco, spagnolo, portoghese, russo, italiano, olandese, svedese, danese, finlandese, norvegese, greco, polacco, ceco, ungherese, rumeno, bulgaro, croato, slovacco. Su Synthorai lo chiami via POST /v1/audio/transcriptions, lo stesso formato dell'API di trascrizione di OpenAI.

Come ottengo l'accesso a Fun-ASR MTL?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="fun-asr-mtl" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →