Fun-ASR Flash è la variante offline rapida della famiglia di riconoscimento vocale Fun-ASR di Alibaba, costruita per trascrivere registrazioni brevi fino a cinque minuti.
- Input
- audio
- Output
- testo
- Prezzo
- $0.0021/min
Il prezzo nel contesto
Posizione del prezzo tra 11 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Audio
| Lingue | Multilingue con dialetti, stesso elenco di 30 lingue delle versioni principali di Fun-ASR: cinese (mandarino, cantonese, wu, hokkien, hakka, gan, xiang, jin più accenti regionali), inglese, giapponese, coreano, vietnamita, thai, indonesiano, malese, filippino, hindi, arabo, francese, tedesco, spagnolo, portoghese, russo, italiano, olandese, svedese, danese, finlandese, norvegese, greco, polacco, ceco, ungherese, rumeno, bulgaro, croato, slovacco |
|---|---|
| Limiti audio |
|
| Diarizzazione | No |
| Trascrizione in streaming | Sì |
Modello
| Modalità | audio → testo |
|---|
Livello sincrono veloce della famiglia Fun-ASR.
Usa Fun-ASR Flash in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/audio/transcriptions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="fun-asr-flash",
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "fun-asr-flash",
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="fun-asr-flash" \
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "fun-asr-flash",
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("fun-asr-flash")
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());Informazioni su Fun-ASR Flash
- La sua caratteristica distintiva, secondo la documentazione ufficiale, è l'iniezione di contesto tramite prompt: invece di mantenere liste di hotword, si fornisce la terminologia di dominio direttamente in un prompt per guidare l'accuratezza del riconoscimento.
- È l'unico modello della famiglia documentato per questo e accetta fino a cinque round di contesto da qualche centinaio di caratteri ciascuno, il che si adatta a terminologia che cambia da chiamata a chiamata anziché da progetto a progetto.
- Mantiene l'ampia copertura linguistica della famiglia, che spazia dal cinese con i dialetti regionali all'inglese, al giapponese, al coreano e a molte lingue europee e del Sud-est asiatico.
- Il resto dello scambio rispetto al modello base è altrettanto concreto: le chiamate sono sincrone con risultati in streaming anziché a invio e interrogazione, quindi una clip breve torna inline invece che tramite un id di task, ma il tetto di cinque minuti sostituisce quello di dodici ore (il limite di 2 GB per file resta, quindi qui è la durata a vincolare), e la diarizzazione dei parlanti non è disponibile.
- Nel complesso la scelta all'interno della famiglia è netta: Fun-ASR per archivi lunghi e multi-parlante con vocabolario stabile, Fun-ASR Flash per clip brevi che richiedono una risposta rapida e terminologia per singola richiesta.
- Su Synthorai è disponibile tramite la consueta superficie API compatibile OpenAI.
FAQ
L'API di Fun-ASR Flash si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare Fun-ASR Flash sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.
In cosa eccelle Fun-ASR Flash?
Iniezione di contesto basata su prompt anziché hotword; trascrizione di registrazioni brevi fino a cinque minuti; ampia copertura inclusi i dialetti regionali cinesi. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa Fun-ASR Flash?
Su Synthorai, Fun-ASR Flash costa $0.0021 per minuto di audio trascritto: pagamento a consumo, senza ricarico della piattaforma, senza abbonamento.
Quali lingue supporta Fun-ASR Flash?
Fun-ASR Flash supporta Multilingue con dialetti, stesso elenco di 30 lingue delle versioni principali di Fun-ASR: cinese (mandarino, cantonese, wu, hokkien, hakka, gan, xiang, jin più accenti regionali), inglese, giapponese, coreano, vietnamita, thai, indonesiano, malese, filippino, hindi, arabo, francese, tedesco, spagnolo, portoghese, russo, italiano, olandese, svedese, danese, finlandese, norvegese, greco, polacco, ceco, ungherese, rumeno, bulgaro, croato, slovacco. Su Synthorai lo chiami via POST /v1/audio/transcriptions, lo stesso formato dell'API di trascrizione di OpenAI.
Come ottengo l'accesso a Fun-ASR Flash?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="fun-asr-flash" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.