🎁 Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Fun-ASR vs Fun-ASR Flash

vs

Qual usar, quando — veredito curado, não uma tabela de benchmark

Os mesmos $0.0021 por minuto de áudio, então escolha pela forma e não pelo preço: o fun-asr é o modelo assíncrono de arquivos — até 12 horas e 2GB, com diarização, hotwords e carimbos de tempo por frase e palavra — enquanto o fun-asr-flash responde de forma síncrona, limitado a 5 minutos e 2GB, com streaming e injeção de termos de domínio no contexto, mas sem diarização nem carimbos de tempo. A lista de 30 idiomas é a mesma. Escolha o fun-asr para gravações, o fun-asr-flash para clipes curtos respondidos na requisição.

Preços

Fun-ASR Fun-ASR Flash Δ
Por minuto de áudio $0.0021 $0.0021 =

Tarifas do catálogo em tempo real no momento do build; a página de cada modelo contém o cartão atual.

Onde eles se posicionam — preço por minuto de áudio entre todos os 11 modelos de fala para texto nesta unidade de cobrança (escala logarítmica)

Fun-ASR · $0.0021 Fun-ASR Flash · $0.0021
$0.002 · Fun-ASR Realtime $0.016 · Chirp 2

Capacidades

Fun-ASR Fun-ASR Flash
Diarização de locutor sim não
Streaming não sim
Timestamps sim

Especificações

Fun-ASR Fun-ASR Flash
Modalidades de entrada áudio áudio
Modalidades de saída texto texto
Lançamento 2025-08-22 2026-06
Limites

Async file transcription up to 12h / 2GB

hotwords + speaker diarization

sentence/word timestamps

30+ languages incl. Chinese dialects

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

Idiomas Multilingual with dialects, 30 languages: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

As especificações são transcritas da documentação de cada fornecedor; uma linha que um fornecedor não publica é omitida em vez de ser inferida. Fontes completas: Fun-ASR · Fun-ASR Flash

Alterne entre eles com uma linha

Ambos os IDs estão em todas as abas abaixo — o par de linhas destacado é a única edição. Mesmo endpoint, mesma chave, mesmo formato de requisição.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr",
    # model="fun-asr-flash",  # descomente esta linha, comente a linha acima
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Obter uma chave de API →

FAQ

Qual é mais barato, Fun-ASR ou Fun-ASR Flash?

Eles listam a mesma por minuto de áudio ($0.0021), então o preço não decide este caso — veja as especificações e capacidades abaixo.

Posso fazer um teste A/B de Fun-ASR contra Fun-ASR Flash sem duas integrações?

Sim. Ambos são servidos pelo mesmo endpoint compatível com OpenAI com uma única chave de API — a troca é uma alteração de uma linha na string do modelo, de modo que você pode rotear uma fração do tráfego para cada um e comparar as faturas diretamente.

Fun-ASR e Fun-ASR Flash suportam diarização de locutor?

A tabela de capacidades acima responde a isso por modelo, direto da documentação de cada fornecedor — diarização, streaming e timestamps são listados separadamente porque os modelos diferem nos três.

Comparações relacionadas

De nossos estudos medidos