🎁 신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

Fun-ASR Flash vs Seed ASR

vs

언제 어떤 모델을 사용할까 — 벤치마크 표가 아닌 선별된 평가

분당 요금 차이는 반올림 오차 수준이라($0.0021 대 $0.002) 선택은 전적으로 기능에 달렸습니다. seed-asr-bigmodel은 오디오 파일 API에서 화자 분리를 하고(문서상 10명 이하가 최적), 문장·단어 타임스탬프를 반환하며 파일당 최대 5시간을 받습니다. fun-asr-flash는 동기만 지원하고 5분·2GB가 상한이며 분리는 없지만 도메인 용어 컨텍스트 주입이 있습니다. 짧은 클립을 빠르게 받으려면 fun-asr-flash, 길거나 다중 화자면 seed-asr-bigmodel입니다.

가격

Fun-ASR Flash Seed ASR Δ
오디오 분당 $0.0021 $0.002

빌드 시점의 라이브 카탈로그 요금입니다. 각 모델 페이지에 현재 요금표가 표시됩니다.

현재 위치 — 이 청구 단위를 사용하는 모든 11개의 음성 텍스트 변환 모델 전체의 오디오 분당 가격 (로그 스케일)

Fun-ASR Flash · $0.0021 Seed ASR · $0.002
$0.002 · Fun-ASR Realtime $0.016 · Chirp 2

기능

Fun-ASR Flash Seed ASR
화자 분리 아니요
스트리밍
타임스탬프

사양

Fun-ASR Flash Seed ASR
입력 모달리티 오디오 오디오
출력 모달리티 텍스트 텍스트
출시일 2026-06
제한

Synchronous fast recognition, <=5 min / <=2GB per audio

context injection for domain terms

30+ languages

no diarization

Async audio-file mode: <512MB, <5 hours, OPUS/WAV/MP3/SPX/OGG/AMR/AAC/M4A (raw PCM also accepted), results returned within 3 hours and retained 7 days

speaker diarization via enable_speaker_info (audio-file API only, best with <=10 speakers, no diarization on the streaming API)

sentence + word segmentation with start_time/end_time via show_utterances

language identification via enable_lid

hotwords/context up to 800 tokens and 20 rounds

per-call billing

언어 Multilingual with dialects, the same 30-language list as the Fun-ASR main versions: Chinese (Mandarin, Cantonese, Wu, Hokkien, Hakka, Gan, Xiang, Jin plus regional accents), English, Japanese, Korean, Vietnamese, Thai, Indonesian, Malay, Filipino, Hindi, Arabic, French, German, Spanish, Portuguese, Russian, Italian, Dutch, Swedish, Danish, Finnish, Norwegian, Greek, Polish, Czech, Hungarian, Romanian, Bulgarian, Croatian, Slovak

With `language` empty the model covers Mandarin, English, Cantonese, Shanghainese, Minnan, Sichuan and Shaanxi dialects

39 language keys can be pinned explicitly (en-US, zh-CN, yue-CN, ja-JP, ko-KR, id-ID, es-MX, pt-BR, de-DE, fr-FR, fil-PH, ms-MY, th-TH, ar-SA, it-IT, bn-BD, el-GR, nl-NL, ru-RU, tr-TR, vi-VN, pl-PL, ro-RO, uk-UA, az-AZ, bg-BG, cs-CZ, da-DK, fi-FI, hi-IN, hu-HU, kk-KZ, km-KH, my-MM, no-NO, pa-PK, sv-SE, sw-KE, ur-PK), plus optional auto-detection (enable_auto_lang)

사양은 각 공급업체의 문서를 그대로 기록한 것입니다. 공급업체가 공개하지 않은 항목은 추론하지 않고 제외했습니다. 전체 출처: Fun-ASR Flash · Seed ASR

코드 한 줄로 모델 전환

두 id는 아래의 모든 탭에 있습니다 — 강조 표시된 두 줄이 유일한 수정 사항입니다. 동일한 엔드포인트, 동일한 키, 동일한 요청 형태입니다.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    # model="seed-asr-bigmodel",  # 이 줄의 주석을 해제하고, 윗줄을 주석 처리하세요
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

API 키 발급받기 →

FAQ

Fun-ASR Flash와(과) Seed ASR 중 어느 것이 더 저렴한가요?

오디오 분당 항목에서는 Seed ASR이(가) 더 저렴합니다($0.002 대 $0.0021, 1.0× 차이). 다른 항목에서는 결과가 다를 수 있습니다 — 위의 표에 전체 정보가 있으며, 실제 비용은 사용 조합에 따라 달라집니다.

두 번의 연동 과정 없이 Fun-ASR Flash와(과) Seed ASR를 A/B 테스트할 수 있나요?

네. 둘 다 하나의 API 키를 사용하여 동일한 OpenAI 호환 엔드포인트를 통해 제공됩니다 — 모델 문자열을 한 줄만 변경하면 전환되므로, 트래픽의 일부를 각각 라우팅하여 요금을 직접 비교할 수 있습니다.

Fun-ASR Flash와(과) Seed ASR가 화자 분리를 지원하나요?

위의 기능 표는 각 공급업체의 문서에서 직접 가져와 모델별로 이에 대한 답변을 제공합니다 — 화자 분리, 스트리밍 및 타임스탬프는 모델마다 지원 여부가 다르므로 별도로 나열되어 있습니다.

관련 비교

측정 연구 결과