신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

Fun-ASR Flash

2026-06 출시

transcription

Fun-ASR Flash는 Alibaba Fun-ASR 음성 인식 패밀리의 빠른 오프라인 변형으로, 최대 5분 길이의 짧은 녹음 전사를 위해 만들어졌습니다.

입력
오디오
출력
텍스트
가격
$0.0021/min

가격의 위치

동종 11개 모델 중 가격 위치

분당$0.0021/min
$0.002 · Fun-ASR Realtime Chirp 2 · $0.016

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

오디오

언어 방언을 포함한 다국어, Fun-ASR 메인 버전과 동일한 30개 언어 목록: 중국어(표준어, 광둥어, 우어, 민난어, 하카어, 간어, 샹어, 진어 및 지역 억양), 영어, 일본어, 한국어, 베트남어, 태국어, 인도네시아어, 말레이어, 필리핀어, 힌디어, 아랍어, 프랑스어, 독일어, 스페인어, 포르투갈어, 러시아어, 이탈리아어, 네덜란드어, 스웨덴어, 덴마크어, 핀란드어, 노르웨이어, 그리스어, 폴란드어, 체코어, 헝가리어, 루마니아어, 불가리아어, 크로아티아어, 슬로바키아어
오디오 제한
  • 동기 고속 인식, 오디오당 5분 이하 / 2GB 이하
  • 도메인 용어를 위한 컨텍스트 주입
  • 30개 이상 언어
  • 화자 분리 없음
화자 분리 미지원
스트리밍 전사 지원

모델

모달리티 오디오 → 텍스트

Fun-ASR 패밀리의 빠른 동기 티어.

출처: Alibaba 공식 문서 ↗

30초 만에 Fun-ASR Flash 사용하기

OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="fun-asr-flash",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Fun-ASR Flash 소개

  • 공식 문서 기준으로 이 모델의 차별점은 프롬프트 기반 컨텍스트 주입입니다.
  • 핫워드 목록을 관리하는 대신 도메인 용어를 프롬프트에 직접 넣어 인식 정확도를 유도합니다.
  • 패밀리 중 이 방식이 문서화된 유일한 모델이며, 각각 수백 자 규모의 컨텍스트를 최대 5회까지 받아들여 프로젝트 단위가 아니라 호출 단위로 바뀌는 용어에 적합합니다.
  • 중국어와 지역 방언, 영어, 일본어, 한국어, 다수의 유럽 및 동남아시아 언어에 이르는 패밀리의 폭넓은 언어 커버리지는 그대로 유지합니다.
  • 기본 모델과의 나머지 트레이드오프도 마찬가지로 구체적입니다.
  • 호출은 제출 후 폴링이 아니라 스트리밍 결과를 동반한 동기 방식이라 짧은 클립이 작업 id를 거치지 않고 인라인으로 반환되지만, 12시간 상한이 5분 상한으로 바뀌고(2 GB 파일 제한은 그대로이므로 여기서 실제 제약이 되는 것은 길이입니다), 화자 분리는 제공되지 않습니다.
  • 함께 놓고 보면 패밀리 안에서의 선택은 명확합니다.
  • 어휘가 안정적인 길고 다중 화자인 아카이브에는 Fun-ASR을, 빠른 응답과 요청별 용어가 필요한 짧은 클립에는 Fun-ASR Flash를 쓰면 됩니다.
  • Synthorai에서는 표준 OpenAI 호환 API 인터페이스로 이용할 수 있습니다.

자주 묻는 질문

Fun-ASR Flash API는 무료로 사용해 볼 수 있나요?

네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 결제 수단을 추가하기 전에 실제 워크로드로 Fun-ASR Flash를 충분히 시험해 볼 수 있는 양입니다.

Fun-ASR Flash는 무엇에 가장 강한가요?

핫워드 대신 프롬프트 기반 컨텍스트 주입, 최대 5분 짧은 녹음 전사, 중국어 지역 방언 포함 폭넓은 커버리지. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

Fun-ASR Flash의 가격은 얼마인가요?

Synthorai에서 Fun-ASR Flash는 전사한 오디오 1분당 $0.0021로 과금됩니다. 종량제, 플랫폼 마진 없음, 구독 불필요.

Fun-ASR Flash는 어떤 언어를 지원하나요?

Fun-ASR Flash는 방언을 포함한 다국어, Fun-ASR 메인 버전과 동일한 30개 언어 목록: 중국어(표준어, 광둥어, 우어, 민난어, 하카어, 간어, 샹어, 진어 및 지역 억양), 영어, 일본어, 한국어, 베트남어, 태국어, 인도네시아어, 말레이어, 필리핀어, 힌디어, 아랍어, 프랑스어, 독일어, 스페인어, 포르투갈어, 러시아어, 이탈리아어, 네덜란드어, 스웨덴어, 덴마크어, 핀란드어, 노르웨이어, 그리스어, 폴란드어, 체코어, 헝가리어, 루마니아어, 불가리아어, 크로아티아어, 슬로바키아어를 지원합니다. Synthorai에서는 POST /v1/audio/transcriptions로 호출합니다. OpenAI 전사 API 형태 그대로입니다.

Fun-ASR Flash는 어떻게 이용하나요?

기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="fun-asr-flash"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →