GPT-4o Mini Transcribe vs GPT-4o Transcribe
언제 어떤 모델을 쓸까
mini 단은 청구서를 대략 절반으로 줄입니다 - 텍스트 입력 100만당 $1.25, 출력 $5, 오디오 입력 100만당 $3이 $2.5, $10, $6 대비 - 반면 25MB 파일 상한, 57개 언어 목록, 16000토큰 컨텍스트, json/text만 내는 출력, 그리고 양쪽 모두 없는 타임스탬프와 화자 분리는 동일합니다. 공개된 사양에 다른 차이는 없으므로, 자신의 오디오로 차이를 측정하지 않았다면 gpt-4o-mini-transcribe를 고르세요.
벤치마크
GPT-4o Mini Transcribe: 33개가 공개됐지만, 비교할 수 있을 만큼 여러 모델이 함께 측정한 벤치마크가 없습니다.
공급자 공개 자료: Alibaba (Qwen) ByteDance Google OpenAI
가격
| GPT-4o Mini Transcribe | GPT-4o Transcribe | Δ | |
|---|---|---|---|
| 오디오 입력 / 1M 토큰 | $3 | $6 | 0.5× |
| 텍스트 출력 / 1M 토큰 | $5 | $10 | 0.5× |
빌드 시점에 실시간 카탈로그에서 가져온 요금입니다. 현재 요금은 각 모델 페이지에서 확인할 수 있습니다.
기능
| GPT-4o Mini Transcribe | GPT-4o Transcribe | |
|---|---|---|
| 화자 분리 | 미지원 | 미지원 |
| 스트리밍 | 지원 | 지원 |
| 타임스탬프 | 미지원 | 미지원 |
사양
| GPT-4o Mini Transcribe | GPT-4o Transcribe | |
|---|---|---|
| 입력 모달리티 | 텍스트 오디오 | 텍스트 오디오 |
| 출력 모달리티 | 텍스트 | 텍스트 |
| 출시일 | 2025-03-20 | 2025-03-20 |
| 지식 컷오프 | 2024-06 | 2024-06 |
| 제한 | mp3/mp4/mpeg/mpga/m4a/wav/webm, up to 25MB streaming transcription supported json/text output only no word timestamps or diarization | mp3/mp4/mpeg/mpga/m4a/wav/webm, up to 25MB streaming transcription supported (incl. Realtime transcription sessions) json/text output only no word timestamps or diarization |
| 언어 | 57 languages listed for the transcriptions endpoint (one shared list for all transcription models) ISO 639-1 / 639-3 codes accepted for GPT-4o-based models | 57 languages listed for the transcriptions endpoint (one shared list for all transcription models) ISO 639-1 / 639-3 codes accepted for GPT-4o-based models |
| 최대 출력 | 2K | 2K |
사양은 각 공급자의 문서에서 그대로 옮겨 적었습니다. 공급자가 공개하지 않은 항목은 추정해 채우지 않고 뺐습니다. 전체 출처: GPT-4o Mini Transcribe · GPT-4o Transcribe
코드 한 줄로 모델 전환
아래 탭마다 두 모델 id가 모두 들어 있습니다. 바꿀 곳은 강조된 두 줄뿐이고, 엔드포인트, 키, 요청 형식은 그대로입니다.
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="gpt-4o-mini-transcribe",
# model="gpt-4o-transcribe", # 이 줄의 주석을 해제하고, 윗줄을 주석 처리하세요
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "gpt-4o-mini-transcribe",
// model: "gpt-4o-transcribe", // 이 줄의 주석을 해제하고, 윗줄을 주석 처리하세요
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="gpt-4o-mini-transcribe" \
# -F model="gpt-4o-transcribe" \ # 이 줄의 주석을 해제하고, 윗줄을 주석 처리하세요
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "gpt-4o-mini-transcribe",
// Model: "gpt-4o-transcribe", // 이 줄의 주석을 해제하고, 윗줄을 주석 처리하세요
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("gpt-4o-mini-transcribe")
// .model("gpt-4o-transcribe") // 이 줄의 주석을 해제하고, 윗줄을 주석 처리하세요
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());자주 묻는 질문
GPT-4o Mini Transcribe vs GPT-4o Transcribe, 어느 쪽이 더 저렴한가요?
오디오 입력 / 1M 토큰 기준으로는 GPT-4o Mini Transcribe 쪽이 더 저렴합니다($3 대 $6, 2.0배 차이). 다른 항목에서는 반대일 수 있습니다. 전체 요금은 위 표에 있으며, 실제 비용은 사용 패턴에 따라 달라집니다.
연동을 두 번 하지 않고도 GPT-4o Mini Transcribe vs GPT-4o Transcribe A/B 테스트를 할 수 있나요?
네. 두 모델 모두 API 키 하나로 같은 OpenAI 호환 엔드포인트에서 호출합니다. 모델 문자열 한 줄만 바꾸면 전환되므로, 트래픽 일부를 각 모델로 보내 청구 금액을 직접 비교할 수 있습니다.
GPT-4o Mini Transcribe, GPT-4o Transcribe 모두 화자 분리를 지원하나요?
위 기능 표에 모델별로 정리되어 있으며, 내용은 각 공급자 문서에서 그대로 가져왔습니다. 화자 분리, 스트리밍, 타임스탬프는 모델마다 지원 여부가 달라 항목을 따로 나눴습니다.