신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

GPT Realtime

2025-08-28 출시

초대제 베타

GPT Realtime은 OpenAI의 첫 정식 제공 실시간 모델입니다.

입력
오디오 텍스트 $4/M
출력
오디오 텍스트 $16/M
오디오 입력
$32/M
오디오 출력
$64/M
캐시 읽기
$0.4/M
지식 컷오프
2023-10

벤치마크

GPT Realtime: 8개 공개되었지만, 비교할 만큼 다른 모델이 측정한 항목이 없다.

GPT Realtime 측정된 다른 모델 측정 대상 평균 더 높은 점수를 낸 모델 없음
AMI near+far field (WER)
35.9%
Big Bench Audio
82.8%
BFCL v3 (single-turn, python only)
80.4%

벤더 공개: Amazon OpenAI

가격의 위치

동종 6개 모델 중 가격 위치

입력$4/M
$0.06 · nova-2-sonic GPT Realtime · $4
출력$16/M
$0.24 · nova-2-sonic GPT Realtime 2.1 · $24
캐시 읽기$0.4/M
$0.06 · GPT Realtime 2.1 Mini GPT Realtime · $0.4

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양) 32,000
최대 출력(벤더 스펙) 4,096
지식 컷오프 2023-10

프롬프트 캐싱

캐싱 방식 자동
최소 프리픽스 1,024
수명 5-10분, 최대 1시간

실시간

세션 WebSocket 기반 네이티브 음성 대 음성 · 함수 호출 · 32K 컨텍스트

모델

모달리티 오디오 + 텍스트 → 오디오 + 텍스트
  • OpenAI 최초의 정식 출시 실시간 모델(스냅샷 gpt-realtime-2025-08-28): 함수 호출을 지원하는 네이티브 음성 대 음성
  • 32k 컨텍스트

출처: OpenAI 공식 문서 ↗

30초 만에 GPT Realtime 사용하기

OpenAI Realtime 호환: WebSocket으로 연결해 오디오 입력·오디오 출력. WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime"
# Send ONLY the Authorization header - the beta protocol is retired.
HEADERS = {"Authorization": "Bearer sk-syn-..."}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {
                "type": "realtime",
                "output_modalities": ["audio"],
                "audio": {"output": {"voice": "alloy"}},
            },
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

GPT Realtime 소개

  • 전사와 합성 모델을 따로 이어 붙이는 대신 자연스럽고 표현력 있는 오디오로 직접 듣고 응답하는 단일 음성-음성 모델입니다.
  • 32K 토큰 컨텍스트 윈도우와 4,096 최대 출력 토큰을 가지며, 음성 에이전트 워크플로를 위한 함수 호출을 지원하고, 오디오 또는 텍스트 입력을 받아 오디오와 텍스트를 출력합니다.
  • 오디오와 텍스트는 서로 다른 토큰 단가로 과금되며 캐시 입력은 할인됩니다.
  • 세션은 브라우저와 모바일 클라이언트를 위한 WebRTC, 서버가 이미 오디오 스트림을 쥐고 있을 때의 WebSocket, 텔레포니 에이전트를 위한 SIP로 구동할 수 있고, 서버 측 음성 활동 감지가 발화를 청크로 나누고 발신자가 끼어들면 재생되지 않은 오디오를 잘라냅니다.
  • 모델 페이지는 텍스트·오디오와 함께 이미지 입력도 나열하고, 음성은 OpenAI가 공개한 세트에서 세션마다 고르되 세션이 오디오를 한 번 내보낸 뒤에는 음성을 바꿀 수 없다는 단서가 붙습니다.
  • 추론 강도 제어는 없으며(그것은 2.1 세대에서 등장합니다), 지식 컷오프는 2023년 10월입니다.
  • OpenAI는 이후 이 모델의 폐기를 발표했고 종료는 2027년 1월로 예정되어 있으며 마이그레이션 대상으로 GPT Realtime 2.1을 지정했으므로, 새 음성 작업은 2.1에서 진행하고 기존 통합에는 아직 여유가 있습니다.
  • 실시간 패밀리 최초의 정식 제공 스냅샷으로 계속 제공됩니다.
  • Synthorai는 OpenAI 호환 /v1/realtime WebSocket 엔드포인트로 GPT Realtime을 서빙하므로 공식 Realtime SDK 클라이언트가 그대로 연결됩니다.

자주 묻는 질문

GPT Realtime API는 무료로 사용해 볼 수 있나요?

GPT Realtime는 현재 초대제 베타 단계로, 공개 가입이 아닌 신청 기반으로 이용할 수 있습니다. Synthorai 콘솔에서 신청하면 되며, 승인 후에는 구독 없이 표준 종량제 요금이 적용됩니다.

GPT Realtime는 무엇에 가장 강한가요?

단일 모델 음성 대 음성, 전사 체인 불필요, 표현력 있는 자연 오디오와 함수 호출, 실시간 제품군 최초의 GA 스냅샷. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

GPT Realtime의 가격은 얼마인가요?

Synthorai에서 GPT Realtime는 입력 토큰 100만 개당 $4, 출력 토큰 100만 개당 $16입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.4/M로 과금됩니다.

GPT Realtime API는 어떻게 호출하나요?

GPT Realtime는 음성 대화(speech-to-speech) 모델입니다. WebSocket으로 wss://synthorai.io/v1/realtime?model=gpt-realtime에 연결하고 OpenAI Realtime SDK(또는 원시 WebSocket)로 오디오 입력·오디오 출력을 처리합니다. POST /v1/audio/transcriptions 파일 업로드가 아닙니다. sk-syn 키로 인증하고 Authorization 헤더만 보내세요(beta 프로토콜은 종료되었습니다).

GPT Realtime는 어떻게 이용하나요?

GPT Realtime는 초대제 베타입니다: Synthorai 콘솔에서 액세스를 신청하세요. 승인되면 다른 모델과 동일하게 동작합니다. OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="gpt-realtime"로 설정하면 됩니다.

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →