신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

GPT Realtime 2.1 Mini

2026-07-06 출시

초대제 베타

GPT Realtime 2.1 Mini는 OpenAI 실시간 패밀리의 비용 효율적인 멤버입니다.

입력
오디오 텍스트 $0.6/M
출력
오디오 텍스트 $2.4/M
오디오 입력
$10/M
오디오 출력
$20/M
캐시 읽기
$0.06/M
지식 컷오프
2024-09

가격의 위치

동종 6개 모델 중 가격 위치

입력$0.6/M
$0.06 · nova-2-sonic GPT Realtime · $4
출력$2.4/M
$0.24 · nova-2-sonic GPT Realtime 2.1 · $24
캐시 읽기$0.06/M
$0.06 · GPT Realtime 2.1 Mini GPT Realtime · $0.4

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양) 128,000
최대 출력(벤더 스펙) 32,000
지식 컷오프 2024-09

프롬프트 캐싱

캐싱 방식 자동
최소 프리픽스 1,024
수명 5-10분, 최대 1시간

실시간

세션 추론과 도구 사용이 가능한 음성 대 음성 · 프롬프트 캐싱 · 128K 컨텍스트

모델

모달리티 오디오 + 텍스트 → 오디오 + 텍스트
  • 추론과 도구 사용을 mini 티어로 가져온, 더 빠르고 저렴한 증류 실시간 추론 모델
  • 프롬프트 캐싱 지원
  • 128k 컨텍스트

출처: OpenAI 공식 문서 ↗

30초 만에 GPT Realtime 2.1 Mini 사용하기

OpenAI Realtime 호환: WebSocket으로 연결해 오디오 입력·오디오 출력. WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini"
# Send ONLY the Authorization header - the beta protocol is retired.
HEADERS = {"Authorization": "Bearer sk-syn-..."}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {
                "type": "realtime",
                "output_modalities": ["audio"],
                "audio": {"output": {"voice": "alloy"}},
            },
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

GPT Realtime 2.1 Mini 소개

  • 더 빠르고 저렴한 실시간 음성 상호작용을 위한 증류 추론 모델로, 추론과 도구 사용을 미니 티어로 가져옵니다.
  • 2.1 세대의 128K 토큰 컨텍스트 윈도우와 32K 최대 출력 토큰을 유지하고, 함수 호출과 프롬프트 캐싱을 지원하며, 오디오 입력 가격은 플래그십 요율의 3분의 1 미만입니다.
  • 둘 중 무엇을 고를지에 대한 OpenAI의 지침은 직설적입니다.
  • 가장 강력한 실시간 추론, 도구 사용, 지시 준수를 원하면 풀 2.1을, 더 빠르고 비용 효율적인 선택지를 원하면 이 모델을 쓰라는 것입니다.
  • WebRTC, WebSocket, SIP로 오디오와 텍스트 입력을 받으므로 동일한 전송 선택지와 음성 에이전트 패턴이 적용됩니다.
  • 침묵 기반 또는 의미 기반 턴 감지, 끼어들기 시 서버 측 잘라내기, 세션 단위 또는 응답 단위 도구 선언입니다.
  • OpenAI는 이번 릴리스에서 캐싱 개선을 통해 실시간 음성 모델 전반의 p95 지연 시간이 최소 25% 감소했다고 보고했습니다.
  • 2027년 1월 종료가 예정된 이전 미니 실시간 모델들의 지정 마이그레이션 대상이기도 합니다.
  • 그래서 상시 동작하는 음성 어시스턴트와 대용량 고객 대면 음성 에이전트에 자연스러운 선택지가 됩니다.
  • Synthorai는 실시간 라인업의 나머지와 동일한 OpenAI 호환 /v1/realtime WebSocket 엔드포인트로 이 모델을 노출합니다.

자주 묻는 질문

GPT Realtime 2.1 Mini API는 무료로 사용해 볼 수 있나요?

GPT Realtime 2.1 Mini는 현재 초대제 베타 단계로, 공개 가입이 아닌 신청 기반으로 이용할 수 있습니다. Synthorai 콘솔에서 신청하면 되며, 승인 후에는 구독 없이 표준 종량제 요금이 적용됩니다.

GPT Realtime 2.1 Mini는 무엇에 가장 강한가요?

실시간 음성용 증류 추론 모델, 오디오 단가는 플래그십의 3분의 1 미만, 128K 컨텍스트·도구 사용·프롬프트 캐싱 유지. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

GPT Realtime 2.1 Mini의 가격은 얼마인가요?

Synthorai에서 GPT Realtime 2.1 Mini는 입력 토큰 100만 개당 $0.6, 출력 토큰 100만 개당 $2.4입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.06/M로 과금됩니다.

GPT Realtime 2.1 Mini API는 어떻게 호출하나요?

GPT Realtime 2.1 Mini는 음성 대화(speech-to-speech) 모델입니다. WebSocket으로 wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini에 연결하고 OpenAI Realtime SDK(또는 원시 WebSocket)로 오디오 입력·오디오 출력을 처리합니다. POST /v1/audio/transcriptions 파일 업로드가 아닙니다. sk-syn 키로 인증하고 Authorization 헤더만 보내세요(beta 프로토콜은 종료되었습니다).

GPT Realtime 2.1 Mini는 어떻게 이용하나요?

GPT Realtime 2.1 Mini는 초대제 베타입니다: Synthorai 콘솔에서 액세스를 신청하세요. 승인되면 다른 모델과 동일하게 동작합니다. OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="gpt-realtime-2.1-mini"로 설정하면 됩니다.

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →