🎁 신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

GPT Realtime 2.1 Mini 2026-07-06 출시

OpenAI 초대제 베타 realtime audio
입력$0.6/M
출력$2.4/M
오디오 입력$10/M
오디오 출력$20/M
캐시 읽기$0.06/M
지식 컷오프2024-09

공급사 정가. 플랫폼 마진 없음, 종량제. 아래는 공식 정가입니다. 로그인한 고객은 /console/pricing 에서 워크스페이스 할인이 반영된 실제 가격을 볼 수 있습니다. 캐시 적중률 70% 기준 실효 입력 단가:$0.222/M. 프롬프트가 최소 길이를 넘으면 자동 프리픽스 캐싱이 적용되어 코드 변경이 필요 없습니다. 캐시 읽기는 할인되며(현행 모델 기준 최대 90%) 쓰기 수수료가 없습니다.

30초 만에 GPT Realtime 2.1 Mini 사용하기

OpenAI Realtime 호환: WebSocket으로 연결해 오디오 입력·오디오 출력. WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini"
HEADERS = {"Authorization": "Bearer sk-syn-...", "OpenAI-Beta": "realtime=v1"}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {"modalities": ["audio", "text"], "voice": "alloy"},
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

GPT Realtime 2.1 Mini 소개

실시간 음성용 증류 추론 모델
오디오 단가는 플래그십의 3분의 1 미만
128K 컨텍스트·도구 사용·프롬프트 캐싱 유지

GPT Realtime 2.1 Mini는 OpenAI 실시간 제품군의 비용 효율 멤버로, 실시간 음성 애플리케이션을 위한 더 빠르고 저렴한 증류(distilled) 추론 모델이며 mini 티어에 추론과 도구 사용을 가져옵니다.

  • 2.1 세대의 128K 토큰 컨텍스트 윈도우와 32K 최대 출력 토큰을 유지하고 함수 호출과 프롬프트 캐싱을 지원하며, 오디오 입력 단가는 플래그십의 3분의 1 미만입니다.
  • 상시 가동 음성 비서와 대규모 고객 응대 음성 에이전트에 자연스럽게 맞습니다.
  • Synthorai는 실시간 라인업의 나머지와 동일한 OpenAI 호환 /v1/realtime WebSocket 엔드포인트로 이를 공개합니다.

스펙 및 제한

최대 출력(벤더 스펙)32,000
모달리티audio + text → audio + text
기능realtime · speech-to-speech
특기 사항Faster, lower-cost distilled realtime reasoning model bringing reasoning and tool use to the mini tier; prompt caching supported; 128k context.
프롬프트 캐싱자동 · 최소 프리픽스 1,024 토큰 · TTL 5–10m, up to 1h

출처: OpenAI 공식 문서 ↗

자주 묻는 질문

GPT Realtime 2.1 Mini API는 무료로 사용해 볼 수 있나요?

GPT Realtime 2.1 Mini은(는) 현재 초대제 베타 단계로, 공개 가입이 아닌 신청 기반으로 이용할 수 있습니다. Synthorai 콘솔에서 신청하면 되며, 승인 후에는 구독 없이 표준 종량제 요금이 적용됩니다.

GPT Realtime 2.1 Mini은(는) 무엇에 가장 강한가요?

실시간 음성용 증류 추론 모델, 그리고 오디오 단가는 플래그십의 3분의 1 미만 및 128K 컨텍스트·도구 사용·프롬프트 캐싱 유지. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 About 섹션을 참고하세요.

GPT Realtime 2.1 Mini의 가격은 얼마인가요?

Synthorai에서 GPT Realtime 2.1 Mini은(는) 입력 토큰 100만 개당 $0.6, 출력 토큰 100만 개당 $2.4입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.06/M로 과금됩니다.

GPT Realtime 2.1 Mini API는 어떻게 호출하나요?

GPT Realtime 2.1 Mini은(는) 음성 대화(speech-to-speech) 모델입니다. WebSocket으로 wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini에 연결하고 OpenAI Realtime SDK(또는 원시 WebSocket)로 오디오 입력·오디오 출력을 처리합니다. POST /v1/audio/transcriptions 파일 업로드가 아닙니다. sk-syn 키로 인증하고 OpenAI-Beta 헤더를 미러링하세요.

GPT Realtime 2.1 Mini은(는) 어떻게 이용하나요?

GPT Realtime 2.1 Mini은(는) 초대제 베타입니다: Synthorai 콘솔에서 액세스를 신청하세요. 승인되면 다른 모델과 동일하게 동작합니다. OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="gpt-realtime-2.1-mini"로 설정하면 됩니다.

관련 모델

무료 API 키 받기 내 비용 비교하기 →