🎁 新規 無料登録、10回の呼び出しを進呈。最大 $1、カード不要。

GPT Realtime 2.1 Mini 2026-07-06 リリース

OpenAI 招待制ベータ realtime audio
入力$0.6/M
出力$2.4/M
音声入力$10/M
音声出力$20/M
キャッシュ読み取り$0.06/M
知識カットオフ2024-09

ベンダー定価。プラットフォーム手数料なし、従量課金。 これらは公式 list 価格です。ログイン中のお客様は /console/pricing でワークスペース割引を含む実効価格を確認できます。 キャッシュヒット率 70% 時の実効入力単価:$0.222/M. プロンプトが最小長を超えると自動プレフィックスキャッシュが働き、コード変更は不要です。キャッシュ読み取りは割引され(現行モデルで最大 90%)、書き込み手数料はありません。

30 秒で GPT Realtime 2.1 Mini を使う

OpenAI Realtime 互換:WebSocket で接続し、音声入力・音声出力。WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini"
HEADERS = {"Authorization": "Bearer sk-syn-...", "OpenAI-Beta": "realtime=v1"}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {"modalities": ["audio", "text"], "voice": "alloy"},
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

GPT Realtime 2.1 Mini について

リアルタイム音声向け蒸留推論モデル
音声単価はフラッグシップの 3 分の 1 未満
128K コンテキスト・ツール使用・キャッシュを維持

GPT Realtime 2.1 Mini は OpenAI リアルタイムファミリーのコスト効率メンバーで、リアルタイム音声アプリケーション向けのより高速・低コストな蒸留推論モデルとして、mini ティアに推論とツール使用をもたらします。

  • 2.1 世代の 128K トークンコンテキストウィンドウと 32K 最大出力トークンを維持し、関数呼び出しとプロンプトキャッシュに対応、音声入力単価はフラッグシップの 3 分の 1 未満です。
  • 常時稼働の音声アシスタントや大量の顧客対応音声エージェントに自然にフィットします。
  • Synthorai はリアルタイム製品群の他のモデルと同じ OpenAI 互換 /v1/realtime WebSocket エンドポイントで公開しています。

スペックと制限

最大出力(ベンダー仕様)32,000
モダリティaudio + text → audio + text
機能realtime · speech-to-speech
特記事項Faster, lower-cost distilled realtime reasoning model bringing reasoning and tool use to the mini tier; prompt caching supported; 128k context.
プロンプトキャッシュ自動 · 最小プレフィックス 1,024 トークン · TTL 5–10m, up to 1h

出典:OpenAI 公式ドキュメント ↗

よくある質問

GPT Realtime 2.1 Mini API は無料で試せますか?

GPT Realtime 2.1 Mini は現在招待制ベータです。オープン登録ではなく申請制で、Synthorai コンソールから申請できます。承認後は標準の従量課金が適用され、サブスクリプションは不要です。

GPT Realtime 2.1 Mini は何が得意ですか?

リアルタイム音声向け蒸留推論モデル、さらに音声単価はフラッグシップの 3 分の 1 未満と128K コンテキスト・ツール使用・キャッシュを維持。全体像はベンダー公式のリリースノートに基づく About セクションをご覧ください。

GPT Realtime 2.1 Mini の料金はいくらですか?

Synthorai 上の GPT Realtime 2.1 Mini は入力 100 万トークンあたり $0.6、出力 100 万トークンあたり $2.4 です。ベンダー定価のままで、プラットフォーム手数料はありません。キャッシュ済み入力トークンは $0.06/M で課金されます。

GPT Realtime 2.1 Mini API はどう呼び出しますか?

GPT Realtime 2.1 Mini は音声対話(speech-to-speech)モデルです。WebSocket で wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini に接続し、OpenAI Realtime SDK(または生の WebSocket)で音声入力・音声出力を行います。POST /v1/audio/transcriptions のファイルアップロードではありません。sk-syn キーで認証し、OpenAI-Beta ヘッダーをミラーしてください。

GPT Realtime 2.1 Mini を利用するには?

GPT Realtime 2.1 Mini は招待制ベータです。Synthorai コンソールからアクセスを申請してください。承認後は他のモデルと同じ使い方です。OpenAI SDK の base_url を "https://synthorai.io/v1" に向け、model="gpt-realtime-2.1-mini" を設定するだけです。

関連モデル

無料の API キーを取得 コストを比較する →