🎁 新規 無料登録、10回の呼び出しを進呈。最大 $1、カード不要。

GPT Realtime 2.1 vs GPT Realtime 2.1 Mini

vs

いつ、どちらを使うべきか — ベンチマーク表ではなく、厳選された評価

mini の段はどの行でも安く、テキストは 100万あたり $0.6 と $2.4 が $4 と $24 に対して、音声は入出力 100万あたり $10 と $20 が $32 と $64 に対して — 音声でおよそ 3 分の 1、テキスト入力で約 7 分の 1 です。どちらも 128K のセッションコンテキストを持ち、音声対音声、ツール利用、プロンプトキャッシュに対応します。フルモデルはさらに設定可能な推論の強さと割り込み処理を明記しています。量をこなすなら mini、セッションごとに推論の強さを調整したいならフルモデルを選んでください。

料金

GPT Realtime 2.1 GPT Realtime 2.1 Mini Δ
音声入力 / 1Mトークン $32 $10 3.2×
音声出力 / 1Mトークン $64 $20 3.2×
音声キャッシュ読み取り / 1Mトークン $0.4 $0.3 1.3×
テキスト入力 / 1Mトークン $4 $0.6 6.7×
テキスト出力 / 1Mトークン $24 $2.4 10×
キャッシュ書き込み 別途料金なし 別途料金なし

ビルド時のライブカタログの料金です。各モデルのページには現在の料金カードが記載されています。

位置付け — この課金単位におけるすべての6個のリアルタイム音声対音声モデル全体の1M音声トークンあたりの料金 (対数スケール)

機能

GPT Realtime 2.1 GPT Realtime 2.1 Mini
プロンプトキャッシング 暗黙的 (自動) 暗黙的 (自動)
キャッシュ有効期間 5–10m, up to 1h 5–10m, up to 1h
最小キャッシュプレフィックス 1024 トークン 1024 トークン

仕様

GPT Realtime 2.1 GPT Realtime 2.1 Mini
入力モダリティ テキスト 音声 テキスト 音声
出力モダリティ テキスト 音声 テキスト 音声
リリース 2026-07-06 2026-07-06
知識のカットオフ 2024-09 2024-09
セッション機能
  • Speech-to-speech over WebSocket
  • configurable reasoning effort
  • tool use
  • interruption handling
  • 128K context
  • Speech-to-speech with reasoning & tool use
  • prompt caching
  • 128K context
コンテキストウィンドウ 128K 128K

仕様は各ベンダーのドキュメントから転記されています。ベンダーが公開していない行は推測せず、省略しています。 すべての出典: GPT Realtime 2.1 · GPT Realtime 2.1 Mini

1行で切り替え

以下のすべてのタブには両方のIDが含まれています — 変更箇所はハイライトされた2行のみです。エンドポイント、キー、リクエスト形式はすべて同じです。

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1"
# URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini"  # この行をアンコメントし、上の行をコメントアウトします
# Send ONLY the Authorization header — the beta protocol is retired.
HEADERS = {"Authorization": "Bearer sk-syn-..."}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {
                "type": "realtime",
                "output_modalities": ["audio"],
                "audio": {"output": {"voice": "alloy"}},
            },
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

APIキーを取得する →

FAQ

GPT Realtime 2.1 と GPT Realtime 2.1 Mini ではどちらが安いですか?

音声入力 / 1mトークン においては GPT Realtime 2.1 Mini の方が安価です($10 対 $32、3.2× の差)。他の行では逆になる可能性があります — 上の表には完全な情報が記載されており、実際のコストは組み合わせに依存します。

2つの統合を行わずに GPT Realtime 2.1 と GPT Realtime 2.1 Mini のA/Bテストを実施できますか?

はい。両方とも1つのAPIキーで同じOpenAI互換エンドポイントを通じて提供されます — モデル文字列を1行変更するだけで切り替えられるため、トラフィックの一部をそれぞれにルーティングし、請求額を直接比較できます。

GPT Realtime 2.1 と GPT Realtime 2.1 Mini はプロンプトキャッシングをサポートしていますか?

はい — どちらのモデルでもキャッシュ読み込みは入力レートよりも低く請求されるため、ウォームプレフィックスのワークロードは定価が示すよりも低コストになります。キャッシュ読み込みの正確な行は、上の料金表に記載されています。

関連する比較