Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

GPT Realtime Whisper

transcription

OpenAI's lowest-latency streaming transcription model for Realtime sessions. Duration-billed at $0.017/min ($1.02/hour).

Prezzo
$0.017/min

Il prezzo nel contesto

Posizione del prezzo tra 12 modelli comparabili

Al minuto$0.017/min
$0.002 · Fun-ASR Realtime GPT Realtime Whisper · $0.017

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Usa GPT Realtime Whisper in 30 secondi

Usato solo all'interno di una sessione OpenAI Realtime, come modello di trascrizione dell'input: apri la sessione su un modello Realtime e imposta session.audio.input.transcription.model su gpt-realtime-whisper. WS /v1/realtime

import asyncio, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1"
# Send ONLY the Authorization header - the beta protocol is retired.
HEADERS = {"Authorization": "Bearer sk-syn-..."}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) name gpt-realtime-whisper as the session's input transcription model
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {
                "type": "realtime",
                "audio": {"input": {"transcription": {"model": "gpt-realtime-whisper"}}},
            },
        }))
        # 2) send input audio (base64 PCM16) and commit it
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        # 3) the transcript of what was said arrives as its own event
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "conversation.item.input_audio_transcription.completed":
                print(ev["transcript"])
                break

asyncio.run(main())

FAQ

L'API di GPT Realtime Whisper si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare GPT Realtime Whisper sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.

Quanto costa GPT Realtime Whisper?

Su Synthorai, GPT Realtime Whisper costa $0.017 per minuto di audio trascritto: pagamento a consumo, senza ricarico della piattaforma, senza abbonamento.

Come si usa GPT Realtime Whisper?

GPT Realtime Whisper non si chiama da solo. Trascrive l'audio dell'utente all'interno di una sessione Realtime: connettiti a wss://synthorai.io/v1/realtime con un modello Realtime, imposta session.audio.input.transcription.model su "gpt-realtime-whisper" e leggi ogni trascrizione dall'evento conversation.item.input_audio_transcription.completed. Viene addebitato $0.017 al minuto di audio in ingresso, in aggiunta alle tariffe della sessione.

Come ottengo l'accesso a GPT Realtime Whisper?

Apri la sessione Realtime con la tua chiave API Synthorai e indica "gpt-realtime-whisper" come modello di trascrizione dell'input. GPT Realtime Whisper è pensato per le sessioni Realtime, non per l'API di file /v1/audio/transcriptions; per trascrivere un file, scegli un modello di riconoscimento vocale. Una sola chiave API copre tutti i modelli del gateway.

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →