Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

GPT Realtime Whisper

transcription

OpenAI's lowest-latency streaming transcription model for Realtime sessions. Duration-billed at $0.017/min ($1.02/hour).

Prix
$0.017/min

Le prix en contexte

Position du prix parmi 12 modèles comparables

Par minute$0.017/min
$0.002 · Fun-ASR Realtime GPT Realtime Whisper · $0.017

La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.

Utilisez GPT Realtime Whisper en 30 secondes

Utilisé uniquement dans une session OpenAI Realtime, comme modèle de transcription de l'entrée : ouvrez la session sur un modèle Realtime et réglez session.audio.input.transcription.model sur gpt-realtime-whisper. WS /v1/realtime

import asyncio, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1"
# Send ONLY the Authorization header - the beta protocol is retired.
HEADERS = {"Authorization": "Bearer sk-syn-..."}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) name gpt-realtime-whisper as the session's input transcription model
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {
                "type": "realtime",
                "audio": {"input": {"transcription": {"model": "gpt-realtime-whisper"}}},
            },
        }))
        # 2) send input audio (base64 PCM16) and commit it
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        # 3) the transcript of what was said arrives as its own event
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "conversation.item.input_audio_transcription.completed":
                print(ev["transcript"])
                break

asyncio.run(main())

FAQ

Peut-on essayer l'API GPT Realtime Whisper gratuitement ?

Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. De quoi essayer GPT Realtime Whisper sur votre charge de travail réelle avant d'ajouter un moyen de paiement.

Combien coûte GPT Realtime Whisper ?

Sur Synthorai, GPT Realtime Whisper coûte $0.017 par minute d'audio transcrit : paiement à l'usage, sans majoration de plateforme, sans abonnement.

Comment utiliser GPT Realtime Whisper ?

GPT Realtime Whisper ne s'appelle pas seul. Il transcrit l'audio de l'utilisateur dans une session Realtime : connectez-vous à wss://synthorai.io/v1/realtime avec un modèle Realtime, réglez session.audio.input.transcription.model sur "gpt-realtime-whisper" et lisez chaque transcription dans l'événement conversation.item.input_audio_transcription.completed. Il est facturé $0.017 par minute d'audio en entrée, en plus des tarifs de la session.

Comment obtenir l'accès à GPT Realtime Whisper ?

Ouvrez la session Realtime avec votre clé API Synthorai et indiquez "gpt-realtime-whisper" comme modèle de transcription de l'entrée. GPT Realtime Whisper est conçu pour les sessions Realtime, pas pour l'API de fichiers /v1/audio/transcriptions ; pour transcrire un fichier, choisissez un modèle de reconnaissance vocale. Une seule clé API couvre tous les modèles de la passerelle.

Modèles associés

Comparer

Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.

Obtenez votre clé API Comparez votre coût →