新人 免费注册,送 10 次调用,最高 $1,免绑卡。

GPT Realtime Whisper

transcription

OpenAI's lowest-latency streaming transcription model for Realtime sessions. Duration-billed at $0.017/min ($1.02/hour).

价格
$0.017/min

价格在同类中的位置

价格在 12 个同类模型中的位置

每分钟$0.017/min
$0.002 · Fun-ASR Realtime GPT Realtime Whisper · $0.017

这条线显示该模型的价格,在 Synthorai 上同类模型里处于什么位置。两端标出了最便宜和最贵的那个。这里是基础价,批量、区域和缓存写入的折扣见价格页。

30 秒用上 GPT Realtime Whisper

只在 OpenAI Realtime 会话里作为输入转写模型使用:在 Realtime 模型上建立会话,把 session.audio.input.transcription.model 设为 gpt-realtime-whisper。WS /v1/realtime

import asyncio, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1"
# Send ONLY the Authorization header - the beta protocol is retired.
HEADERS = {"Authorization": "Bearer sk-syn-..."}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) name gpt-realtime-whisper as the session's input transcription model
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {
                "type": "realtime",
                "audio": {"input": {"transcription": {"model": "gpt-realtime-whisper"}}},
            },
        }))
        # 2) send input audio (base64 PCM16) and commit it
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        # 3) the transcript of what was said arrives as its own event
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "conversation.item.input_audio_transcription.completed":
                print(ev["transcript"])
                break

asyncio.run(main())

常见问题

GPT Realtime Whisper API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。足够在添加付款方式之前,用真实工作负载试一试 GPT Realtime Whisper。

GPT Realtime Whisper 的价格是多少?

在 Synthorai 上,GPT Realtime Whisper 按转写音频每分钟 $0.017 计费,按量付费,无平台加价,无需订阅。

GPT Realtime Whisper 怎么用?

GPT Realtime Whisper 不单独调用,而是在 Realtime 会话里转写用户说的话:用 Realtime 模型连接 wss://synthorai.io/v1/realtime,把 session.audio.input.transcription.model 设为 "gpt-realtime-whisper",每段转写结果从 conversation.item.input_audio_transcription.completed 事件读取。按输入音频每分钟 $0.017 计费,另加会话本身的费用。

如何开通 GPT Realtime Whisper?

用你的 Synthorai API key 建立 Realtime 会话,并把 "gpt-realtime-whisper" 设为输入转写模型即可。GPT Realtime Whisper 是为 Realtime 会话设计的,不用于 /v1/audio/transcriptions 文件转写接口;要转写音频文件,请选用语音转文字模型。一个 API key 可调用网关上的所有模型。

相关模型

对比

本页每个值都转录自厂商自己的文档(链接见上),并带有核对日期。价格在全目录范围内比较;各厂商定义不同的规格值,只说明差异而不作图表对比。此处没有任何由我们测量的数据,也不做评分。

获取 API 密钥 算算你的成本 →