🎁 新人 免费注册,送 10 次调用,最高 $1,免绑卡。

gemini-3.1-flash-live

Google 邀请测试 realtime audio
输入$0.75/M
输出$4.5/M
音频输入$3/M
音频输出$12/M

厂商牌价,无平台加价,按量付费。 以下为官方 list 价。登录客户可在 /console/pricing 查看含工作空间折扣的实际价格。

30 秒用上 gemini-3.1-flash-live

兼容 OpenAI Realtime:通过 WebSocket 连接,音频进、音频出。WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gemini-3.1-flash-live"
HEADERS = {"Authorization": "Bearer sk-syn-...", "OpenAI-Beta": "realtime=v1"}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {"modalities": ["audio", "text"], "voice": "alloy"},
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

关于 gemini-3.1-flash-live

Google Gemini 3.1 Flash Live speech-to-speech over WebSocket (AI Studio BidiGenerateContent).

  • Flagship low-latency voice conversation.
  • Audio $3/M in · $12/M out; text $0.75/M in · $4.50/M out.
  • Billed per response at official list price.

常见问题

gemini-3.1-flash-live API 可以免费试用吗?

gemini-3.1-flash-live 目前处于邀请测试阶段:需申请开通,而非开放注册。在 Synthorai 控制台提交申请,通过后即按标准量付费计费,无需订阅。

gemini-3.1-flash-live 的价格是多少?

在 Synthorai 上,gemini-3.1-flash-live 输入 $0.75/百万 token、输出 $4.5/百万 token,即厂商牌价,无平台加价。

如何调用 gemini-3.1-flash-live API?

gemini-3.1-flash-live 是语音对话(speech-to-speech)模型:通过 WebSocket 连接 wss://synthorai.io/v1/realtime?model=gemini-3.1-flash-live,用 OpenAI Realtime SDK(或原生 WebSocket)即可,音频输入、音频输出。它不是 POST /v1/audio/transcriptions 文件上传接口。用你的 sk-syn key 鉴权,并镜像 OpenAI-Beta 头。

如何开通 gemini-3.1-flash-live?

gemini-3.1-flash-live 处于邀请测试阶段:在 Synthorai 控制台申请开通。审批通过后与其他模型用法一致:把 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "gemini-3.1-flash-live" 即可。

相关模型

免费获取 API key 算算你的成本 →