🎁 Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

gemini-3.1-flash-live

Google beta por invitación realtime audio
Entrada$0.75/M
Salida$4.5/M
Entrada de audio$3/M
Salida de audio$12/M

Precios de lista del proveedor, sin margen de plataforma, pago por uso. Estos son los precios de lista oficiales. Los clientes con sesión iniciada pueden ver los precios efectivos con descuentos del espacio de trabajo en /console/pricing.

Use gemini-3.1-flash-live en 30 segundos

Compatible con OpenAI Realtime: conéctate por WebSocket, audio de entrada y de salida. WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gemini-3.1-flash-live"
HEADERS = {"Authorization": "Bearer sk-syn-...", "OpenAI-Beta": "realtime=v1"}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {"modalities": ["audio", "text"], "voice": "alloy"},
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

Acerca de gemini-3.1-flash-live

Google Gemini 3.1 Flash Live speech-to-speech over WebSocket (AI Studio BidiGenerateContent).

  • Flagship low-latency voice conversation.
  • Audio $3/M in · $12/M out; text $0.75/M in · $4.50/M out.
  • Billed per response at official list price.

Preguntas frecuentes

¿Se puede probar gratis la API de gemini-3.1-flash-live?

gemini-3.1-flash-live está actualmente en beta por invitación: el acceso se otorga por solicitud, no por registro abierto. Solicítelo desde la consola de Synthorai; una vez aprobado, se aplica la tarifa estándar de pago por uso, sin suscripción.

¿Cuánto cuesta gemini-3.1-flash-live?

gemini-3.1-flash-live cuesta $0.75 por millón de tokens de entrada y $4.5 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.

¿Cómo se llama a la API de gemini-3.1-flash-live?

gemini-3.1-flash-live es un modelo speech-to-speech: conéctate por WebSocket a wss://synthorai.io/v1/realtime?model=gemini-3.1-flash-live con el SDK de OpenAI Realtime (o un WebSocket sin procesar) y transmite audio de entrada y de salida. No es una subida de archivo POST /v1/audio/transcriptions. Autentícate con tu clave sk-syn y replica la cabecera OpenAI-Beta.

¿Cómo obtengo acceso a gemini-3.1-flash-live?

gemini-3.1-flash-live está en beta por invitación: solicite acceso desde la consola de Synthorai. Una vez aprobado, funciona como cualquier otro modelo: apunte su SDK de OpenAI a base_url="https://synthorai.io/v1" y configure model="gemini-3.1-flash-live".

Modelos relacionados

Obtenga su clave API gratuita Compare su costo →