🎁 Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

GPT Realtime 2.1 Mini Lançado em 2026-07-06

OpenAI beta por convite realtime audio
Entrada$0.6/M
Saída$2.4/M
Entrada de áudio$10/M
Saída de áudio$20/M
Leitura de cache$0.06/M
Corte de conhecimento2024-09

Preços de tabela do provedor: sem margem da plataforma, pagamento por uso. Estes são os preços de tabela oficiais. Clientes autenticados podem ver os preços efetivos com descontos do espaço de trabalho em /console/pricing. Entrada efetiva com taxa de acerto de cache de 70%:$0.222/M. Cache de prefixo automático assim que um prompt passa do comprimento mínimo, sem mudanças de código; as leituras em cache têm desconto (até 90% nos modelos atuais) e não há taxa de gravação.

Use o GPT Realtime 2.1 Mini em 30 segundos

Compatível com OpenAI Realtime: conecte-se por WebSocket, áudio de entrada e de saída. WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini"
HEADERS = {"Authorization": "Bearer sk-syn-...", "OpenAI-Beta": "realtime=v1"}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {"modalities": ["audio", "text"], "voice": "alloy"},
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

Sobre o GPT Realtime 2.1 Mini

Raciocínio destilado para voz em tempo real
Entrada de áudio a menos de um terço do carro-chefe
Mantém 128K de contexto, ferramentas e cache de prompts

O GPT Realtime 2.1 Mini é o membro econômico da família realtime da OpenAI: um modelo de raciocínio destilado mais rápido e barato para aplicações de voz em tempo real, que traz raciocínio e uso de ferramentas ao nível mini.

  • Mantém a janela de contexto de 128K tokens e os 32K tokens máximos de saída da geração 2.1, suporta chamadas de função e cache de prompts, e cobra a entrada de áudio a menos de um terço da tarifa do carro-chefe.
  • Isso o torna a escolha natural para assistentes de voz sempre ativos e agentes de voz de alto volume voltados ao cliente.
  • A Synthorai o expõe pelo mesmo endpoint WebSocket /v1/realtime compatível com OpenAI do restante da linha realtime.

Especificações e limites

Saída máxima (especificação do fornecedor)32,000
Modalidadesaudio + text → audio + text
Recursosrealtime · speech-to-speech
DestaquesFaster, lower-cost distilled realtime reasoning model bringing reasoning and tool use to the mini tier; prompt caching supported; 128k context.
Cache de promptsautomático · prefixo mínimo de 1,024 tokens · TTL 5–10m, up to 1h

conforme documentação oficial da OpenAI ↗

Perguntas frequentes

A API do GPT Realtime 2.1 Mini é gratuita para testar?

O GPT Realtime 2.1 Mini está atualmente em beta por convite: o acesso é por solicitação, não por cadastro aberto. Solicite pelo console da Synthorai; após a aprovação, aplica-se o preço padrão de pagamento por uso, sem assinatura.

Em que o GPT Realtime 2.1 Mini é melhor?

Raciocínio destilado para voz em tempo real, além de entrada de áudio a menos de um terço do carro-chefe e mantém 128K de contexto, ferramentas e cache de prompts. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o GPT Realtime 2.1 Mini?

Na Synthorai, o GPT Realtime 2.1 Mini custa $0.6 por milhão de tokens de entrada e $2.4 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.06/M.

Como chamar a API do GPT Realtime 2.1 Mini?

GPT Realtime 2.1 Mini é um modelo speech-to-speech: conecte-se por WebSocket a wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1-mini com o SDK OpenAI Realtime (ou um WebSocket puro) e transmita áudio de entrada e de saída. Não é um upload de arquivo POST /v1/audio/transcriptions. Autentique-se com a sua chave sk-syn e espelhe o cabeçalho OpenAI-Beta.

Como obtenho acesso ao GPT Realtime 2.1 Mini?

O GPT Realtime 2.1 Mini está em beta por convite: solicite acesso pelo console da Synthorai. Após a aprovação, ele funciona como qualquer outro modelo: aponte seu SDK da OpenAI para base_url="https://synthorai.io/v1" e defina model="gpt-realtime-2.1-mini".

Modelos relacionados

Obtenha sua chave de API gratuita Compare seu custo →