🎁 Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

GPT Realtime 2.1 Lançado em 2026-07-06

OpenAI beta por convite realtime audio
Entrada$4/M
Saída$24/M
Entrada de áudio$32/M
Saída de áudio$64/M
Leitura de cache$0.4/M
Corte de conhecimento2024-09

Preços de tabela do provedor: sem margem da plataforma, pagamento por uso. Estes são os preços de tabela oficiais. Clientes autenticados podem ver os preços efetivos com descontos do espaço de trabalho em /console/pricing. Entrada efetiva com taxa de acerto de cache de 70%:$1.48/M. Cache de prefixo automático assim que um prompt passa do comprimento mínimo, sem mudanças de código; as leituras em cache têm desconto (até 90% nos modelos atuais) e não há taxa de gravação.

Use o GPT Realtime 2.1 em 30 segundos

Compatível com OpenAI Realtime: conecte-se por WebSocket, áudio de entrada e de saída. WS /v1/realtime

import asyncio, base64, json, websockets

URL = "wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1"
HEADERS = {"Authorization": "Bearer sk-syn-...", "OpenAI-Beta": "realtime=v1"}

async def main():
    async with websockets.connect(URL, additional_headers=HEADERS) as ws:
        # 1) configure the speech-to-speech session
        await ws.send(json.dumps({
            "type": "session.update",
            "session": {"modalities": ["audio", "text"], "voice": "alloy"},
        }))
        # 2) send input audio (base64 PCM16), then request a spoken reply
        await ws.send(json.dumps({"type": "input_audio_buffer.append", "audio": pcm16_b64}))
        await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
        await ws.send(json.dumps({"type": "response.create"}))
        # 3) stream the model's audio (and text) back
        async for raw in ws:
            ev = json.loads(raw)
            if ev["type"] == "response.audio.delta":
                play(base64.b64decode(ev["delta"]))   # audio out
            elif ev["type"] == "response.done":
                break

asyncio.run(main())

Sobre o GPT Realtime 2.1

Nível realtime carro-chefe para agentes de voz em produção
Interrupção, ruído e alfanuméricos aprimorados
Esforço de raciocínio configurável com ferramentas

O GPT Realtime 2.1 é o carro-chefe da família realtime de voz para voz da OpenAI, anunciado como um modelo de raciocínio realtime atualizado com reconhecimento alfanumérico, tratamento de silêncio e ruído e comportamento de interrupção aprimorados.

  • Ele expande a família para uma janela de contexto de 128K tokens com até 32K tokens de saída e suporta esforço de raciocínio configurável, seguimento de instruções e uso de ferramentas para fluxos complexos de agentes de voz.
  • Tokens de áudio e texto são cobrados a tarifas separadas, com entrada em cache com desconto.
  • Na Synthorai, é servido pelo endpoint WebSocket /v1/realtime compatível com OpenAI, de modo que aplicações construídas sobre os SDKs oficiais de Realtime funcionam sem mudanças.

Especificações e limites

Saída máxima (especificação do fornecedor)32,000
Modalidadesaudio + text → audio + text
Recursosrealtime · speech-to-speech
DestaquesUpdated realtime reasoning model with improved alphanumeric recognition, silence and noise handling, and interruption behavior; configurable reasoning effort and tool use for voice-agent workflows; 128k context.
Cache de promptsautomático · prefixo mínimo de 1,024 tokens · TTL 5–10m, up to 1h

conforme documentação oficial da OpenAI ↗

Perguntas frequentes

A API do GPT Realtime 2.1 é gratuita para testar?

O GPT Realtime 2.1 está atualmente em beta por convite: o acesso é por solicitação, não por cadastro aberto. Solicite pelo console da Synthorai; após a aprovação, aplica-se o preço padrão de pagamento por uso, sem assinatura.

Em que o GPT Realtime 2.1 é melhor?

Nível realtime carro-chefe para agentes de voz em produção, além de interrupção, ruído e alfanuméricos aprimorados e esforço de raciocínio configurável com ferramentas. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o GPT Realtime 2.1?

Na Synthorai, o GPT Realtime 2.1 custa $4 por milhão de tokens de entrada e $24 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.4/M.

Como chamar a API do GPT Realtime 2.1?

GPT Realtime 2.1 é um modelo speech-to-speech: conecte-se por WebSocket a wss://synthorai.io/v1/realtime?model=gpt-realtime-2.1 com o SDK OpenAI Realtime (ou um WebSocket puro) e transmita áudio de entrada e de saída. Não é um upload de arquivo POST /v1/audio/transcriptions. Autentique-se com a sua chave sk-syn e espelhe o cabeçalho OpenAI-Beta.

Como obtenho acesso ao GPT Realtime 2.1?

O GPT Realtime 2.1 está em beta por convite: solicite acesso pelo console da Synthorai. Após a aprovação, ele funciona como qualquer outro modelo: aponte seu SDK da OpenAI para base_url="https://synthorai.io/v1" e defina model="gpt-realtime-2.1".

Modelos relacionados

Obtenha sua chave de API gratuita Compare seu custo →