Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

GPT-4o Mini Transcribe

Lançado em 2025-03-20

transcription

O GPT-4o Mini Transcribe é um modelo de speech-to-text alimentado pelo GPT-4o mini, oferecendo melhorias na taxa de erro por palavra e melhor reconhecimento e precisão de idioma em comparação com os modelos Whisper originais.

Entrada
áudio texto $1.25/M
Saída
texto $5/M
Entrada de áudio
$3/M
Contexto
16K
Corte de conhecimento
2024-06

Benchmarks

GPT-4o Mini Transcribe: 33 publicados, mas nenhum benchmark partilhado com modelos suficientes para comparar.

GPT-4o Mini Transcribe outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
FLEURS Arabic (WER)
14.06%

Publicado pelos fornecedores: OpenAI

O preço em contexto

Posição do preço entre 3 modelos comparáveis

Entrada$1.25/M
$1.25 · GPT-4o Mini Transcribe GPT-4o Transcribe · $2.5
Saída$5/M
$2.5 · GPT-4o Transcribe Diarize GPT-4o Transcribe · $10

A barra mostra onde fica o preço deste modelo entre todos os modelos do mesmo tipo na Synthorai. Em cada extremidade está o mais barato e o mais caro. São tarifas base; os descontos de lote, região e escrita em cache estão na página de preços.

Especificações e limites

Tokens

Saída máxima (especificação do fornecedor) 2.000
Corte de conhecimento 2024-06

Áudio

Idiomas 57 idiomas listados para o endpoint de transcrições (uma lista única para todos os modelos de transcrição); códigos ISO 639-1 / 639-3 aceitos nos modelos baseados em GPT-4o
Limites de áudio
  • mp3/mp4/mpeg/mpga/m4a/wav/webm, até 25MB
  • transcrição em streaming suportada
  • saída apenas em json/text
  • sem timestamps por palavra nem diarização
Diarização Não
Transcrição em streaming Sim
Marcas de tempo Não

Modelo

Modalidades áudio + texto → texto

Nível de custo eficiente da transcrição GPT-4o.

conforme documentação oficial da OpenAI ↗

Use o GPT-4o Mini Transcribe em 30 segundos

Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="gpt-4o-mini-transcribe",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Sobre o GPT-4o Mini Transcribe

  • É a opção custo-eficiente da linha de transcrição da OpenAI, precificada pela metade da taxa de entrada de áudio do GPT-4o Transcribe, com uma janela de contexto de 16K tokens e até 2K tokens de saída por requisição.
  • Ele compartilha o envelope operacional da família: arquivos mp3, mp4, mpeg, mpga, m4a, wav ou webm de até 25MB, transcrição em streaming, injeção de contexto por prompt para nomes e vocabulário de domínio, e log probabilities sob demanda, com saída limitada a JSON ou texto simples e sem granularidades de timestamp.
  • Duas mudanças justificam fixar um snapshot.
  • A OpenAI moveu o alias sem data para um snapshot de dezembro de 2025, então integrações que nunca fixaram uma versão trocaram de modelo silenciosamente, e o snapshot original de março de 2025 já foi programado para aposentadoria.
  • O suporte à Batch API foi adicionado no início de 2026, o que barateia limpar grandes filas offline.
  • Como seu irmão maior, ele é servido tanto no endpoint de transcrição quanto em sessões de transcrição realtime, cobre a lista publicada da API de transcrição de mais de setenta idiomas e carrega um corte de conhecimento de junho de 2024.
  • Ele se encaixa em pipelines de transcrição de alto volume onde a precisão ainda importa, mas o custo de áudio por token decide a arquitetura, e onde uma transcrição diarizada ou marcações de legenda não são necessárias.
  • A Synthorai o processa pelo endpoint de transcrição de áudio compatível com OpenAI.

Perguntas frequentes

A API do GPT-4o Mini Transcribe é gratuita para testar?

Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. É o suficiente para testar o GPT-4o Mini Transcribe com sua carga de trabalho real antes de adicionar um meio de pagamento.

Em que o GPT-4o Mini Transcribe é melhor?

Taxa de erro por palavra aprimorada em relação ao Whisper original; metade da taxa de entrada de áudio do nível premium; 16K de contexto com até 2K de saída. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o GPT-4o Mini Transcribe?

Na Synthorai, o GPT-4o Mini Transcribe custa $1.25 por milhão de tokens de entrada e $5 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma.

Quais idiomas o GPT-4o Mini Transcribe suporta?

O GPT-4o Mini Transcribe suporta 57 idiomas listados para o endpoint de transcrições (uma lista única para todos os modelos de transcrição); códigos ISO 639-1 / 639-3 aceitos nos modelos baseados em GPT-4o. Na Synthorai, você o chama via POST /v1/audio/transcriptions, no mesmo formato da API de transcrição da OpenAI.

Como obtenho acesso ao GPT-4o Mini Transcribe?

Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="gpt-4o-mini-transcribe" e pronto. Uma única chave de API cobre todos os modelos do gateway.

Modelos relacionados

Comparar

Cada valor desta página é transcrito da documentação do fornecedor, ligada acima, e traz a data em que foi verificado. Os preços são comparados em todo o catálogo; os valores de especificação que os fornecedores definem de forma diferente são apresentados com a diferença indicada em vez de representados num gráfico. Nada aqui é medido por nós, e nada é pontuado.

Obtenha sua chave API Compare seu custo →