Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

GPT-4o Mini Transcribe

Lanzamiento: 2025-03-20

transcription

GPT-4o Mini Transcribe es un modelo de voz a texto impulsado por GPT-4o mini, que ofrece mejoras en la tasa de error por palabra y un mejor reconocimiento y precisión de idiomas en comparación con los modelos Whisper originales.

Entrada
audio texto $1.25/M
Salida
texto $5/M
Entrada de audio
$3/M
Contexto
16K
Corte de conocimiento
2024-06

Benchmarks

GPT-4o Mini Transcribe: 33 publicados, pero ningún benchmark compartido con suficientes modelos para comparar.

GPT-4o Mini Transcribe otros modelos medidos media de los modelos comparados ningún otro modelo puntuó más alto
FLEURS Arabic (WER)
14.06%

Publicado por los proveedores: OpenAI

El precio en contexto

Posición del precio entre 3 modelos comparables

Entrada$1.25/M
$1.25 · GPT-4o Mini Transcribe GPT-4o Transcribe · $2.5
Salida$5/M
$2.5 · GPT-4o Transcribe Diarize GPT-4o Transcribe · $10

La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.

Especificaciones y límites

Tokens

Salida máxima (especificación del proveedor) 2000
Corte de conocimiento 2024-06

Audio

Idiomas 57 idiomas listados para el endpoint de transcriptions (una única lista compartida por todos los modelos de transcripción); se aceptan códigos ISO 639-1 / 639-3 para los modelos basados en GPT-4o
Límites de audio
  • mp3/mp4/mpeg/mpga/m4a/wav/webm, hasta 25MB
  • transcripción en streaming admitida
  • salida solo en json/text
  • sin marcas de tiempo por palabra ni diarización
Diarización No
Transcripción en streaming
Marcas de tiempo No

Modelo

Modalidades audio + texto → texto

Nivel económico de la transcripción de GPT-4o.

según documentación oficial de OpenAI ↗

Use GPT-4o Mini Transcribe en 30 segundos

Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="gpt-4o-mini-transcribe",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Acerca de GPT-4o Mini Transcribe

  • Es la opción rentable de la línea de transcripción de OpenAI, con un precio equivalente a la mitad de la tarifa de entrada de audio de GPT-4o Transcribe, una ventana de contexto de 16K tokens y hasta 2K tokens de salida por solicitud.
  • Comparte el marco operativo de la familia: archivos mp3, mp4, mpeg, mpga, m4a, wav o webm de hasta 25MB, transcripción en streaming, inyección de contexto basada en prompt para nombres y vocabulario de dominio, y probabilidades logarítmicas bajo petición, con salida limitada a JSON o texto plano y sin granularidades de marcas de tiempo.
  • Dos cambios justifican fijar una instantánea.
  • OpenAI trasladó el alias sin fecha a una instantánea de diciembre de 2025, de modo que las integraciones que nunca fijaron una versión cambiaron de modelo en silencio, y la instantánea original de marzo de 2025 ha quedado desde entonces programada para su retirada.
  • El soporte de la Batch API se añadió a principios de 2026, lo que abarata el vaciado de grandes acumulaciones offline.
  • Como su hermano mayor, se sirve tanto en el endpoint de transcripción como en las sesiones de transcripción realtime, cubre la lista publicada de más de setenta idiomas de la API de transcripción y lleva una fecha de corte de conocimiento de junio de 2024.
  • Encaja con canalizaciones de transcripción de alto volumen donde la precisión sigue importando pero el coste de audio por token decide la arquitectura, y donde no se requiere una transcripción con diarización ni tiempos de subtítulos.
  • Synthorai lo gestiona a través del endpoint de transcripción de audio compatible con OpenAI.

Preguntas frecuentes

¿Se puede probar gratis la API de GPT-4o Mini Transcribe?

Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. Suficiente para probar GPT-4o Mini Transcribe con su carga de trabajo real antes de añadir un método de pago.

¿En qué destaca GPT-4o Mini Transcribe?

Tasa de error por palabra mejorada sobre el Whisper original; la mitad de la tarifa de audio del nivel premium; 16K de contexto con hasta 2K de salida. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.

¿Cuánto cuesta GPT-4o Mini Transcribe?

GPT-4o Mini Transcribe cuesta $1.25 por millón de tokens de entrada y $5 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.

¿Qué idiomas admite GPT-4o Mini Transcribe?

GPT-4o Mini Transcribe admite 57 idiomas listados para el endpoint de transcriptions (una única lista compartida por todos los modelos de transcripción); se aceptan códigos ISO 639-1 / 639-3 para los modelos basados en GPT-4o. En Synthorai se invoca mediante POST /v1/audio/transcriptions, el formato de la API de transcripción de OpenAI.

¿Cómo obtengo acceso a GPT-4o Mini Transcribe?

Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gpt-4o-mini-transcribe" y listo. Una sola clave API cubre todos los modelos del gateway.

Modelos relacionados

Comparar

Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.

Obtén tu clave API Compare su costo →