GPT-4o Mini Transcribe es un modelo de voz a texto impulsado por GPT-4o mini, que ofrece mejoras en la tasa de error por palabra y un mejor reconocimiento y precisión de idiomas en comparación con los modelos Whisper originales.
- Entrada
- audio texto $1.25/M
- Salida
- texto $5/M
- Entrada de audio
- $3/M
- Contexto
- 16K
- Corte de conocimiento
- 2024-06
Benchmarks
GPT-4o Mini Transcribe: 33 publicados, pero ningún benchmark compartido con suficientes modelos para comparar.
Publicado por los proveedores: OpenAI
El precio en contexto
Posición del precio entre 3 modelos comparables
La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.
Especificaciones y límites
Tokens
| Salida máxima (especificación del proveedor) | 2000 |
|---|---|
| Corte de conocimiento | 2024-06 |
Audio
| Idiomas | 57 idiomas listados para el endpoint de transcriptions (una única lista compartida por todos los modelos de transcripción); se aceptan códigos ISO 639-1 / 639-3 para los modelos basados en GPT-4o |
|---|---|
| Límites de audio |
|
| Diarización | No |
| Transcripción en streaming | Sí |
| Marcas de tiempo | No |
Modelo
| Modalidades | audio + texto → texto |
|---|
Nivel económico de la transcripción de GPT-4o.
Use GPT-4o Mini Transcribe en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/audio/transcriptions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="gpt-4o-mini-transcribe",
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "gpt-4o-mini-transcribe",
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="gpt-4o-mini-transcribe" \
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "gpt-4o-mini-transcribe",
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("gpt-4o-mini-transcribe")
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());Acerca de GPT-4o Mini Transcribe
- Es la opción rentable de la línea de transcripción de OpenAI, con un precio equivalente a la mitad de la tarifa de entrada de audio de GPT-4o Transcribe, una ventana de contexto de 16K tokens y hasta 2K tokens de salida por solicitud.
- Comparte el marco operativo de la familia: archivos mp3, mp4, mpeg, mpga, m4a, wav o webm de hasta 25MB, transcripción en streaming, inyección de contexto basada en prompt para nombres y vocabulario de dominio, y probabilidades logarítmicas bajo petición, con salida limitada a JSON o texto plano y sin granularidades de marcas de tiempo.
- Dos cambios justifican fijar una instantánea.
- OpenAI trasladó el alias sin fecha a una instantánea de diciembre de 2025, de modo que las integraciones que nunca fijaron una versión cambiaron de modelo en silencio, y la instantánea original de marzo de 2025 ha quedado desde entonces programada para su retirada.
- El soporte de la Batch API se añadió a principios de 2026, lo que abarata el vaciado de grandes acumulaciones offline.
- Como su hermano mayor, se sirve tanto en el endpoint de transcripción como en las sesiones de transcripción realtime, cubre la lista publicada de más de setenta idiomas de la API de transcripción y lleva una fecha de corte de conocimiento de junio de 2024.
- Encaja con canalizaciones de transcripción de alto volumen donde la precisión sigue importando pero el coste de audio por token decide la arquitectura, y donde no se requiere una transcripción con diarización ni tiempos de subtítulos.
- Synthorai lo gestiona a través del endpoint de transcripción de audio compatible con OpenAI.
Preguntas frecuentes
¿Se puede probar gratis la API de GPT-4o Mini Transcribe?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. Suficiente para probar GPT-4o Mini Transcribe con su carga de trabajo real antes de añadir un método de pago.
¿En qué destaca GPT-4o Mini Transcribe?
Tasa de error por palabra mejorada sobre el Whisper original; la mitad de la tarifa de audio del nivel premium; 16K de contexto con hasta 2K de salida. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta GPT-4o Mini Transcribe?
GPT-4o Mini Transcribe cuesta $1.25 por millón de tokens de entrada y $5 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.
¿Qué idiomas admite GPT-4o Mini Transcribe?
GPT-4o Mini Transcribe admite 57 idiomas listados para el endpoint de transcriptions (una única lista compartida por todos los modelos de transcripción); se aceptan códigos ISO 639-1 / 639-3 para los modelos basados en GPT-4o. En Synthorai se invoca mediante POST /v1/audio/transcriptions, el formato de la API de transcripción de OpenAI.
¿Cómo obtengo acceso a GPT-4o Mini Transcribe?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gpt-4o-mini-transcribe" y listo. Una sola clave API cubre todos los modelos del gateway.
Modelos relacionados
Comparar
Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.