Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

GPT-4o Mini Transcribe

Rilasciato 2025-03-20

transcription

GPT-4o Mini Transcribe è un modello speech-to-text alimentato da GPT-4o mini, che offre miglioramenti nel word error rate e un riconoscimento e un'accuratezza linguistica migliori rispetto ai modelli Whisper originali.

Input
audio testo $1.25/M
Output
testo $5/M
Input audio
$3/M
Contesto
16K
Cutoff di conoscenza
2024-06

Benchmark

GPT-4o Mini Transcribe: 33 pubblicati, ma nessun benchmark condiviso con abbastanza modelli per confrontare.

GPT-4o Mini Transcribe altri modelli misurati media dei modelli confrontati nessun altro modello ha fatto meglio
FLEURS Arabic (WER)
14.06%

Dati pubblicati dai fornitori: OpenAI

Il prezzo nel contesto

Posizione del prezzo tra 3 modelli comparabili

Input$1.25/M
$1.25 · GPT-4o Mini Transcribe GPT-4o Transcribe · $2.5
Output$5/M
$2.5 · GPT-4o Transcribe Diarize GPT-4o Transcribe · $10

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Token

Output massimo (specifica del vendor) 2.000
Cutoff di conoscenza 2024-06

Audio

Lingue 57 lingue elencate per l'endpoint di trascrizione (un unico elenco condiviso da tutti i modelli di trascrizione); codici ISO 639-1 / 639-3 accettati per i modelli basati su GPT-4o
Limiti audio
  • mp3/mp4/mpeg/mpga/m4a/wav/webm, fino a 25MB
  • trascrizione in streaming supportata
  • solo output json/text
  • nessun timestamp di parola né diarizzazione
Diarizzazione No
Trascrizione in streaming
Timestamp No

Modello

Modalità audio + testo → testo

Livello economico della trascrizione GPT-4o.

fonte: documentazione ufficiale OpenAI ↗

Usa GPT-4o Mini Transcribe in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="gpt-4o-mini-transcribe",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Informazioni su GPT-4o Mini Transcribe

  • È l'opzione economica della lineup di trascrizione di OpenAI, con un prezzo pari alla metà della tariffa di input audio di GPT-4o Transcribe, una finestra di contesto da 16K token e fino a 2K token di output per richiesta.
  • Condivide l'inviluppo operativo della famiglia: file mp3, mp4, mpeg, mpga, m4a, wav o webm fino a 25MB, trascrizione in streaming, iniezione di contesto tramite prompt per nomi e vocabolario di dominio e log probability su richiesta, con output limitato a JSON o testo semplice e senza granularità dei timestamp.
  • Due cambiamenti rendono opportuno fissare uno snapshot.
  • OpenAI ha spostato l'alias senza data su uno snapshot di dicembre 2025, quindi le integrazioni che non avevano mai fissato una versione hanno cambiato modello silenziosamente, e lo snapshot originale di marzo 2025 è stato da allora messo in calendario per il ritiro.
  • Il supporto per la Batch API è stato aggiunto all'inizio del 2026, il che rende più economico smaltire grandi arretrati offline.
  • Come il fratello maggiore è servito sia sull'endpoint di trascrizione sia sulle sessioni di trascrizione realtime, copre l'elenco pubblicato dalla transcription API di più di settanta lingue e porta un cutoff di conoscenza a giugno 2024.
  • Si adatta a pipeline di trascrizione ad alto volume dove l'accuratezza conta ancora ma è il costo audio per token a decidere l'architettura, e dove non servono un trascritto diarizzato o i tempi dei sottotitoli.
  • Synthorai lo gestisce tramite l'endpoint di trascrizione audio compatibile OpenAI.

FAQ

L'API di GPT-4o Mini Transcribe si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare GPT-4o Mini Transcribe sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.

In cosa eccelle GPT-4o Mini Transcribe?

Tasso di errore sulle parole migliorato rispetto a Whisper originale; metà della tariffa di input audio del livello premium; contesto da 16K con fino a 2K di output. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa GPT-4o Mini Transcribe?

Su Synthorai, GPT-4o Mini Transcribe costa $1.25 per milione di token in input e $5 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma.

Quali lingue supporta GPT-4o Mini Transcribe?

GPT-4o Mini Transcribe supporta 57 lingue elencate per l'endpoint di trascrizione (un unico elenco condiviso da tutti i modelli di trascrizione); codici ISO 639-1 / 639-3 accettati per i modelli basati su GPT-4o. Su Synthorai lo chiami via POST /v1/audio/transcriptions, lo stesso formato dell'API di trascrizione di OpenAI.

Come ottengo l'accesso a GPT-4o Mini Transcribe?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-4o-mini-transcribe" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →