🎁 Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

GPT-4o Mini Transcribe vs GPT-4o Transcribe

vs

Quale scegliere e quando — verdetto curato, non una tabella di benchmark

Il livello mini dimezza all'incirca il conto — $1.25 per milione in ingresso testo, $5 in uscita e $3 per milione di audio in ingresso contro $2.5, $10 e $6 — a parità di tetto di 25MB per file, elenco di 57 lingue, contesto da 16000 token e uscita solo json/text, senza timestamp né diarizzazione su entrambi. Nient'altro nelle specifiche pubblicate li separa, quindi scegli gpt-4o-mini-transcribe a meno che tu non abbia misurato una differenza sul tuo audio.

Prezzi

GPT-4o Mini Transcribe GPT-4o Transcribe Δ
Input audio / 1M token $3 $6 0.5×
Output di testo / 1M token $5 $10 0.5×

Le tariffe provengono dal catalogo live al momento della build; la pagina di ciascun modello riporta la scheda attuale.

Capacità

GPT-4o Mini Transcribe GPT-4o Transcribe
Diarizzazione dei parlanti no no
Streaming
Timestamp no no

Specifiche

GPT-4o Mini Transcribe GPT-4o Transcribe
Modalità di input testo audio testo audio
Modalità di output testo testo
Rilascio 2025-03-20 2025-03-20
Cutoff di conoscenza 2024-06 2024-06
Limiti

mp3/mp4/mpeg/mpga/m4a/wav/webm, up to 25MB

streaming transcription supported

json/text output only

no word timestamps or diarization

mp3/mp4/mpeg/mpga/m4a/wav/webm, up to 25MB

streaming transcription supported (incl. Realtime transcription sessions)

json/text output only

no word timestamps or diarization

Lingue

57 languages listed for the transcriptions endpoint (one shared list for all transcription models)

ISO 639-1 / 639-3 codes accepted for GPT-4o-based models

57 languages listed for the transcriptions endpoint (one shared list for all transcription models)

ISO 639-1 / 639-3 codes accepted for GPT-4o-based models

Output massimo 2K 2K

Le specifiche sono trascritte dalla documentazione di ciascun fornitore; una riga che un fornitore non pubblica viene omessa anziché essere dedotta. Fonti complete: GPT-4o Mini Transcribe · GPT-4o Transcribe

Passa dall'uno all'altro con una sola riga

Entrambi gli id sono presenti in ogni scheda qui sotto — la coppia di righe evidenziata è l'unica modifica. Stesso endpoint, stessa chiave, stessa struttura della richiesta.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="gpt-4o-mini-transcribe",
    # model="gpt-4o-transcribe",  # decommenta questa riga, commenta quella sopra
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Ottieni una chiave API →

FAQ

Qual è più economico, GPT-4o Mini Transcribe o GPT-4o Transcribe?

GPT-4o Mini Transcribe è più economico per input audio / 1m token ($3 contro $6, 2.0× di differenza). Altre righe potrebbero indicare il contrario — la tabella sopra riporta la scheda completa, e il costo reale dipende dal tuo mix.

Posso fare un A/B test di GPT-4o Mini Transcribe contro GPT-4o Transcribe senza due integrazioni?

Sì. Entrambi sono serviti tramite lo stesso endpoint compatibile con OpenAI con una singola chiave API — il passaggio richiede la modifica della stringa del modello in una sola riga, quindi puoi instradare una frazione del traffico verso ciascuno e confrontare direttamente le fatture.

GPT-4o Mini Transcribe e GPT-4o Transcribe supportano la diarizzazione dei parlanti?

La tabella delle funzionalità sopra risponde a questa domanda per ogni modello, direttamente dalla documentazione di ciascun fornitore — diarizzazione, streaming e timestamp sono elencati separatamente perché i modelli differiscono su tutti e tre.

Confronti correlati

Dai nostri studi misurati