GPT-4o Mini Transcribe è un modello speech-to-text alimentato da GPT-4o mini, che offre miglioramenti nel word error rate e un riconoscimento e un'accuratezza linguistica migliori rispetto ai modelli Whisper originali.
- Input
- audio testo $1.25/M
- Output
- testo $5/M
- Input audio
- $3/M
- Contesto
- 16K
- Cutoff di conoscenza
- 2024-06
Benchmark
GPT-4o Mini Transcribe: 33 pubblicati, ma nessun benchmark condiviso con abbastanza modelli per confrontare.
Dati pubblicati dai fornitori: OpenAI
Il prezzo nel contesto
Posizione del prezzo tra 3 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Output massimo (specifica del vendor) | 2.000 |
|---|---|
| Cutoff di conoscenza | 2024-06 |
Audio
| Lingue | 57 lingue elencate per l'endpoint di trascrizione (un unico elenco condiviso da tutti i modelli di trascrizione); codici ISO 639-1 / 639-3 accettati per i modelli basati su GPT-4o |
|---|---|
| Limiti audio |
|
| Diarizzazione | No |
| Trascrizione in streaming | Sì |
| Timestamp | No |
Modello
| Modalità | audio + testo → testo |
|---|
Livello economico della trascrizione GPT-4o.
Usa GPT-4o Mini Transcribe in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/audio/transcriptions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="gpt-4o-mini-transcribe",
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "gpt-4o-mini-transcribe",
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="gpt-4o-mini-transcribe" \
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "gpt-4o-mini-transcribe",
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("gpt-4o-mini-transcribe")
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());Informazioni su GPT-4o Mini Transcribe
- È l'opzione economica della lineup di trascrizione di OpenAI, con un prezzo pari alla metà della tariffa di input audio di GPT-4o Transcribe, una finestra di contesto da 16K token e fino a 2K token di output per richiesta.
- Condivide l'inviluppo operativo della famiglia: file mp3, mp4, mpeg, mpga, m4a, wav o webm fino a 25MB, trascrizione in streaming, iniezione di contesto tramite prompt per nomi e vocabolario di dominio e log probability su richiesta, con output limitato a JSON o testo semplice e senza granularità dei timestamp.
- Due cambiamenti rendono opportuno fissare uno snapshot.
- OpenAI ha spostato l'alias senza data su uno snapshot di dicembre 2025, quindi le integrazioni che non avevano mai fissato una versione hanno cambiato modello silenziosamente, e lo snapshot originale di marzo 2025 è stato da allora messo in calendario per il ritiro.
- Il supporto per la Batch API è stato aggiunto all'inizio del 2026, il che rende più economico smaltire grandi arretrati offline.
- Come il fratello maggiore è servito sia sull'endpoint di trascrizione sia sulle sessioni di trascrizione realtime, copre l'elenco pubblicato dalla transcription API di più di settanta lingue e porta un cutoff di conoscenza a giugno 2024.
- Si adatta a pipeline di trascrizione ad alto volume dove l'accuratezza conta ancora ma è il costo audio per token a decidere l'architettura, e dove non servono un trascritto diarizzato o i tempi dei sottotitoli.
- Synthorai lo gestisce tramite l'endpoint di trascrizione audio compatibile OpenAI.
FAQ
L'API di GPT-4o Mini Transcribe si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare GPT-4o Mini Transcribe sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.
In cosa eccelle GPT-4o Mini Transcribe?
Tasso di errore sulle parole migliorato rispetto a Whisper originale; metà della tariffa di input audio del livello premium; contesto da 16K con fino a 2K di output. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa GPT-4o Mini Transcribe?
Su Synthorai, GPT-4o Mini Transcribe costa $1.25 per milione di token in input e $5 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma.
Quali lingue supporta GPT-4o Mini Transcribe?
GPT-4o Mini Transcribe supporta 57 lingue elencate per l'endpoint di trascrizione (un unico elenco condiviso da tutti i modelli di trascrizione); codici ISO 639-1 / 639-3 accettati per i modelli basati su GPT-4o. Su Synthorai lo chiami via POST /v1/audio/transcriptions, lo stesso formato dell'API di trascrizione di OpenAI.
Come ottengo l'accesso a GPT-4o Mini Transcribe?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-4o-mini-transcribe" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.