GPT-4o Mini Transcribe est un modèle speech-to-text propulsé par GPT-4o mini, offrant des améliorations du taux d'erreur sur les mots ainsi qu'une meilleure reconnaissance et une meilleure précision linguistiques par rapport aux modèles Whisper d'origine.
- Entrée
- audio texte $1.25/M
- Sortie
- texte $5/M
- Entrée audio
- $3/M
- Contexte
- 16K
- Coupure des connaissances
- 2024-06
Benchmarks
GPT-4o Mini Transcribe : 33 publiés, mais aucun benchmark partagé avec assez de modèles pour comparer.
Chiffres publiés par les fournisseurs : OpenAI
Le prix en contexte
Position du prix parmi 3 modèles comparables
La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.
Spécifications et limites
Tokens
| Sortie max (spéc. fournisseur) | 2 000 |
|---|---|
| Coupure des connaissances | 2024-06 |
Audio
| Langues | 57 langues listées pour l'endpoint de transcriptions (une liste unique partagée par tous les modèles de transcription) ; codes ISO 639-1 / 639-3 acceptés pour les modèles basés sur GPT-4o |
|---|---|
| Limites audio |
|
| Diarisation | Non |
| Transcription en streaming | Oui |
| Horodatages | Non |
Modèle
| Modalités | audio + texte → texte |
|---|
Palier économique de la transcription GPT-4o.
Utilisez GPT-4o Mini Transcribe en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/audio/transcriptions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="gpt-4o-mini-transcribe",
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "gpt-4o-mini-transcribe",
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="gpt-4o-mini-transcribe" \
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "gpt-4o-mini-transcribe",
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("gpt-4o-mini-transcribe")
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());À propos de GPT-4o Mini Transcribe
- C'est l'option économique de la gamme de transcription d'OpenAI, facturée à la moitié du tarif d'entrée audio de GPT-4o Transcribe, avec une fenêtre de contexte de 16K tokens et jusqu'à 2K tokens de sortie par requête.
- Il partage l'enveloppe opérationnelle de la famille : fichiers mp3, mp4, mpeg, mpga, m4a, wav ou webm jusqu'à 25 Mo, transcription en streaming, injection de contexte par prompt pour les noms propres et le vocabulaire métier, et probabilités logarithmiques sur demande, la sortie se limitant à du JSON ou du texte brut, sans granularités d'horodatage.
- Deux changements justifient d'épingler un snapshot.
- OpenAI a déplacé l'alias non daté vers un snapshot de décembre 2025, si bien que les intégrations qui n'avaient jamais épinglé de version ont changé de modèle sans bruit, et le snapshot initial de mars 2025 a depuis été programmé pour retrait.
- La prise en charge de la Batch API a été ajoutée début 2026, ce qui rend moins coûteux l'écoulement de grands arriérés hors ligne.
- Comme son grand frère, il est servi à la fois sur l'endpoint de transcription et sur les sessions de transcription temps réel, couvre la liste publiée par l'API de transcription de plus de soixante-dix langues, et porte une date limite des connaissances en juin 2024.
- Il convient aux pipelines de transcription à fort volume où la précision compte encore mais où le coût audio au token décide de l'architecture, et où un transcript diarisé ou des timings de sous-titres ne sont pas nécessaires.
- Synthorai le prend en charge via l'endpoint de transcription audio compatible OpenAI.
FAQ
Peut-on essayer l'API GPT-4o Mini Transcribe gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. De quoi essayer GPT-4o Mini Transcribe sur votre charge de travail réelle avant d'ajouter un moyen de paiement.
Quels sont les points forts de GPT-4o Mini Transcribe ?
Taux d'erreur sur les mots amélioré par rapport à Whisper d'origine ; moitié du tarif d'entrée audio du palier premium ; contexte de 16K avec jusqu'à 2K en sortie. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte GPT-4o Mini Transcribe ?
Sur Synthorai, GPT-4o Mini Transcribe coûte $1.25 par million de tokens en entrée et $5 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme.
Quelles langues GPT-4o Mini Transcribe prend-il en charge ?
GPT-4o Mini Transcribe prend en charge 57 langues listées pour l'endpoint de transcriptions (une liste unique partagée par tous les modèles de transcription) ; codes ISO 639-1 / 639-3 acceptés pour les modèles basés sur GPT-4o. Sur Synthorai, vous l'appelez via POST /v1/audio/transcriptions, le format de l'API de transcription d'OpenAI.
Comment obtenir l'accès à GPT-4o Mini Transcribe ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="gpt-4o-mini-transcribe", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.
Modèles associés
Comparer
Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.