GPT-4o Mini Transcribe ist ein Speech-to-Text-Modell auf Basis von GPT-4o mini, das Verbesserungen bei der Wortfehlerrate sowie bessere Spracherkennung und Genauigkeit gegenüber den ursprünglichen Whisper-Modellen bietet.
- Eingabe
- Audio Text $1.25/M
- Ausgabe
- Text $5/M
- Audio-Input
- $3/M
- Kontext
- 16K
- Knowledge Cutoff
- 2024-06
Benchmarks
GPT-4o Mini Transcribe: 33 veröffentlicht, aber kein Benchmark, den genug andere Modelle teilen.
Herstellerangaben: OpenAI
Preis im Vergleich
Preisposition unter 3 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Tokens
| Max. Output (Anbieter-Spezifikation) | 2.000 |
|---|---|
| Knowledge Cutoff | 2024-06 |
Audio
| Sprachen | 57 Sprachen für den Transkriptions-Endpoint gelistet (eine gemeinsame Liste für alle Transkriptionsmodelle); ISO-639-1- / 639-3-Codes werden für GPT-4o-basierte Modelle akzeptiert |
|---|---|
| Audio-Limits |
|
| Sprecher-Diarisierung | Nein |
| Streaming-Transkription | Ja |
| Zeitstempel | Nein |
Modell
| Modalitäten | Audio + Text → Text |
|---|
Kosteneffiziente Stufe der GPT-4o-Transkription.
GPT-4o Mini Transcribe in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/audio/transcriptions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.audio.transcriptions.create(
model="gpt-4o-mini-transcribe",
file=open("meeting.mp3", "rb"),
language="en",
)
print(resp.text)import OpenAI from "openai";
import fs from "node:fs";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.audio.transcriptions.create({
model: "gpt-4o-mini-transcribe",
file: fs.createReadStream("meeting.mp3"),
});
console.log(resp.text);curl https://synthorai.io/v1/audio/transcriptions \
-H "Authorization: Bearer sk-syn-..." \
-F model="gpt-4o-mini-transcribe" \
-F file=@meeting.mp3package main
import (
"context"
"fmt"
"os"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
f, _ := os.Open("meeting.mp3")
resp, _ := client.Audio.Transcriptions.New(context.TODO(), openai.AudioTranscriptionNewParams{
Model: "gpt-4o-mini-transcribe",
File: f,
})
fmt.Println(resp.Text)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.audio.transcriptions.*;
import java.nio.file.Paths;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
Transcription resp = client.audio().transcriptions().create(
TranscriptionCreateParams.builder()
.model("gpt-4o-mini-transcribe")
.file(Paths.get("meeting.mp3"))
.build()).asTranscription();
System.out.println(resp.text());Über GPT-4o Mini Transcribe
- Es ist die kostengünstige Option in OpenAIs Transkriptionsreihe, bepreist mit der Hälfte des Audio-Input-Satzes von GPT-4o Transcribe, mit einem Kontextfenster von 16K Token und bis zu 2K Output-Token pro Anfrage.
- Es teilt den Betriebsrahmen der Familie: mp3-, mp4-, mpeg-, mpga-, m4a-, wav- oder webm-Dateien bis 25MB, Streaming-Transkription, promptbasierte Kontexteinspeisung für Namen und Fachvokabular sowie Log-Probabilities auf Anfrage, wobei die Ausgabe auf JSON oder reinen Text beschränkt ist und es keine Zeitstempel-Granularitäten gibt.
- Zwei Änderungen sind Grund genug, einen Snapshot anzupinnen.
- OpenAI verschob den undatierten Alias auf einen Snapshot vom Dezember 2025, sodass Integrationen, die nie eine Version angepinnt hatten, stillschweigend das Modell wechselten, und für den ursprünglichen Snapshot vom März 2025 wurde inzwischen die Abschaltung angesetzt.
- Anfang 2026 kam Unterstützung für die Batch API hinzu, was das Abarbeiten großer Offline-Rückstände günstiger macht.
- Wie sein größeres Geschwistermodell wird es sowohl auf dem Transkriptions-Endpoint als auch in Realtime-Transkriptionssitzungen bereitgestellt, deckt die veröffentlichte Liste der Transkriptions-API von mehr als siebzig Sprachen ab und trägt einen Knowledge Cutoff vom Juni 2024.
- Es eignet sich für Transkriptionspipelines mit hohem Volumen, in denen Genauigkeit weiterhin zählt, die Audiokosten pro Token aber über die Architektur entscheiden und weder ein diarisiertes Transkript noch Untertitel-Timings verlangt sind.
- Synthorai verarbeitet es über den OpenAI-kompatiblen Endpoint für Audio-Transkription.
FAQ
Lässt sich die GPT-4o Mini Transcribe API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Das reicht, um GPT-4o Mini Transcribe mit Ihrem realen Workload auszuprobieren, bevor Sie eine Zahlungsmethode hinterlegen.
Worin ist GPT-4o Mini Transcribe am besten?
Bessere Wortfehlerrate als das ursprüngliche Whisper; halbe Audio-Input-Rate der Premium-Stufe; 16K Kontext mit bis zu 2K Output. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet GPT-4o Mini Transcribe?
GPT-4o Mini Transcribe kostet auf Synthorai $1.25 pro Million Input-Tokens und $5 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag.
Welche Sprachen unterstützt GPT-4o Mini Transcribe?
GPT-4o Mini Transcribe unterstützt 57 Sprachen für den Transkriptions-Endpoint gelistet (eine gemeinsame Liste für alle Transkriptionsmodelle); ISO-639-1- / 639-3-Codes werden für GPT-4o-basierte Modelle akzeptiert. Auf Synthorai rufen Sie das Modell über POST /v1/audio/transcriptions auf, das OpenAI-Transkriptions-API-Format.
Wie erhalte ich Zugang zu GPT-4o Mini Transcribe?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gpt-4o-mini-transcribe", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.