Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

GPT-4o Mini Transcribe

Veröffentlicht 2025-03-20

transcription

GPT-4o Mini Transcribe ist ein Speech-to-Text-Modell auf Basis von GPT-4o mini, das Verbesserungen bei der Wortfehlerrate sowie bessere Spracherkennung und Genauigkeit gegenüber den ursprünglichen Whisper-Modellen bietet.

Eingabe
Audio Text $1.25/M
Ausgabe
Text $5/M
Audio-Input
$3/M
Kontext
16K
Knowledge Cutoff
2024-06

Benchmarks

GPT-4o Mini Transcribe: 33 veröffentlicht, aber kein Benchmark, den genug andere Modelle teilen.

GPT-4o Mini Transcribe weitere gemessene Modelle Durchschnitt der Vergleichsmodelle kein anderes Modell war besser
FLEURS Arabic (WER)
14.06%

Herstellerangaben: OpenAI

Preis im Vergleich

Preisposition unter 3 vergleichbaren Modellen

Eingabe$1.25/M
$1.25 · GPT-4o Mini Transcribe GPT-4o Transcribe · $2.5
Ausgabe$5/M
$2.5 · GPT-4o Transcribe Diarize GPT-4o Transcribe · $10

Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.

Spezifikationen & Limits

Tokens

Max. Output (Anbieter-Spezifikation) 2.000
Knowledge Cutoff 2024-06

Audio

Sprachen 57 Sprachen für den Transkriptions-Endpoint gelistet (eine gemeinsame Liste für alle Transkriptionsmodelle); ISO-639-1- / 639-3-Codes werden für GPT-4o-basierte Modelle akzeptiert
Audio-Limits
  • mp3/mp4/mpeg/mpga/m4a/wav/webm, bis 25MB
  • Streaming-Transkription unterstützt
  • nur json/text als Output
  • keine Wort-Zeitstempel und keine Diarisierung
Sprecher-Diarisierung Nein
Streaming-Transkription Ja
Zeitstempel Nein

Modell

Modalitäten Audio + Text → Text

Kosteneffiziente Stufe der GPT-4o-Transkription.

laut Offizielle OpenAI-Dokumentation ↗

GPT-4o Mini Transcribe in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/audio/transcriptions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="gpt-4o-mini-transcribe",
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Über GPT-4o Mini Transcribe

  • Es ist die kostengünstige Option in OpenAIs Transkriptionsreihe, bepreist mit der Hälfte des Audio-Input-Satzes von GPT-4o Transcribe, mit einem Kontextfenster von 16K Token und bis zu 2K Output-Token pro Anfrage.
  • Es teilt den Betriebsrahmen der Familie: mp3-, mp4-, mpeg-, mpga-, m4a-, wav- oder webm-Dateien bis 25MB, Streaming-Transkription, promptbasierte Kontexteinspeisung für Namen und Fachvokabular sowie Log-Probabilities auf Anfrage, wobei die Ausgabe auf JSON oder reinen Text beschränkt ist und es keine Zeitstempel-Granularitäten gibt.
  • Zwei Änderungen sind Grund genug, einen Snapshot anzupinnen.
  • OpenAI verschob den undatierten Alias auf einen Snapshot vom Dezember 2025, sodass Integrationen, die nie eine Version angepinnt hatten, stillschweigend das Modell wechselten, und für den ursprünglichen Snapshot vom März 2025 wurde inzwischen die Abschaltung angesetzt.
  • Anfang 2026 kam Unterstützung für die Batch API hinzu, was das Abarbeiten großer Offline-Rückstände günstiger macht.
  • Wie sein größeres Geschwistermodell wird es sowohl auf dem Transkriptions-Endpoint als auch in Realtime-Transkriptionssitzungen bereitgestellt, deckt die veröffentlichte Liste der Transkriptions-API von mehr als siebzig Sprachen ab und trägt einen Knowledge Cutoff vom Juni 2024.
  • Es eignet sich für Transkriptionspipelines mit hohem Volumen, in denen Genauigkeit weiterhin zählt, die Audiokosten pro Token aber über die Architektur entscheiden und weder ein diarisiertes Transkript noch Untertitel-Timings verlangt sind.
  • Synthorai verarbeitet es über den OpenAI-kompatiblen Endpoint für Audio-Transkription.

FAQ

Lässt sich die GPT-4o Mini Transcribe API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Das reicht, um GPT-4o Mini Transcribe mit Ihrem realen Workload auszuprobieren, bevor Sie eine Zahlungsmethode hinterlegen.

Worin ist GPT-4o Mini Transcribe am besten?

Bessere Wortfehlerrate als das ursprüngliche Whisper; halbe Audio-Input-Rate der Premium-Stufe; 16K Kontext mit bis zu 2K Output. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet GPT-4o Mini Transcribe?

GPT-4o Mini Transcribe kostet auf Synthorai $1.25 pro Million Input-Tokens und $5 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag.

Welche Sprachen unterstützt GPT-4o Mini Transcribe?

GPT-4o Mini Transcribe unterstützt 57 Sprachen für den Transkriptions-Endpoint gelistet (eine gemeinsame Liste für alle Transkriptionsmodelle); ISO-639-1- / 639-3-Codes werden für GPT-4o-basierte Modelle akzeptiert. Auf Synthorai rufen Sie das Modell über POST /v1/audio/transcriptions auf, das OpenAI-Transkriptions-API-Format.

Wie erhalte ich Zugang zu GPT-4o Mini Transcribe?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gpt-4o-mini-transcribe", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Verwandte Modelle

Vergleichen

Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.

API-Schlüssel abrufen Ihre Kosten vergleichen →