TTS-1 HD ist OpenAIs auf Qualität optimiertes Text-to-Speech-Modell, die hochwertigere Hälfte des Paares, das es mit tts-1 bildet.
- Eingabe
- Text $30/M
- Ausgabe
- Audio
- Kontext
- 4K
Preis im Vergleich
Preisposition unter 7 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Sprachsynthese
| Synthesesprachen | Folgt im Wesentlichen der Sprachunterstützung des Whisper-Modells: Afrikaans, Arabisch, Armenisch, Aserbaidschanisch, Belarussisch, Bosnisch, Bulgarisch, Katalanisch, Chinesisch, Kroatisch, Tschechisch, Dänisch, Niederländisch, Englisch, Estnisch, Finnisch, Französisch, Galicisch, Deutsch, Griechisch, Hebräisch, Hindi, Ungarisch, Isländisch, Indonesisch, Italienisch, Japanisch, Kannada, Kasachisch, Koreanisch, Lettisch, Litauisch, Mazedonisch, Malaiisch, Marathi, Maori, Nepalesisch, Norwegisch, Persisch, Polnisch, Portugiesisch, Rumänisch, Russisch, Serbisch, Slowakisch, Slowenisch, Spanisch, Suaheli, Schwedisch, Tagalog, Tamil, Thailändisch, Türkisch, Ukrainisch, Urdu, Vietnamesisch und Walisisch, obwohl die Stimmen auf Englisch optimiert sind |
|---|---|
| Stimmen | alloy, ash, coral, echo, fable, onyx, nova, sage und shimmer, eine kleinere Auswahl als die vollständige TTS-Liste mit 13 Stimmen, und die Stimmen sind derzeit auf Englisch optimiert. |
| Eingabelimit | 4,096 Zeichen Anbieter geben dieses Limit in unterschiedlichen Einheiten an: Bei nicht lateinischem Text ist ein Byte-Limit kein Zeichen-Limit. |
| Streaming-Synthese | Ja |
| SSML | Nicht dokumentiert |
| Stimmsteuerung | Bei diesem Modell nicht verfügbar |
| Abrechnungseinheit | Pro Eingabezeichen |
| Endpunkte und Formate |
|
Modell
| Modalitäten | Text → Audio |
|---|
Auf Qualität optimiertes Text-to-Speech-Modell: derselbe Speech-Endpoint wie tts-1, abgestimmt auf hochwertige statt latenzarme Anwendungsfälle. Der instructions-Parameter, der bei gpt-4o-mini-tts Akzent, Emotion, Intonation und Tonfall steuert, funktioniert bei tts-1 und tts-1-hd nicht.
TTS-1 HD in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="tts-1-hd",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "tts-1-hd",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "tts-1-hd",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("tts-1-hd")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Über TTS-1 HD
- Die Modellseite rahmt es als Umwandlung von Text in natürlich klingende gesprochene Sprache für hochwertige Text-to-Speech-Anwendungsfälle, und der Leitfaden benennt den Kompromiss direkt: tts-1 bietet niedrigere Latenz, aber bei geringerer Qualität als tts-1-hd.
- Diese zusätzliche Qualität ist der ganze Unterschied, und sie ist entsprechend mit $30 pro Million Zeichen bepreist, dem Doppelten des tts-1-Satzes, was es zur Wahl für Erzählstimmen, veröffentlichtes Audio und alles macht, was ein Zuhörer mehr als einmal hört, statt für interaktive Sprache Zug um Zug.
- Alles Übrige teilt es mit seinem Geschwistermodell.
- Es bedient nur den Speech-Endpoint der Audio API, nimmt Text entgegen und gibt Audio zurück, mit denselben neun Stimmen (alloy, ash, coral, echo, fable, onyx, nova, sage und shimmer), denselben Ausgabeformaten MP3, Opus, AAC, FLAC, WAV und 24-kHz-PCM, demselben Geschwindigkeitsbereich von 0.25 bis 4.0 um einen Standardwert von 1.0 und demselben Chunked-Transfer-Streaming, sodass die Wiedergabe früh beginnen kann.
- Es gelten auch dieselben zwei Einschränkungen: Der instructions-Parameter zur Steuerung von Ton und Vortrag ist als bei tts-1 und tts-1-hd nicht funktionierend dokumentiert, und das sse-Stream-Format wird nicht unterstützt, sodass rohes Audio-Streaming als einzige Option bleibt.
- Die Sprachabdeckung folgt Whispers Liste, während die Stimmen auf Englisch optimiert bleiben, und OpenAI verlangt einen klaren Hinweis, dass die Stimme KI-generiert ist.
- Synthorai stellt TTS-1 HD über denselben OpenAI-kompatiblen /v1/audio/speech Endpoint bereit.
FAQ
Lässt sich die TTS-1 HD API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Das reicht, um TTS-1 HD mit Ihrem realen Workload auszuprobieren, bevor Sie eine Zahlungsmethode hinterlegen.
Worin ist TTS-1 HD am besten?
Auf Qualität statt auf Latenz optimiert; doppelte tts-1-Rate zu $30 pro Million Zeichen; geeignet für Erzählstimmen und veröffentlichtes Audio, nicht für interaktive Sprache. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet TTS-1 HD?
TTS-1 HD kostet auf Synthorai $30 pro Million Input-Tokens und $0 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag.
Unterstützt TTS-1 HD Prompt-Caching?
TTS-1 HD hat auf Synthorai derzeit keinen Cache-Lese-Rabatt. Prompt-Caching gilt weiterhin für andere Modelle auf dem Gateway; cache-fähige Alternativen finden Sie in der Preistabelle. Caching-Vergleich der Anbieter →
Wie erhalte ich Zugang zu TTS-1 HD?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="tts-1-hd", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.