Google TTS Standard erschließt die Standard-Stimmstufe von Google Cloud Text-to-Speech, jene, die Googles eigene Vergleichstabelle schlicht als kosteneffizient bezeichnet.
- Eingabe
- Text $4/M
- Ausgabe
- Audio
- Kontext
- 4K
Preis im Vergleich
Preisposition unter 7 vergleichbaren Modellen
Der Balken zeigt, wo der Preis dieses Modells unter allen Modellen derselben Art auf Synthorai liegt. An beiden Enden stehen das günstigste und das teuerste Modell. Es sind Grundpreise; Rabatte für Batch, Region und Cache-Schreibvorgänge stehen auf der Preisseite.
Spezifikationen & Limits
Sprachsynthese
| Synthesesprachen | Die breiteste Locale-Spanne aller Cloud-TTS-Stimmtypen. Standard-Stimm-ids sind veröffentlicht für af-ZA, ar-XA, bg-BG, bn-IN, ca-ES, cmn-CN, cmn-TW, cs-CZ, da-DK, de-DE, el-GR, en-AU, en-GB, en-IN, en-US, es-ES, es-US, et-EE, eu-ES, fi-FI, fil-PH, fr-CA, fr-FR, gl-ES, gu-IN, he-IL, hi-IN, hu-HU, id-ID, is-IS, it-IT, ja-JP, kn-IN, ko-KR, lt-LT, lv-LV, ml-IN, mr-IN, ms-MY, nb-NO, nl-BE, nl-NL, pa-IN, pl-PL, pt-BR, pt-PT, ro-RO, ru-RU, sk-SK, sr-RS, sv-SE, ta-IN, te-IN, th-TH, tr-TR, uk-UA, ur-IN, vi-VN und yue-HK. |
|---|---|
| Stimmen | Stimm-ids folgen einem Muster aus Locale plus Buchstabe (en-US-Standard-A, cmn-CN-Standard-A). Googles Vergleichstabelle führt Standard als kosteneffizient, allgemein verfügbar, per SSML steuerbar und nicht streamingfähig; die Dokumentation führt die Stimmen auf parametrische Sprachsynthese zurück, die durch Vokoder geleitet wird. |
| Eingabelimit | 5,000 Bytes Anbieter geben dieses Limit in unterschiedlichen Einheiten an: Bei nicht lateinischem Text ist ein Byte-Limit kein Zeichen-Limit. |
| Streaming-Synthese | Nein |
| SSML | Unterstützt |
| Stimmsteuerung | Numerische Parameter |
| Was akzeptiert wird |
|
| Abrechnungseinheit | Pro Eingabezeichen Ein Mehrbyte-Zeichen wird einmal berechnet. |
| Endpunkte und Formate |
|
Modell
| Modalitäten | Text → Audio |
|---|
Die Standard-Stimmstufe von Google Cloud Text-to-Speech, auf der Preisseite zusammen mit WaveNet und Studio unter Legacy TTS models gruppiert. US$0.000004 pro Zeichen (US$4 pro 1 Million Zeichen), wobei die ersten 4 Millionen Zeichen jeden Monat kostenlos sind, das größte Freikontingent, das die Preistabelle veröffentlicht.
Google TTS Standard in 30 Sekunden nutzen
OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="google-tts-standard",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "google-tts-standard",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "google-tts-standard",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "google-tts-standard",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("google-tts-standard")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Über Google TTS Standard
- Ihre Stimmen sind die älteste Technologie im Katalog, und die Dokumentation sagt das unumwunden: Parametrische Sprachsynthese erzeugt Audio, indem sie Ausgaben durch Signalverarbeitungsalgorithmen leitet, die als Vokoder bekannt sind, und viele der Standard-Stimmen nutzen eine Variante dieser Technologie, was der ehrliche Grund dafür ist, dass sie flacher klingen als die generativen Stufen.
- Die Preisseite führt Standard unter Legacy TTS models neben WaveNet und Studio, zu US$0.000004 pro Zeichen, angegeben als US$4 pro 1 Million Zeichen, wobei die ersten 4 Millionen Zeichen jeden Monat kostenlos sind, das größte Freikontingent, das die Preistabelle veröffentlicht.
- Was Standard an Ausdruckskraft aufgibt, macht es an Reichweite wett.
- Stimm-ids folgen einem Muster aus Locale plus Buchstabe wie en-US-Standard-A oder cmn-CN-Standard-A, und die Tabelle der unterstützten Stimmen führt Standard über die breiteste Locale-Spanne im Produkt, von af-ZA und eu-ES über hi-IN, ja-JP und ur-IN bis yue-HK, weit über das hinaus, wohin die neueren Stufen reichen.
- Die Steuerbarkeit erfolgt über SSML, mit Tags wie speak, break, prosody, emphasis, say-as, sub und phoneme, und der AudioConfig-Block ergänzt speakingRate von 0.25 bis 2.0, pitch über 20 Halbtöne in beide Richtungen, volumeGainDb von -96 bis 16, eine optionale Ausgabe-Abtastrate sowie effectsProfileId-Geräteprofile, abgestimmt auf Wearables, Handsets, Kopfhörer, Bluetooth-Lautsprecher, Autoaudio und IVR.
- Die Ausgabe ist LINEAR16 mit WAV-Header, MP3 mit 32 kbps, OGG_OPUS oder G.711 MULAW und ALAW.
- Zwei Einschränkungen sind wichtig: Eine Anfrage trägt höchstens 5.000 Byte Inhalt, und Standard wird nicht über die Streaming-Synthese angeboten, sodass langer Text den asynchronen Weg über Long Audio Synthesis oder eigenes Chunking bedeutet.
- Die Abrechnung zählt jedes Zeichen einschließlich Leerzeichen, Zeilenumbrüchen und SSML-Tags außer mark, wobei Mehrbyte-Zeichen bei Standard einfach zählen.
- Synthorai stellt es über den OpenAI-kompatiblen Endpoint /v1/audio/speech bereit.
FAQ
Lässt sich die Google TTS Standard API kostenlos testen?
Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Das reicht, um Google TTS Standard mit Ihrem realen Workload auszuprobieren, bevor Sie eine Zahlungsmethode hinterlegen.
Worin ist Google TTS Standard am besten?
Die Stufe, die Google als kosteneffizient bezeichnet; breiteste Locale-Spanne aller Cloud-TTS-Stimmtypen; parametrische Stimmen mit SSML und Geräteprofilen. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.
Was kostet Google TTS Standard?
Google TTS Standard kostet auf Synthorai $4 pro Million Input-Tokens und $0 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag.
Unterstützt Google TTS Standard Prompt-Caching?
Google TTS Standard hat auf Synthorai derzeit keinen Cache-Lese-Rabatt. Prompt-Caching gilt weiterhin für andere Modelle auf dem Gateway; cache-fähige Alternativen finden Sie in der Preistabelle. Caching-Vergleich der Anbieter →
Wie erhalte ich Zugang zu Google TTS Standard?
Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="google-tts-standard", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.
Verwandte Modelle
Vergleichen
Jeder Wert auf dieser Seite ist aus der Dokumentation des Anbieters übernommen, oben verlinkt, und trägt das Datum der Prüfung. Preise werden über den gesamten Katalog verglichen; Spezifikationswerte, die Anbieter unterschiedlich definieren, werden mit benanntem Unterschied gezeigt statt grafisch verglichen. Nichts hier wird von uns gemessen, und nichts wird bewertet.