Google TTS Standard
Prix catalogue du fournisseur : sans majoration de plateforme, paiement à l'usage. Ce sont les prix catalogue officiels. Les clients connectés peuvent voir les prix effectifs incluant les remises de l’espace de travail sur /console/pricing.
Utilisez Google TTS Standard en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="google-tts-standard",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "google-tts-standard",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "google-tts-standard",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "google-tts-standard",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("google-tts-standard")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Spécifications et limites
Audio
- Langues
- L'éventail de locales le plus large de tous les types de voix Cloud TTS. Des identifiants de voix Standard sont publiés pour af-ZA, ar-XA, bg-BG, bn-IN, ca-ES, cmn-CN, cmn-TW, cs-CZ, da-DK, de-DE, el-GR, en-AU, en-GB, en-IN, en-US, es-ES, es-US, et-EE, eu-ES, fi-FI, fil-PH, fr-CA, fr-FR, gl-ES, gu-IN, he-IL, hi-IN, hu-HU, id-ID, is-IS, it-IT, ja-JP, kn-IN, ko-KR, lt-LT, lv-LV, ml-IN, mr-IN, ms-MY, nb-NO, nl-BE, nl-NL, pa-IN, pl-PL, pt-BR, pt-PT, ro-RO, ru-RU, sk-SK, sr-RS, sv-SE, ta-IN, te-IN, th-TH, tr-TR, uk-UA, ur-IN, vi-VN et yue-HK.
- Limites audio
-
- Limite de contenu de 5 000 octets au total par requête de synthèse (un caractère unique occupe plusieurs octets dans certaines locales). Sortie en LINEAR16 (renvoyée avec un en-tête WAV), MP3 à 32 kbps, OGG_OPUS, ou G.711 MULAW et ALAW
- le paramètre optionnel sampleRateHertz rééchantillonne et fait échouer la requête si la fréquence n'est pas prise en charge pour l'encodage. Non proposé en synthèse par streaming
- Long Audio Synthesis (en préversion) couvre jusqu'à 1 million d'octets d'entrée de façon asynchrone. Facturé au caractère, espaces et sauts de ligne compris, et toutes les balises SSML sauf <mark> comptent
- pour Standard et WaveNet, un caractère multi-octets n'est facturé qu'une fois
Temps réel
- Voix
- Les identifiants de voix suivent un motif locale-plus-lettre (en-US-Standard-A, cmn-CN-Standard-A). Le tableau comparatif de Google présente Standard comme économique, en disponibilité générale, pilotable via SSML et non compatible avec le streaming ; la documentation attribue les voix à une synthèse vocale paramétrique passée par des vocodeurs.
- Session
-
- Contrôles AudioConfig : speakingRate de 0.25 à 2.0 (1.0 en natif)
- pitch de -20.0 à 20.0 demi-tons
- volumeGainDb de -96.0 à 16.0
- profils d'appareil effectsProfileId pour objet connecté, téléphone, casque, enceinte Bluetooth petite et moyenne, grand système home cinéma, grand système automobile et restitution téléphonique
- les balises SSML comprennent speak, break, say-as, sub, mark, prosody, emphasis, phoneme, voice et lang
Modèle
- Modalités
- texte → audio
Le palier de voix Standard de Google Cloud Text-to-Speech, regroupé avec WaveNet et Studio sous les modèles TTS hérités (Legacy) sur la page de tarification. 0,000004 $ US par caractère (4 $ US par million de caractères) avec les 4 premiers millions de caractères gratuits chaque mois, la plus large allocation gratuite que publie le tableau tarifaire.
À propos de Google TTS Standard
Google TTS Standard expose le palier de voix Standard de Google Cloud Text-to-Speech, celui que le propre tableau comparatif de Google qualifie simplement d'économique.
- Ses voix reposent sur la technologie la plus ancienne du catalogue, et la documentation le dit sans détour : la synthèse vocale paramétrique génère l'audio en faisant passer ses sorties par des algorithmes de traitement du signal appelés vocodeurs, et beaucoup des voix Standard emploient une variante de cette technologie, ce qui explique honnêtement pourquoi elles sonnent plus plates que les paliers génératifs.
- La page de tarification range Standard parmi les modèles TTS hérités (Legacy), aux côtés de WaveNet et Studio, à 0,000004 $ US par caractère, soit 4 $ US par million de caractères, avec les 4 premiers millions de caractères gratuits chaque mois, la plus large allocation gratuite que publie le tableau tarifaire.
- Ce que Standard abandonne en expressivité, il le regagne en couverture.
- Les identifiants de voix suivent un motif locale-plus-lettre comme en-US-Standard-A ou cmn-CN-Standard-A, et le tableau des voix prises en charge répertorie Standard sur l'éventail de locales le plus large du produit, de af-ZA et eu-ES à hi-IN, ja-JP et ur-IN jusqu'à yue-HK, bien au-delà de la portée des paliers plus récents.
- Le contrôle passe par SSML, avec des balises dont speak, break, prosody, emphasis, say-as, sub et phoneme, et le bloc AudioConfig ajoute speakingRate de 0.25 à 2.0, le pitch sur 20 demi-tons dans chaque sens, volumeGainDb de -96 à 16, une fréquence d'échantillonnage de sortie optionnelle, et des profils d'appareil effectsProfileId réglés pour les objets connectés, les téléphones, les casques, les enceintes Bluetooth, l'audio embarqué et les SVI.
- La sortie est en LINEAR16 avec un en-tête WAV, en MP3 à 32 kbps, en OGG_OPUS ou en G.711 MULAW et ALAW.
- Deux contraintes comptent : une requête porte au plus 5 000 octets de contenu, et Standard n'est pas proposé en synthèse par streaming, si bien qu'un texte long impose la voie asynchrone Long Audio Synthesis ou votre propre découpage.
- La facturation compte chaque caractère, espaces, sauts de ligne et balises SSML compris, à l'exception de mark, même si un caractère multi-octets n'est compté qu'une fois pour Standard.
- Synthorai le sert via l'endpoint /v1/audio/speech compatible OpenAI.
FAQ
Peut-on essayer l'API Google TTS Standard gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $4/M de tokens en entrée, ce crédit couvre à lui seul environ 61 requêtes de ~4K tokens sur Google TTS Standard.
Quels sont les points forts de Google TTS Standard ?
Le palier que google qualifie d'économique ; l'éventail de locales le plus large de tous les types de voix cloud tts ; voix paramétriques avec ssml et profils d'appareil. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte Google TTS Standard ?
Sur Synthorai, Google TTS Standard coûte $4 par million de tokens en entrée et $0 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme.
Google TTS Standard prend-il en charge la mise en cache des prompts ?
Google TTS Standard n'a pas de remise sur les lectures de cache sur Synthorai aujourd'hui. La mise en cache des prompts s'applique toujours aux autres modèles de la passerelle ; voir la table des prix pour les alternatives compatibles avec le cache. Comparatif de la mise en cache par fournisseur →
Comment obtenir l'accès à Google TTS Standard ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="google-tts-standard", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.