TTS-1 est le modèle text-to-speech d'OpenAI optimisé pour la vitesse.
- Entrée
- texte $15/M
- Sortie
- audio
- Contexte
- 4K
Le prix en contexte
Position du prix parmi 7 modèles comparables
La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.
Spécifications et limites
Synthèse vocale
| Langues de synthèse | Suit globalement la prise en charge linguistique du modèle Whisper: afrikaans, arabe, arménien, azéri, biélorusse, bosniaque, bulgare, catalan, chinois, croate, tchèque, danois, néerlandais, anglais, estonien, finnois, français, galicien, allemand, grec, hébreu, hindi, hongrois, islandais, indonésien, italien, japonais, kannada, kazakh, coréen, letton, lituanien, macédonien, malais, marathi, maori, népalais, norvégien, persan, polonais, portugais, roumain, russe, serbe, slovaque, slovène, espagnol, swahili, suédois, tagalog, tamoul, thaï, turc, ukrainien, ourdou, vietnamien et gallois, bien que les voix soient optimisées pour l'anglais |
|---|---|
| Voix | alloy, ash, coral, echo, fable, onyx, nova, sage et shimmer, un ensemble plus restreint que la liste TTS complète de 13 voix, et les voix sont actuellement optimisées pour l'anglais. |
| Limite d'entrée | 4,096 caractères Les fournisseurs publient cette limite dans des unités différentes : pour un texte non latin, une limite en octets n'équivaut pas à une limite en caractères. |
| Synthèse en streaming | Oui |
| SSML | Non documentée |
| Contrôle de la voix | Aucun sur ce modèle |
| Unité de facturation | Par caractère d'entrée |
| Points de terminaison et formats |
|
Modèle
| Modalités | texte → audio |
|---|
Modèle de synthèse vocale optimisé pour la vitesse: OpenAI documente tts-1 comme l'option à latence et qualité plus faibles face à tts-1-hd. Le paramètre instructions qui pilote l'accent, l'émotion, l'intonation et le ton sur gpt-4o-mini-tts ne fonctionne ni avec tts-1 ni avec tts-1-hd.
Utilisez TTS-1 en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="tts-1",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "tts-1",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "tts-1",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("tts-1")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));À propos de TTS-1
- Sa page modèle le décrit comme convertissant du texte en parole au son naturel et comme réglé pour les cas d'usage text-to-speech en temps réel, et le guide text-to-speech trace clairement la ligne au sein de la famille : tts-1 offre une latence plus faible, mais à une qualité inférieure à celle de tts-1-hd.
- C'est un modèle à usage unique, pris en charge uniquement sur l'endpoint speech de l'Audio API et sur aucune autre route, prenant du texte en entrée et renvoyant de l'audio, au prix de 15 $ par million de caractères.
- Neuf voix lui sont accessibles, un ensemble plus restreint que les treize que propose au total l'endpoint Speech : alloy, ash, coral, echo, fable, onyx, nova, sage et shimmer.
- La sortie peut être en MP3 par défaut, ou en Opus, AAC, FLAC, WAV, ou en PCM brut 24 kHz, et OpenAI recommande WAV ou PCM pour la réponse la plus rapide ; le débit de parole est ajustable de 0.25 à 4.0, avec 1.0 par défaut, et l'audio peut être diffusé en streaming avec un encodage de transfert par blocs, de sorte que la lecture commence avant que le fichier complet n'existe.
- Deux limites distinguent cette génération de la plus récente et casseront le code copié : le paramètre instructions qui pilote l'accent, l'émotion et la diction ne fonctionne pas sur tts-1 ni sur tts-1-hd, et le format de flux sse n'est pas pris en charge ici.
- La couverture linguistique suit globalement la liste de Whisper de plus de cinquante langues, même si les voix elles-mêmes sont optimisées pour l'anglais, et les politiques d'usage d'OpenAI imposent d'indiquer aux utilisateurs finaux que la voix est générée par IA.
- Synthorai sert TTS-1 via son endpoint /v1/audio/speech compatible OpenAI, si bien que les clients vocaux existants fonctionnent sans modification.
FAQ
Peut-on essayer l'API TTS-1 gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. De quoi essayer TTS-1 sur votre charge de travail réelle avant d'ajouter un moyen de paiement.
Quels sont les points forts de TTS-1 ?
Optimisé pour la vitesse et les cas d'usage de synthèse vocale en temps réel ; latence plus faible à une qualité inférieure à tts-1-hd ; pas de paramètre instructions ni de format de flux sse. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte TTS-1 ?
Sur Synthorai, TTS-1 coûte $15 par million de tokens en entrée et $0 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme.
TTS-1 prend-il en charge la mise en cache des prompts ?
TTS-1 n'a pas de remise sur les lectures de cache sur Synthorai aujourd'hui. La mise en cache des prompts s'applique toujours aux autres modèles de la passerelle ; voir la table des prix pour les alternatives compatibles avec le cache. Comparatif de la mise en cache par fournisseur →
Comment obtenir l'accès à TTS-1 ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="tts-1", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.
Modèles associés
Comparer
Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.