Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

TTS-1 HD

TTS-1 HD est le modèle text-to-speech d'OpenAI optimisé pour la qualité, la moitié haute fidélité de la paire qu'il forme avec tts-1.

Entrée
texte $30/M
Sortie
audio
Contexte
4K

Le prix en contexte

Position du prix parmi 7 modèles comparables

Entrée$30/M
$4 · Google TTS Standard Google TTS Chirp 3 HD · $30

La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.

Spécifications et limites

Synthèse vocale

Langues de synthèse Suit globalement la prise en charge linguistique du modèle Whisper: afrikaans, arabe, arménien, azéri, biélorusse, bosniaque, bulgare, catalan, chinois, croate, tchèque, danois, néerlandais, anglais, estonien, finnois, français, galicien, allemand, grec, hébreu, hindi, hongrois, islandais, indonésien, italien, japonais, kannada, kazakh, coréen, letton, lituanien, macédonien, malais, marathi, maori, népalais, norvégien, persan, polonais, portugais, roumain, russe, serbe, slovaque, slovène, espagnol, swahili, suédois, tagalog, tamoul, thaï, turc, ukrainien, ourdou, vietnamien et gallois, bien que les voix soient optimisées pour l'anglais
Voix alloy, ash, coral, echo, fable, onyx, nova, sage et shimmer, un ensemble plus restreint que la liste TTS complète de 13 voix, et les voix sont actuellement optimisées pour l'anglais.
Limite d'entrée 4,096 caractères Les fournisseurs publient cette limite dans des unités différentes : pour un texte non latin, une limite en octets n'équivaut pas à une limite en caractères.
Synthèse en streaming Oui
SSML Non documentée
Contrôle de la voix Aucun sur ce modèle
Unité de facturation Par caractère d'entrée
Points de terminaison et formats
  • Endpoint de génération de parole (v1/audio/speech) uniquement, Chat Completions, Responses, Realtime, Batch et le fine-tuning étant tous listés comme non pris en charge
  • le texte d'entrée est plafonné à 4096 caractères
  • sortie mp3 (par défaut), opus, aac, flac, wav ou pcm (échantillons bruts 24 kHz 16 bits signés little-endian)
  • lecture en temps réel via l'encodage de transfert par blocs

Modèle

Modalités texte → audio

Modèle de synthèse vocale optimisé pour la qualité: le même endpoint Speech que tts-1, réglé pour des cas d'usage privilégiant la haute qualité plutôt que la faible latence. Le paramètre instructions qui pilote l'accent, l'émotion, l'intonation et le ton sur gpt-4o-mini-tts ne fonctionne ni avec tts-1 ni avec tts-1-hd.

selon docs officielles OpenAI ↗

Utilisez TTS-1 HD en 30 secondes

Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="tts-1-hd",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

À propos de TTS-1 HD

  • La page modèle le présente comme convertissant du texte en parole au son naturel pour les cas d'usage text-to-speech de haute qualité, et le guide énonce le compromis sans détour : tts-1 offre une latence plus faible, mais à une qualité inférieure à celle de tts-1-hd.
  • Ce surcroît de qualité est toute la différence, et il est tarifé en conséquence à 30 $ par million de caractères, soit le double du tarif de tts-1, ce qui en fait le choix pour la narration, l'audio publié et tout ce qu'un auditeur entendra plus d'une fois, plutôt que pour de la parole interactive tour par tour.
  • Tout le reste est partagé avec son frère.
  • Il ne sert que l'endpoint speech de l'Audio API, prenant du texte en entrée et renvoyant de l'audio, avec les mêmes neuf voix (alloy, ash, coral, echo, fable, onyx, nova, sage et shimmer), les mêmes formats de sortie MP3, Opus, AAC, FLAC, WAV et PCM 24 kHz, la même plage de vitesse de 0.25 à 4.0 autour d'une valeur par défaut de 1.0, et le même streaming par transfert en blocs permettant à la lecture de démarrer tôt.
  • Les deux mêmes restrictions s'appliquent également : le paramètre instructions qui pilote le ton et la diction est documenté comme ne fonctionnant pas sur tts-1 ni sur tts-1-hd, et le format de flux sse n'est pas pris en charge, ce qui laisse le streaming audio brut comme seule option.
  • La couverture linguistique suit la liste de Whisper tandis que les voix restent optimisées pour l'anglais, et OpenAI exige d'indiquer clairement que la voix est générée par IA.
  • Synthorai sert TTS-1 HD via le même endpoint /v1/audio/speech compatible OpenAI.

FAQ

Peut-on essayer l'API TTS-1 HD gratuitement ?

Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. De quoi essayer TTS-1 HD sur votre charge de travail réelle avant d'ajouter un moyen de paiement.

Quels sont les points forts de TTS-1 HD ?

Optimisé pour la qualité plutôt que pour la latence ; le double du tarif de tts-1, à 30 $ par million de caractères ; convient à la narration et à l'audio publié, pas à la parole interactive. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.

Combien coûte TTS-1 HD ?

Sur Synthorai, TTS-1 HD coûte $30 par million de tokens en entrée et $0 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme.

TTS-1 HD prend-il en charge la mise en cache des prompts ?

TTS-1 HD n'a pas de remise sur les lectures de cache sur Synthorai aujourd'hui. La mise en cache des prompts s'applique toujours aux autres modèles de la passerelle ; voir la table des prix pour les alternatives compatibles avec le cache. Comparatif de la mise en cache par fournisseur →

Comment obtenir l'accès à TTS-1 HD ?

Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="tts-1-hd", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.

Modèles associés

Comparer

Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.

Obtenez votre clé API Comparez votre coût →