Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

TTS-1 vs TTS-1 HD

vs

Lequel choisir, et quand

Même limite de 4096 caractères, même streaming, mêmes voix et la même absence de contrôle de voix ; tts-1-hd facture $30 par million de caractères contre $15, exactement 2x, pour le rendu de meilleure qualité. Rien d'autre dans les specs publiées ne les sépare. Prenez tts-1 pour les brouillons et le volume, tts-1-hd quand l'audio part vers vos utilisateurs.

Tarifs

TTS-1 TTS-1 HD Δ
Par 1M de caractères $15 $30 0.5×

Tarifs relevés dans le catalogue en direct à la génération du site ; la page de chaque modèle affiche la grille tarifaire à jour.

Leur position : prix pour 1M de caractères, parmi les 7 modèles de synthèse vocale facturés dans cette unité (échelle logarithmique)

Capacités

TTS-1 TTS-1 HD
Streaming oui oui
SSML undocumented undocumented
Unité de facturation character character

Spécifications

TTS-1 TTS-1 HD
Modalités d'entrée texte texte
Modalités de sortie audio audio
Date de sortie 2023-11-06 2023-11-06
Limite par requête 4096 characters 4096 characters
Voix alloy, ash, coral, echo, fable, onyx, nova, sage and shimmer, a smaller set than the full 13-voice TTS list, and voices are currently optimized for English. alloy, ash, coral, echo, fable, onyx, nova, sage and shimmer, a smaller set than the full 13-voice TTS list, and voices are currently optimized for English.
Langues Generally follows the Whisper model’s language support: Afrikaans, Arabic, Armenian, Azerbaijani, Belarusian, Bosnian, Bulgarian, Catalan, Chinese, Croatian, Czech, Danish, Dutch, English, Estonian, Finnish, French, Galician, German, Greek, Hebrew, Hindi, Hungarian, Icelandic, Indonesian, Italian, Japanese, Kannada, Kazakh, Korean, Latvian, Lithuanian, Macedonian, Malay, Marathi, Maori, Nepali, Norwegian, Persian, Polish, Portuguese, Romanian, Russian, Serbian, Slovak, Slovenian, Spanish, Swahili, Swedish, Tagalog, Tamil, Thai, Turkish, Ukrainian, Urdu, Vietnamese and Welsh, despite voices being optimized for English Generally follows the Whisper model’s language support: Afrikaans, Arabic, Armenian, Azerbaijani, Belarusian, Bosnian, Bulgarian, Catalan, Chinese, Croatian, Czech, Danish, Dutch, English, Estonian, Finnish, French, Galician, German, Greek, Hebrew, Hindi, Hungarian, Icelandic, Indonesian, Italian, Japanese, Kannada, Kazakh, Korean, Latvian, Lithuanian, Macedonian, Malay, Marathi, Maori, Nepali, Norwegian, Persian, Polish, Portuguese, Romanian, Russian, Serbian, Slovak, Slovenian, Spanish, Swahili, Swedish, Tagalog, Tamil, Thai, Turkish, Ukrainian, Urdu, Vietnamese and Welsh, despite voices being optimized for English
Contrôle de la voix none none
Limites

Speech generation endpoint (v1/audio/speech) only, with Chat Completions, Responses, Realtime, Batch and Fine-tuning all listed as not supported

input text is capped at 4096 characters

output mp3 (default), opus, aac, flac, wav or pcm (raw 24 kHz 16-bit signed little-endian samples)

realtime playback via chunked transfer encoding

Speech generation endpoint (v1/audio/speech) only, with Chat Completions, Responses, Realtime, Batch and Fine-tuning all listed as not supported

input text is capped at 4096 characters

output mp3 (default), opus, aac, flac, wav or pcm (raw 24 kHz 16-bit signed little-endian samples)

realtime playback via chunked transfer encoding

Les spécifications sont reprises de la documentation de chaque fournisseur ; quand un fournisseur ne publie pas une valeur, la ligne est omise et non déduite. Sources complètes : TTS-1 · TTS-1 HD

Passez de l'un à l'autre en changeant une seule ligne

Les deux identifiants figurent dans chaque onglet ci-dessous : les deux lignes surlignées sont le seul changement. Même endpoint, même clé, même format de requête.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.audio.transcriptions.create(
    model="tts-1",
    # model="tts-1-hd",  # décommentez cette ligne, commentez celle du dessus
    file=open("meeting.mp3", "rb"),
    language="en",
)
print(resp.text)

Obtenez votre clé API →

FAQ

Lequel est le moins cher, TTS-1 ou TTS-1 HD ?

TTS-1 est moins cher sur la ligne « Par 1M de caractères » ($15 contre $30, soit un écart de 2.0×). D'autres lignes peuvent dire l'inverse : le tableau ci-dessus donne la grille tarifaire complète, et le coût réel dépend de la composition de votre trafic.

Puis-je faire un test A/B entre TTS-1 et TTS-1 HD sans deux intégrations ?

Oui. Les deux passent par le même endpoint compatible OpenAI, avec une seule clé API. Pour passer de l'un à l'autre, il suffit de changer l'identifiant du modèle, soit une ligne : vous pouvez donc envoyer une part du trafic à chacun et comparer directement les factures.

Comment la synthèse vocale est-elle facturée ?

Au caractère de texte en entrée, avec un plafond de caractères par requête indiqué dans le tableau des spécifications. Avec l'un comme avec l'autre, un texte long doit être découpé en plusieurs requêtes.

Comparatifs associés

Nos études, mesures à l'appui