TTS-1 HD es el modelo de texto a voz de OpenAI optimizado para la calidad, la mitad de mayor fidelidad del par que forma con tts-1.
- Entrada
- texto $30/M
- Salida
- audio
- Contexto
- 4K
El precio en contexto
Posición del precio entre 7 modelos comparables
La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.
Especificaciones y límites
Síntesis de voz
| Idiomas de síntesis | En general sigue el soporte de idiomas del modelo Whisper: afrikáans, árabe, armenio, azerbaiyano, bielorruso, bosnio, búlgaro, catalán, chino, croata, checo, danés, neerlandés, inglés, estonio, finés, francés, gallego, alemán, griego, hebreo, hindi, húngaro, islandés, indonesio, italiano, japonés, canarés, kazajo, coreano, letón, lituano, macedonio, malayo, maratí, maorí, nepalí, noruego, persa, polaco, portugués, rumano, ruso, serbio, eslovaco, esloveno, español, suajili, sueco, tagalo, tamil, tailandés, turco, ucraniano, urdu, vietnamita y galés, pese a que las voces están optimizadas para el inglés |
|---|---|
| Voces | alloy, ash, coral, echo, fable, onyx, nova, sage y shimmer, un conjunto menor que la lista completa de 13 voces de TTS, y las voces están actualmente optimizadas para el inglés. |
| Límite de entrada | 4,096 caracteres Los proveedores publican este límite en unidades distintas: en texto no latino, un límite en bytes no equivale a un límite en caracteres. |
| Síntesis en streaming | Sí |
| SSML | Sin documentar |
| Control de voz | No disponible en este modelo |
| Unidad de facturación | Por carácter de entrada |
| Endpoints y formatos |
|
Modelo
| Modalidades | texto → audio |
|---|
Modelo de texto a voz optimizado para calidad: el mismo endpoint Speech que tts-1, ajustado para casos de uso de alta calidad en lugar de baja latencia. El parámetro instructions que dirige el acento, la emoción, la entonación y el tono en gpt-4o-mini-tts no funciona con tts-1 ni con tts-1-hd.
Use TTS-1 HD en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="tts-1-hd",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "tts-1-hd",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "tts-1-hd",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("tts-1-hd")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Acerca de TTS-1 HD
- La página del modelo lo plantea como un conversor de texto en habla de sonido natural para casos de uso de texto a voz de alta calidad, y la guía enuncia el compromiso de forma directa: tts-1 ofrece menor latencia, pero con menor calidad que tts-1-hd.
- Esa calidad adicional es toda la diferencia, y tiene el precio correspondiente de $30 por millón de caracteres, el doble de la tarifa de tts-1, lo que lo convierte en la opción para la narración, el audio publicado y todo aquello que un oyente vaya a escuchar más de una vez, en lugar de para el habla interactiva turno a turno.
- Todo lo demás lo comparte con su hermano.
- Sirve únicamente el endpoint de speech de la Audio API, tomando texto y devolviendo audio, con las mismas nueve voces (alloy, ash, coral, echo, fable, onyx, nova, sage y shimmer), los mismos formatos de salida MP3, Opus, AAC, FLAC, WAV y PCM a 24 kHz, el mismo rango de velocidad de 0.25 a 4.0 en torno a un valor por defecto de 1.0, y el mismo streaming con codificación de transferencia por fragmentos para que la reproducción pueda empezar pronto.
- Se aplican también las mismas dos restricciones: el parámetro instructions para dirigir el tono y la entrega está documentado como no funcional en tts-1 ni en tts-1-hd, y el formato de stream sse no se admite, con lo que el streaming de audio en bruto queda como única opción.
- La cobertura de idiomas sigue la lista de Whisper mientras las voces siguen optimizadas para el inglés, y OpenAI exige una divulgación clara de que la voz está generada por IA.
- Synthorai sirve TTS-1 HD a través del mismo endpoint /v1/audio/speech compatible con OpenAI.
Preguntas frecuentes
¿Se puede probar gratis la API de TTS-1 HD?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. Suficiente para probar TTS-1 HD con su carga de trabajo real antes de añadir un método de pago.
¿En qué destaca TTS-1 HD?
Optimizado para la calidad más que para la latencia; el doble de la tarifa de tts-1, a $30 por millón de caracteres; adecuado para narración y audio publicado, no para el habla interactiva. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta TTS-1 HD?
TTS-1 HD cuesta $30 por millón de tokens de entrada y $0 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.
¿TTS-1 HD admite caché de prompts?
TTS-1 HD no tiene hoy descuento por lectura de caché en Synthorai. El caché de prompts sigue disponible para otros modelos del gateway. Consulte la tabla de precios para ver alternativas con caché. Comparativa de caché entre proveedores →
¿Cómo obtengo acceso a TTS-1 HD?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="tts-1-hd" y listo. Una sola clave API cubre todos los modelos del gateway.
Modelos relacionados
Comparar
Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.