Qwen3 TTS Instruct Flash
Precios de lista del proveedor, sin margen de plataforma, pago por uso. Estos son los precios de lista oficiales. Los clientes con sesión iniciada pueden ver los precios efectivos con descuentos del espacio de trabajo en /console/pricing.
Use Qwen3 TTS Instruct Flash en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3-tts-instruct-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3-tts-instruct-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-tts-instruct-flash",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3-tts-instruct-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3-tts-instruct-flash")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Especificaciones y límites
Audio
- Idiomas
- Chino (mandarín), inglés, alemán, italiano, portugués, español, japonés, coreano, francés y ruso. language_type toma Auto por defecto para la entrada plurilingüe o indeterminada, y Alibaba documenta que eso no garantiza la precisión; nombrar un solo idioma está documentado como una mejora significativa de la calidad de la síntesis. A diferencia de la serie Qwen3-TTS-Flash, la serie Instruct no lista ninguna voz de dialecto chino (pekinés, shanghainés, sichuanés, nanjinés, shaanxi, hokkien, tianjin, cantonés).
- Límites de audio
-
- API HTTP de síntesis de voz no en tiempo real
- el sufijo -realtime marca el modelo hermano por WebSocket. Texto de entrada limitado a 600 caracteres, con entrada mixta plurilingüe permitida. Sin streaming se devuelve una URL de archivo de audio válida durante 24 horas
- con streaming se devuelve PCM codificado en Base64 por fragmentos, con la URL solo en el último paquete, reproducido en los ejemplos oficiales como audio mono de 24 kHz y 16 bits. Facturado por caracteres del texto de entrada, informados en usage.characters (input_tokens y output_tokens son siempre 0 en la serie Qwen3-TTS)
- el audio de salida es gratuito
Tiempo real
- Voces
- Voces del sistema publicadas con una persona descrita en una línea, entre ellas Cherry (una mujer joven alegre, positiva, amable y natural), Serena, Ethan, Chelsie, Momo, Vivian, Moon, Maia, Kai, Nofish (un diseñador que no sabe pronunciar los sonidos retroflejos), Bella, Eldric Sage, Mia, Mochi, Bellona, Vincent, Bunny, Neil, Elias, Arthur, Nini, Seren, Pip y Stella; la lista de voces de Qwen-TTS empareja cada voz con los ids de modelo exactos que la aceptan.
- Sesión
-
- instructions dirige la velocidad, la emoción y el estilo en lenguaje natural, con hasta 1600 tokens y documentado solo para chino e inglés
- optimize_instructions (false por defecto) reescribe la instrucción como una directiva más adecuada para la síntesis y no tiene efecto cuando instructions está vacío
- la clonación de voz y el diseño de voz figuran ambos como no admitidos para este id de modelo
Modelo
- Modalidades
- texto → audio
Nivel con control por instrucciones de la familia Qwen3-TTS de Alibaba en Model Studio, actualmente equivalente a la instantánea qwen3-tts-instruct-flash-2026-01-26. Posicionado para trabajos tolerantes a la latencia, como la producción de audiolibros, las voces en off de educación en línea y la creación de contenido. Con precios en la región de Singapur, a $0.115 por cada 10.000 caracteres de entrada en el ámbito de despliegue internacional, y una cuota gratuita de 110.000 caracteres válida durante 90 días tras activar Model Studio.
Acerca de Qwen3 TTS Instruct Flash
Qwen3-TTS-Instruct-Flash es el nivel con control por instrucciones de la familia Qwen3-TTS de Alibaba en Model Studio, con precios en la región de Singapur y actualmente equivalente a la instantánea qwen3-tts-instruct-flash-2026-01-26.
- Model Studio divide la familia por transporte y no por capacidad: un id que lleva el sufijo realtime habla WebSocket, mientras que este, sin ese sufijo, es el modelo HTTP que hay detrás de lo que Alibaba llama síntesis de voz no en tiempo real, pensado para escenarios tolerantes a la latencia como la producción de audiolibros, las voces en off de educación en línea y la creación de contenido.
- El control por instrucciones es la razón para elegirlo en lugar de qwen3-tts-flash a secas.
- Basta con describir en lenguaje corriente la entrega deseada para controlar la velocidad, la emoción y el estilo en cada solicitud, y los ejemplos documentados son hablar con suavidad a un ritmo más lento o usar un estilo de locución entusiasta; el campo instructions admite hasta 1600 tokens y está documentado solo para chino e inglés, y optimize_instructions, desactivado por defecto, hace que el servicio reescriba lo redactado como una directiva más adecuada para la síntesis.
- Las voces son las personas con nombre propio de la familia, entre ellas Cherry como una mujer joven alegre, positiva, amable y natural y Nofish como un diseñador que no sabe pronunciar los sonidos retroflejos, y la lista de voces indica qué ids de modelo aceptan cada una.
- Se cubren diez idiomas, chino (mandarín), inglés, alemán, italiano, portugués, español, japonés, coreano, francés y ruso, y a diferencia de qwen3-tts-flash la línea Instruct no incluye ninguna de las voces de dialectos chinos.
- Dos límites condicionan la integración: el texto de entrada está limitado a 600 caracteres, y language_type toma Auto por defecto, algo que según Alibaba no garantiza la precisión y que aconseja sustituir por un idioma explícito cuando el texto es monolingüe.
- Sin streaming se devuelve una URL de archivo de audio válida durante 24 horas, mientras que con streaming se devuelve PCM codificado en Base64 por fragmentos, con la URL solo en el último paquete, y los ejemplos oficiales reproducen ese flujo como audio mono de 24 kHz y 16 bits.
- La facturación cuenta los caracteres del texto de entrada, a $0.115 por cada 10.000 en el ámbito de despliegue internacional, y el audio de salida es gratuito.
- Synthorai lo sirve a través del endpoint /v1/audio/speech compatible con OpenAI.
Preguntas frecuentes
¿Se puede probar gratis la API de Qwen3 TTS Instruct Flash?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $11.5/M por tokens de entrada, solo ese crédito cubre aproximadamente 21 solicitudes de ~4K tokens contra Qwen3 TTS Instruct Flash.
¿En qué destaca Qwen3 TTS Instruct Flash?
Instrucciones en lenguaje corriente controlan velocidad, emoción y estilo; modelo http para audiolibros y voces en off, no realtime; diez idiomas, límite de 600 caracteres de entrada. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta Qwen3 TTS Instruct Flash?
Qwen3 TTS Instruct Flash cuesta $11.5 por millón de tokens de entrada y $0 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.
¿Qwen3 TTS Instruct Flash admite caché de prompts?
Qwen3 TTS Instruct Flash no tiene hoy descuento por lectura de caché en Synthorai. El caché de prompts sigue disponible para otros modelos del gateway. Consulte la tabla de precios para ver alternativas con caché. Comparativa de caché entre proveedores →
¿Cómo obtengo acceso a Qwen3 TTS Instruct Flash?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="qwen3-tts-instruct-flash" y listo. Una sola clave API cubre todos los modelos del gateway.