Qwen3-TTS-Instruct-Flash es el nivel con control por instrucciones de la familia Qwen3-TTS de Alibaba en Model Studio, con precios en la región de Singapur y actualmente equivalente a la instantánea qwen3-tts-instruct-flash-2026-01-26.
- Entrada
- texto $11.5/M
- Salida
- audio
- Contexto
- 4K
El precio en contexto
Posición del precio entre 7 modelos comparables
La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.
Especificaciones y límites
Síntesis de voz
| Idiomas de síntesis | Chino (mandarín), inglés, alemán, italiano, portugués, español, japonés, coreano, francés y ruso. language_type toma Auto por defecto para la entrada plurilingüe o indeterminada, y Alibaba documenta que eso no garantiza la precisión; nombrar un solo idioma está documentado como una mejora significativa de la calidad de la síntesis. A diferencia de la serie Qwen3-TTS-Flash, la serie Instruct no lista ninguna voz de dialecto chino (pekinés, shanghainés, sichuanés, nanjinés, shaanxi, hokkien, tianjin, cantonés). |
|---|---|
| Voces | Voces del sistema publicadas con una persona descrita en una línea, entre ellas Cherry (una mujer joven alegre, positiva, amable y natural), Serena, Ethan, Chelsie, Momo, Vivian, Moon, Maia, Kai, Nofish (un diseñador que no sabe pronunciar los sonidos retroflejos), Bella, Eldric Sage, Mia, Mochi, Bellona, Vincent, Bunny, Neil, Elias, Arthur, Nini, Seren, Pip y Stella; la lista de voces de Qwen-TTS empareja cada voz con los ids de modelo exactos que la aceptan. |
| Límite de entrada | 600 caracteres Los proveedores publican este límite en unidades distintas: en texto no latino, un límite en bytes no equivale a un límite en caracteres. |
| Síntesis en streaming | Sí |
| SSML | Sin documentar |
| Control de voz | Instrucción en lenguaje natural |
| Qué admite |
|
| Unidad de facturación | Por carácter de entrada |
| Endpoints y formatos |
|
Modelo
| Modalidades | texto → audio |
|---|
Nivel con control por instrucciones de la familia Qwen3-TTS de Alibaba en Model Studio, actualmente equivalente a la instantánea qwen3-tts-instruct-flash-2026-01-26. Posicionado para trabajos tolerantes a la latencia, como la producción de audiolibros, las voces en off de educación en línea y la creación de contenido. Con precios en la región de Singapur, a $0.115 por cada 10.000 caracteres de entrada en el ámbito de despliegue internacional, y una cuota gratuita de 110.000 caracteres válida durante 90 días tras activar Model Studio.
Use Qwen3 TTS Instruct Flash en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3-tts-instruct-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3-tts-instruct-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-tts-instruct-flash",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3-tts-instruct-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3-tts-instruct-flash")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Acerca de Qwen3 TTS Instruct Flash
- Model Studio divide la familia por transporte y no por capacidad: un id que lleva el sufijo realtime habla WebSocket, mientras que este, sin ese sufijo, es el modelo HTTP que hay detrás de lo que Alibaba llama síntesis de voz no en tiempo real, pensado para escenarios tolerantes a la latencia como la producción de audiolibros, las voces en off de educación en línea y la creación de contenido.
- El control por instrucciones es la razón para elegirlo en lugar de qwen3-tts-flash a secas.
- Basta con describir en lenguaje corriente la entrega deseada para controlar la velocidad, la emoción y el estilo en cada solicitud, y los ejemplos documentados son hablar con suavidad a un ritmo más lento o usar un estilo de locución entusiasta; el campo instructions admite hasta 1600 tokens y está documentado solo para chino e inglés, y optimize_instructions, desactivado por defecto, hace que el servicio reescriba lo redactado como una directiva más adecuada para la síntesis.
- Las voces son las personas con nombre propio de la familia, entre ellas Cherry como una mujer joven alegre, positiva, amable y natural y Nofish como un diseñador que no sabe pronunciar los sonidos retroflejos, y la lista de voces indica qué ids de modelo aceptan cada una.
- Se cubren diez idiomas, chino (mandarín), inglés, alemán, italiano, portugués, español, japonés, coreano, francés y ruso, y a diferencia de qwen3-tts-flash la línea Instruct no incluye ninguna de las voces de dialectos chinos.
- Dos límites condicionan la integración: el texto de entrada está limitado a 600 caracteres, y language_type toma Auto por defecto, algo que según Alibaba no garantiza la precisión y que aconseja sustituir por un idioma explícito cuando el texto es monolingüe.
- Sin streaming se devuelve una URL de archivo de audio válida durante 24 horas, mientras que con streaming se devuelve PCM codificado en Base64 por fragmentos, con la URL solo en el último paquete, y los ejemplos oficiales reproducen ese flujo como audio mono de 24 kHz y 16 bits.
- La facturación cuenta los caracteres del texto de entrada, a $0.115 por cada 10.000 en el ámbito de despliegue internacional, y el audio de salida es gratuito.
- Synthorai lo sirve a través del endpoint /v1/audio/speech compatible con OpenAI.
Preguntas frecuentes
¿Se puede probar gratis la API de Qwen3 TTS Instruct Flash?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. Suficiente para probar Qwen3 TTS Instruct Flash con su carga de trabajo real antes de añadir un método de pago.
¿En qué destaca Qwen3 TTS Instruct Flash?
Instrucciones en lenguaje corriente controlan velocidad, emoción y estilo; modelo http para audiolibros y voces en off, no realtime; diez idiomas, límite de 600 caracteres de entrada. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta Qwen3 TTS Instruct Flash?
Qwen3 TTS Instruct Flash cuesta $11.5 por millón de tokens de entrada y $0 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.
¿Qwen3 TTS Instruct Flash admite caché de prompts?
Qwen3 TTS Instruct Flash no tiene hoy descuento por lectura de caché en Synthorai. El caché de prompts sigue disponible para otros modelos del gateway. Consulte la tabla de precios para ver alternativas con caché. Comparativa de caché entre proveedores →
¿Cómo obtengo acceso a Qwen3 TTS Instruct Flash?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="qwen3-tts-instruct-flash" y listo. Una sola clave API cubre todos los modelos del gateway.
Modelos relacionados
Comparar
Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.