Qwen3-TTS-Instruct-Flash est le palier pilotable par instruction de la famille Qwen3-TTS d'Alibaba sur Model Studio, tarifé dans la région de Singapour et actuellement équivalent au snapshot qwen3-tts-instruct-flash-2026-01-26.
- Entrée
- texte $11.5/M
- Sortie
- audio
- Contexte
- 4K
Le prix en contexte
Position du prix parmi 7 modèles comparables
La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.
Spécifications et limites
Synthèse vocale
| Langues de synthèse | Chinois (mandarin), anglais, allemand, italien, portugais, espagnol, japonais, coréen, français et russe. language_type vaut Auto par défaut pour une entrée multilingue ou indéterminée, ce qu'Alibaba documente comme ne garantissant pas la précision ; nommer une seule langue est documenté comme améliorant nettement la qualité de synthèse. Contrairement à la série Qwen3-TTS-Flash, la série Instruct ne liste aucune voix en dialecte chinois (pékinois, shanghaïen, sichuanais, nankinois, shaanxi, hokkien, tianjinois, cantonais). |
|---|---|
| Voix | Voix système publiées avec un personnage résumé en une ligne, parmi lesquelles Cherry (une jeune femme enjouée, positive, amicale et naturelle), Serena, Ethan, Chelsie, Momo, Vivian, Moon, Maia, Kai, Nofish (un designer incapable de prononcer les consonnes rétroflexes), Bella, Eldric Sage, Mia, Mochi, Bellona, Vincent, Bunny, Neil, Elias, Arthur, Nini, Seren, Pip et Stella ; la liste des voix Qwen-TTS associe chaque voix aux identifiants de modèle exacts qui l'acceptent. |
| Limite d'entrée | 600 caractères Les fournisseurs publient cette limite dans des unités différentes : pour un texte non latin, une limite en octets n'équivaut pas à une limite en caractères. |
| Synthèse en streaming | Oui |
| SSML | Non documentée |
| Contrôle de la voix | Instruction en langage naturel |
| Ce qui est accepté |
|
| Unité de facturation | Par caractère d'entrée |
| Points de terminaison et formats |
|
Modèle
| Modalités | texte → audio |
|---|
Palier pilotable par instruction de la famille Qwen3-TTS d'Alibaba sur Model Studio, actuellement équivalent au snapshot qwen3-tts-instruct-flash-2026-01-26. Positionné pour le travail tolérant à la latence, comme la production de livres audio, les voix off de l'éducation en ligne et la création de contenu. Tarifé dans la région de Singapour à 0,115 $ pour 10 000 caractères d'entrée dans le périmètre de déploiement international, avec un quota gratuit de 110 000 caractères valable 90 jours après l'activation de Model Studio.
Utilisez Qwen3 TTS Instruct Flash en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3-tts-instruct-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3-tts-instruct-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-tts-instruct-flash",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3-tts-instruct-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3-tts-instruct-flash")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));À propos de Qwen3 TTS Instruct Flash
- Model Studio répartit la famille selon le transport plutôt que selon la capacité : un identifiant portant le suffixe realtime parle WebSocket, tandis que celui-ci, qui ne le porte pas, est le modèle HTTP derrière ce qu'Alibaba appelle la synthèse vocale non temps réel, conçue pour les scénarios tolérants à la latence tels que la production de livres audio, les voix off de l'éducation en ligne et la création de contenu.
- Le pilotage par instruction est la raison de le préférer à qwen3-tts-flash tout court.
- Vous décrivez en langage ordinaire l'interprétation souhaitée pour contrôler le débit, l'émotion et le style requête par requête, les exemples documentés étant de parler doucement à un rythme plus lent ou d'adopter un style de présentation radio enthousiaste ; le champ instructions accepte jusqu'à 1 600 tokens et n'est documenté que pour le chinois et l'anglais, et optimize_instructions, désactivé par défaut, fait réécrire votre formulation par le service en une directive mieux adaptée à la synthèse.
- Les voix sont les personnages nommés de la famille, parmi lesquels Cherry, une jeune femme enjouée, positive, amicale et naturelle, et Nofish, un designer incapable de prononcer les consonnes rétroflexes, et la liste des voix précise quels identifiants de modèle acceptent chacune d'elles.
- Dix langues sont couvertes, le chinois (mandarin), l'anglais, l'allemand, l'italien, le portugais, l'espagnol, le japonais, le coréen, le français et le russe, et contrairement à qwen3-tts-flash, la ligne Instruct ne comporte aucune des voix en dialectes chinois.
- Deux limites façonnent l'intégration : le texte d'entrée est plafonné à 600 caractères, et language_type vaut Auto par défaut, ce qui, selon Alibaba, ne garantit pas la précision, si bien qu'il conseille de le remplacer par une langue explicite pour un texte monolingue.
- Le mode non streaming renvoie l'URL d'un fichier audio valable 24 heures, tandis que le streaming renvoie du PCM encodé en Base64 par fragments, l'URL n'arrivant que dans le dernier paquet, et les exemples officiels restituent ce flux en audio mono 16 bits à 24 kHz.
- La facturation compte les caractères du texte d'entrée, à 0,115 $ pour 10 000 dans le périmètre de déploiement international, et l'audio produit est gratuit.
- Synthorai le sert via l'endpoint /v1/audio/speech compatible OpenAI.
FAQ
Peut-on essayer l'API Qwen3 TTS Instruct Flash gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. De quoi essayer Qwen3 TTS Instruct Flash sur votre charge de travail réelle avant d'ajouter un moyen de paiement.
Quels sont les points forts de Qwen3 TTS Instruct Flash ?
Des instructions en langage courant contrôlent le débit, l'émotion et le style ; modèle http pour livres audio et voix off, pas temps réel ; dix langues, entrée plafonnée à 600 caractères. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte Qwen3 TTS Instruct Flash ?
Sur Synthorai, Qwen3 TTS Instruct Flash coûte $11.5 par million de tokens en entrée et $0 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme.
Qwen3 TTS Instruct Flash prend-il en charge la mise en cache des prompts ?
Qwen3 TTS Instruct Flash n'a pas de remise sur les lectures de cache sur Synthorai aujourd'hui. La mise en cache des prompts s'applique toujours aux autres modèles de la passerelle ; voir la table des prix pour les alternatives compatibles avec le cache. Comparatif de la mise en cache par fournisseur →
Comment obtenir l'accès à Qwen3 TTS Instruct Flash ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="qwen3-tts-instruct-flash", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.
Modèles associés
Comparer
Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.