🎁 Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.
Tarification de l'API Seedance, mesurée : la formule des tokens vidéo, résolue

Tarification de l'API Seedance, mesurée : la formule des tokens vidéo, résolue

Sommaire
  1. Quel modèle Seedance fait quoi ?
  2. Comment appelle-t-on l’API Seedance ?
  3. Un token vidéo, c’est quoi exactement ?
  4. Combien coûte réellement Seedance à la seconde ?
  5. Le 4k est-il moins cher ? Le tarif dit oui, la facture dit non
  6. Qu’est-ce que change generate_audio ?
  7. Comment se comporte la facturation des vidéos en async ?
  8. FAQ

Seedance facture la vidéo au token, et la formule qui colle réellement au compteur est encoded_width × encoded_height × (24 × seconds + 1) / 1024. Deux éléments n’apparaissent dans aucune documentation que nous ayons trouvée : la frame +1, et le fait que les dimensions encodées ne sont pas les dimensions nominales (le 720p se facture en 1248×704, pas en 1280×720). Nous avons lancé 27 générations sur cinq modèles Seedance et tous les paliers de résolution, et chaque nombre de tokens facturés se réconcilie avec cette formule au token près. Cet article dresse la carte de la famille, présente l’API à deux requêtes, puis donne la formule résolue, l’échelle de prix par seconde qui en découle, et les deux endroits où la grille tarifaire induit en erreur.

TL;DR

  • Tokens vidéo Seedance = largeur encodée × hauteur × (24 × seconds + 1) / 1024 ; la frame +1 et les dimensions encodées sont mesurées, pas documentées.
  • Le 720p se facture en 1248×704 et le 1080p en 1920×1088 ; le ratio d’aspect n’y change rien.
  • Le même clip de 4 secondes a facturé un nombre de tokens identique sur tous les paliers à partir du 1.5-pro ; les tarifs vont de 1,0 $ à 7,0 $ le million.
  • Le tarif de 4,0 $/M du 4k passe sous les 7,7 $/M du 1080p, mais coûte 0,78 $ la seconde contre 0,38 $, soit 2,1x plus.
  • generate_audio ne change pas les tokens et double le tarif sur le 1.5-pro.

Tout ce qui suit a été mesuré le 22/07/2026 via l’endpoint /v1/videos du gateway Synthorai, où la famille Seedance est en ligne aux tarifs publics de ByteDance ; les enregistrements bruts par tâche justifient chaque chiffre.

Quel modèle Seedance fait quoi ?

Le choix du palier change le tarif, jamais le compteur : sélectionnez selon la capacité, puis laissez les sections suivantes en calculer le prix. Le même prompt de 4 secondes en 480p a facturé un nombre de tokens identique sur Seedance 2.0, 2.0-fast, 2.0-mini et 1.5-pro (40 594 chacun ; le 1.0-pro-fast a facturé 39 285 sur sa grille de pixels légèrement plus petite). Ce que vous payez en montant l’échelle, c’est la capacité, et la famille la répartit de façon inégale :

RésolutionsDuréeAudioEntrée imageseed / camera_fixedTarif ($/M tokens)
2.0480p-4k4-15s (+auto)✓ natifpremière + dernière frame$7.0 (1080p $7.7 · 4k $4.0)
2.0-fast480p-720p4-15s (+auto)première + dernière frame$5.6
2.0-mini480p-720p4-15s (+auto)première + dernière frame$3.5
1.5-pro480p-1080p4-12s (+auto)bascule ($1.2 / $2.4)première + dernière frame$1.2-2.4
1.0-pro-fast480p-1080p2-12spremière frame seulement$1.0

Trois particularités à connaître avant de choisir. La reproductibilité fonctionne à l’envers : seed et camera_fixed n’existent que sur les modèles 1.x, donc ce sont les paliers les moins chers qui sont contrôlables, et pas le flagship. Les champs de capacité sont verrouillés modèle par modèle : envoyer generate_audio à un modèle 1.0 renvoie un 400 nommé (extension_not_supported), alors construisez les requêtes à partir de la liste de capacités de chaque modèle plutôt que d’un format unique partagé. Et seul le 1.0-pro-fast descend à des clips de 2 secondes, ce qui explique pourquoi les mesures de la formule ci-dessous s’appuient dessus ; tout ce qui est plus récent commence à 4 secondes. Au-delà du tableau, les modèles 2.0 acceptent aussi des fichiers de référence en amont (jusqu’à 9 images, 3 clips vidéo et 3 fichiers audio) là où une plateforme l’expose.

Comment appelle-t-on l’API Seedance ?

La génération de vidéo est une API de job asynchrone : un seul POST crée la tâche et répond en deux secondes environ, puis tu interroges l’URL de la tâche jusqu’à ce qu’elle se termine. Voici le flux complet en Python :

import os, time, requests

BASE = "https://synthorai.io/v1"
auth = {"Authorization": f"Bearer {os.environ['SYNTHORAI_API_KEY']}"}

task = requests.post(f"{BASE}/videos", headers=auth, json={
    "model": "seedance-1-5-pro-251215",
    "prompt": "A paper boat drifting across a rain puddle, cinematic",
    "resolution": "720p", "ratio": "16:9",
    "duration": 5, "generate_audio": True,
}).json()                                    # returns in ~2s: {"id": "vid_...", "status": "queued", ...}

while task["status"] not in ("completed", "failed", "cancelled"):
    time.sleep(8)
    task = requests.get(f"{BASE}/videos/{task['id']}", headers=auth).json()

print(task["data"][0]["url"])                # signed MP4, valid 24h
print(task["usage"]["total_tokens"])         # the billing meter this post is about

Si tu préfères bloquer plutôt qu’interroger en boucle, envoie un header Prefer: wait=60 à la création : la réponse reste ouverte jusqu’à ce que le clip soit prêt ou que la fenêtre expire, puis retombe sur l’objet de polling. La génération elle-même a pris entre 20 secondes et un peu plus de deux minutes pour les clips 480p et 720p de nos tests. Le champ usage.total_tokens de la tâche terminée est le compteur de facturation, et le reste de cet article explique ce qui le fait varier.

Un token vidéo, c’est quoi exactement ?

Un token vidéo est une tranche fixe de pixels de sortie dans le temps : le nombre facturé vaut W × H × frames / 1024, où le nombre de frames est 24 × secondes + 1 et W×H sont les dimensions réelles de l’encodeur, pas l’étiquette du palier de résolution. On a retrouvé les deux termes à partir du compteur lui-même. Le nombre de tokens facturés sur trois durées, à chaque résolution, s’aligne parfaitement sur une droite sans résidu ; la pente de la droite donne les tokens par seconde, et son ordonnée à l’origine, à chaque résolution, vaut exactement une frame de tokens (405 en 480p, 858 en 720p, 2 040 en 1080p). En résolvant les pentes pour W×H, on obtient les vraies grilles encodées :

Palier nominalDimensions encodées (mesurées)Tokens par secondeUne frame supplémentaire
480p864×480 (série 1.0) / 864×496 (série 1.5/2.0)9 720 / 10 044405 / 418
720p1248×704 (et non 1280×720)20 592858
1080p1920×1088 (et non 1920×1080)48 9602 040
4k3840×2160 (nominal = encodé)194 4008 100

Un contrôle croisé indépendant : l’exemple chiffré largement diffusé par ByteDance pour la 2.0, un clip de 15 secondes à environ 308 880 tokens, vaut exactement 15 fois notre débit 720p mesuré. La grille 720p tient donc au-delà de la série 1.0 sur laquelle on l’a calée (et leur calcul marketing oublie la frame +1).

Deux conséquences pratiques. Le ratio d’aspect ne change rien à la facture : le 16:9 et le 9:16 ont facturé un nombre de tokens identique dans les neuf paires de tests, donc sortir en vertical n’est pas une décision de coût. Et l’approximation souvent citée W × H × 24 × duration / 1024 sous-estime d’une frame et utilise les mauvaises dimensions, ce qui explique pourquoi les estimations tierces s’écartent de quelques pour cent des factures réelles.

Combien coûte réellement Seedance à la seconde ?

En multipliant les débits de tokens mesurés par le tarif catalogue de chaque palier, tout le catalogue se résume à une seule échelle :

Modèle @ résolution$/seconde (tokens mesurés × tarif catalogue)
seedance-1.0-pro-fast @ 480p$0.0097
seedance-1.5-pro @ 480p, sans audio$0.0121
seedance-1.0-pro-fast @ 720p$0.0206
seedance-1.5-pro @ 480p, avec audio$0.0241
seedance-2.0-mini @ 480p$0.0352
seedance-1.0-pro-fast @ 1080p$0.0490
seedance-2.0-fast @ 480p$0.0563
seedance-2.0 @ 480p$0.0703
seedance-2.0 @ 4k$0.778

Pour situer face aux prix catalogue de juillet 2026 des modèles facturés à la seconde (agrégés par des trackers de prix publics) : Kling tourne autour de $0.07/s, Sora 2 autour de $0.10/s et Veo 3.1 autour de $0.40/s. Seedance 2.0 en 480p se place au niveau de prix de Kling, audio multi-piste natif inclus, et le palier 1.0-fast génère du 480p regardable à environ un septième du tarif de Kling. Un clip 720p de 15 secondes en 2.0 revient à environ $2.17 ; le même clip en 1.0-pro-fast coûte $0.31.

Le 4k est-il moins cher ? Le tarif dit oui, la facture dit non

Le 4k affiche le tarif par token le plus bas sur Seedance 2.0, $4.0 par million contre $7.7 pour le 1080p, et il reste malgré tout l’option la plus chère du menu. La raison tient à la formule : le 4k émet environ quatre fois plus de tokens par seconde que le 1080p (194 400 contre 48 960), si bien que le tarif plus bas se traduit par un coût par seconde multiplié par 2,1, soit $0.778/s contre $0.377/s. Notre référence 4k de 4 secondes a facturé 785 700 tokens, $3.14 pour quatre secondes de vidéo. Prenez n’importe quel tarif par token et posez à côté le nombre de tokens par seconde de la résolution concernée ; sur de la vidéo facturée au token, l’étiquette et la facture peuvent pointer dans des directions opposées.

Qu’est-ce que change generate_audio ?

Le tarif, pas les tokens. Sur 1.5-pro, le même clip de 5 secondes a facturé 50 638 tokens audio activé et 50 638 audio désactivé ; le tarif catalogue double, de $1.2/M en silencieux à $2.4/M avec audio, donc une sortie sonorisée coûte exactement 2x, proprement, sans surcoût caché en tokens. Sur la série 2.0, l’audio fait partie du tarif unique du modèle, il n’y a donc aucun calcul de bascule à faire. Si votre pipeline ajoute de toute façon sa propre bande sonore, 1.5-pro en silencieux à $0.0121/s est la bonne affaire discrète du catalogue.

Comment se comporte la facturation des vidéos en async ?

La facturation s’accroche au cycle de vie de la tâche vu plus haut : la facture tombe une seule fois, au moment où la tâche passe pour la première fois à l’état completed, peu importe le nombre de polls. L’annulation est honnête sur le plan physique : une tâche en file d’attente s’annule proprement et ne facture rien, mais une fois la tâche en cours d’exécution, l’upstream refuse la suppression (409) et vous devez attendre le résultat. Les générations en échec ne sont pas facturées.

Trois remarques opérationnelles tirées de 27 tâches lancées. D’abord, les réponses vidéo portent l’usage en tokens mais aucun champ de coût, contrairement au usage.cost du chat ; budgétez en tokens × le tarif de votre palier. Ensuite, la sortie arrive sous forme d’URL signée avec une durée de vie de 24 heures ; déplacez-la rapidement vers votre propre stockage. Enfin, cadencez vos créations : la plateforme autorise 6 tâches vidéo par workspace et par minute, et comme chaque tâche en attente réserve son coût dans le pire des cas sur votre solde, lancer une rafale de créations pendant un ralentissement de l’upstream peut se heurter à une réponse temporaire d’insufficient-quota même si la dépense finale reste correcte.

FAQ

L’API Seedance 2.0 est-elle réellement disponible ?

Oui. Le récit d’accès de début 2026 (identifiants chinois, listes d’attente, déploiement progressif) est dépassé : toute la famille, 2.0 comprise, est en ligne sur l’endpoint /v1/videos de la gateway Synthorai aux tarifs catalogue ByteDance (pages modèles : Seedance 2.0, 1.5-pro, 1.0-pro-fast), et plusieurs autres plateformes le proposent aussi. Si une page indique que Seedance 2.0 est réservé au quota d’essai, c’est qu’elle date d’avant le déploiement de l’API.

Pourquoi les prix Seedance varient-ils autant d’un fournisseur à l’autre ?

Parce que la plupart des revendeurs convertissent la facturation au token en prix fixe à la seconde ou au clip, avec leur propre marge et leurs arrondis, et cette conversion masque le calcul de tokens qui dépend de la résolution et de la durée. La formule de cet article est la vérité brute qui sous-tend chaque devis : calculez W × H × (24s + 1) / 1024 avec les dimensions encodées et multipliez par le tarif officiel, et vous chiffrez précisément la marge de n’importe quel fournisseur.

Le ratio d’aspect ou un format vertical coûte-t-il plus cher ?

Non. Le 16:9 et le 9:16 facturent le même nombre de tokens à chaque résolution et durée que nous avons testée. La résolution et la durée sont les seuls leviers qui font bouger le compteur, et la durée est parfaitement linéaire.

Et Seedance 2.5 ?

Annoncé, mais pas encore servi sur les API que nous suivons. La formule de tokens et la structure paliers/tarif sont les éléments qui ont le plus de chances de se retrouver à l’identique ; dès qu’il arrivera, nous relancerons les mêmes tests.

Mesures du 22-23/07/2026 : 27 générations terminées sur cinq modèles Seedance via /v1/videos, comptes de tokens issus des relevés d’usage par tâche, tarifs du catalogue ByteDance, et matrice de capacités tirée du catalogue live /v1/videos/models. Les chiffres à la seconde des concurrents sont des prix catalogue, pas des mesures. Les ajustements de la formule sont exacts sur chaque point mesuré ; les dimensions encodées sont reconstruites à partir du compteur, à revérifier donc si ByteDance change d’encodeurs. Pour le reste de la série sur les modalités : génération d’images, transcription audio, sessions vocales et tokens de texte.

← Retour au blog