Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.
Tarification de l’API Seedance : la formule des tokens vidéo vérifiée par la mesure

Tarification de l’API Seedance : la formule des tokens vidéo vérifiée par la mesure

Sommaire
  1. À quoi sert chaque modèle Seedance ?
  2. Comment appeler l’API Seedance ?
  3. Qu’est-ce qu’un token vidéo, exactement ?
  4. Combien coûte réellement Seedance par seconde ?
  5. La 4k est-elle moins chère ? Oui sur la grille tarifaire, non sur la facture
  6. Que change generate_audio ?
  7. Comment fonctionne la facturation des tâches vidéo asynchrones ?
  8. FAQ

Seedance facture la génération vidéo en tokens. La formule qui correspond réellement au compteur est encoded_width × encoded_height × (24 × seconds + 1) / 1024. Deux éléments ne figurent dans aucune documentation que nous ayons trouvée : la frame supplémentaire +1 et le fait que les dimensions encodées diffèrent des dimensions nominales. Le 720p, par exemple, est facturé en 1248×704 et non en 1280×720. Nous avons lancé 27 générations sur cinq modèles Seedance et tous les niveaux de résolution. Chaque nombre de tokens facturé correspond exactement à cette formule, au token près. Cet article présente les différents modèles, l’API en deux requêtes, la formule complète, les prix à la seconde qui en découlent et les deux points sur lesquels la grille tarifaire prête à confusion.

TL;DR

  • Tokens vidéo Seedance = largeur encodée × hauteur encodée × (24 × secondes + 1) / 1024 ; la frame supplémentaire et les dimensions encodées proviennent de nos mesures, pas de la documentation.
  • Le 720p est facturé en 1248×704 et le 1080p en 1920×1088 ; le ratio d’image ne change rien.
  • Un même clip de 4 secondes a consommé exactement le même nombre de tokens sur tous les modèles à partir de 1.5-pro ; les tarifs vont de $1.0 à $7.0 par million.
  • Le tarif de la 4k, $4.0/M, est inférieur à celui du 1080p, $7.7/M, mais son coût atteint $0.78 par seconde contre $0.38, soit 2.1x plus.
  • generate_audio ne change pas le nombre de tokens et double le tarif sur 1.5-pro.

Toutes les mesures ci-dessous ont été réalisées le 2026-07-22 via l’endpoint /v1/videos de la gateway Synthorai. La gamme Seedance y est disponible aux tarifs publics de ByteDance. Chaque chiffre repose sur les données brutes des tâches correspondantes.

À quoi sert chaque modèle Seedance ?

Le modèle choisi modifie le tarif, jamais le compteur. Il faut donc choisir selon les fonctionnalités, puis appliquer les calculs des sections suivantes. Avec le même prompt en 480p pendant 4 secondes, Seedance 2.0, 2.0-fast, 2.0-mini et 1.5-pro ont tous facturé 40,594 tokens. 1.0-pro-fast en a facturé 39,285, car sa grille de pixels est légèrement plus petite. Monter en gamme permet surtout d’accéder à davantage de fonctionnalités, dont la répartition reste assez inégale :

RésolutionsDuréeAudioImage en entréeseed / camera_fixedTarif ($/M tokens)
2.0480p-4k4-15s (+auto)✓ natifpremière + dernière frame$7.0 (1080p $7.7 · 4k $4.0)
2.0-fast480p-720p4-15s (+auto)première + dernière frame$5.6
2.0-mini480p-720p4-15s (+auto)première + dernière frame$3.5
1.5-pro480p-1080p4-12s (+auto)optionnel ($1.2 / $2.4)première + dernière frame$1.2-2.4
1.0-pro-fast480p-1080p2-12spremière frame uniquement$1.0

Trois particularités sont à connaître avant de choisir. D’abord, la reproductibilité évolue à contre-courant de la gamme : seed et camera_fixed ne sont disponibles que sur les modèles 1.x. Les modèles les moins chers sont donc contrôlables, contrairement au modèle haut de gamme. Ensuite, les champs pris en charge sont strictement limités selon le modèle. Envoyer generate_audio à un modèle 1.0 renvoie une erreur 400 explicite (extension_not_supported). Il faut donc construire chaque requête à partir des fonctionnalités du modèle plutôt qu’utiliser un payload commun. Enfin, seul 1.0-pro-fast permet de descendre à 2 secondes, d’où son utilisation fréquente dans les mesures de formule ci-dessous. Tous les modèles plus récents commencent à 4 secondes. En plus des fonctions du tableau, les modèles 2.0 acceptent aussi en amont des fichiers de référence lorsqu’une plateforme le permet : jusqu’à 9 images, 3 clips vidéo et 3 fichiers audio.

Comment appeler l’API Seedance ?

La génération vidéo passe par une API de jobs asynchrones. Un POST crée la tâche et répond en deux secondes environ. Il suffit ensuite d’interroger régulièrement l’URL de la tâche jusqu’à son achèvement. Voici le flux complet en Python :

import os, time, requests

BASE = "https://synthorai.io/v1"
auth = {"Authorization": f"Bearer {os.environ['SYNTHORAI_API_KEY']}"}

task = requests.post(f"{BASE}/videos", headers=auth, json={
    "model": "seedance-1-5-pro-251215",
    "prompt": "A paper boat drifting across a rain puddle, cinematic",
    "resolution": "720p", "ratio": "16:9",
    "duration": 5, "generate_audio": True,
}).json()                                    # returns in ~2s: {"id": "vid_...", "status": "queued", ...}

while task["status"] not in ("completed", "failed", "cancelled"):
    time.sleep(8)
    task = requests.get(f"{BASE}/videos/{task['id']}", headers=auth).json()

print(task["data"][0]["url"])                # signed MP4, valid 24h
print(task["usage"]["total_tokens"])         # the billing meter this post is about

Pour bloquer la requête plutôt que faire du polling, ajoutez le header Prefer: wait=60 lors de la création. La réponse reste alors ouverte jusqu’à ce que le clip soit prêt ou que le délai expire. Dans ce dernier cas, elle revient au même objet prévu pour le polling. Lors de nos tests, la génération des clips 480p et 720p a pris entre 20 secondes et un peu plus de deux minutes. Le champ usage.total_tokens de la tâche terminée contient la valeur utilisée pour la facturation. La suite de l’article détaille les paramètres qui la déterminent.

Qu’est-ce qu’un token vidéo, exactement ?

Un token vidéo correspond à une quantité fixe de pixels générés dans le temps. Le nombre facturé est W × H × frames / 1024, avec frames égal à 24 × seconds + 1. W×H représente les dimensions réelles de l’encodeur, pas celles annoncées par le niveau de résolution. Nous avons retrouvé ces deux termes directement à partir du compteur. Pour chaque résolution, les nombres de tokens facturés sur trois durées suivent une droite sans aucun résidu. Sa pente donne le nombre de tokens par seconde. Son ordonnée à l’origine correspond exactement, pour chaque résolution, à une frame supplémentaire : 405 tokens en 480p, 858 en 720p et 2,040 en 1080p. En repartant des pentes pour résoudre W×H, on obtient les grilles encodées réelles :

Niveau nominalDimensions encodées (mesurées)Tokens par secondeFrame supplémentaire
480p864×480 (gamme 1.0) / 864×496 (gammes 1.5/2.0)9,720 / 10,044405 / 418
720p1248×704 (et non 1280×720)20,592858
1080p1920×1088 (et non 1920×1080)48,9602,040
4k3840×2160 (dimensions nominales = encodées)194,4008,100

Autre vérification indépendante : l’exemple de calcul ByteDance largement repris pour 2.0, un clip de 15 secondes à environ 308,880 tokens, correspond exactement à 15 fois notre valeur mesurée en 720p. La grille 720p reste donc valable au-delà de la gamme 1.0 utilisée pour l’ajustement. Leur calcul marketing omet toutefois la frame +1.

Il en découle deux conséquences pratiques. Premièrement, le ratio d’image n’a aucun effet sur la facture. Les formats 16:9 et 9:16 ont consommé le même nombre de tokens lors des neuf paires de tests. Le format vertical n’est donc pas un choix tarifaire. Deuxièmement, l’approximation courante W × H × 24 × duration / 1024 sous-estime la consommation d’une frame et utilise de mauvaises dimensions. C’est ce qui explique l’écart de quelques pourcents entre les estimations de services tiers et les factures réelles.

Combien coûte réellement Seedance par seconde ?

En multipliant les débits de tokens mesurés par le tarif de chaque niveau, toute la gamme se résume au barème suivant :

Modèle @ résolution$/seconde (tokens mesurés × tarif public)
seedance-1.0-pro-fast @ 480p$0.0097
seedance-1.5-pro @ 480p, sans audio$0.0121
seedance-1.0-pro-fast @ 720p$0.0206
seedance-1.5-pro @ 480p, avec audio$0.0241
seedance-2.0-mini @ 480p$0.0352
seedance-1.0-pro-fast @ 1080p$0.0490
seedance-2.0-fast @ 480p$0.0563
seedance-2.0 @ 480p$0.0703
seedance-2.0 @ 4k$0.778

À titre de comparaison avec les tarifs publics de juillet 2026 des services facturés à la seconde, tels que recensés par les comparateurs de tarifs publics : Kling coûte environ $0.07/s, Sora 2 environ $0.10/s et Veo 3.1 environ $0.40/s. Seedance 2.0 en 480p se place au niveau de Kling, tout en incluant nativement l’audio multipiste. Le niveau 1.0-fast produit du 480p exploitable pour environ un septième du tarif de Kling. Un clip 720p de 15 secondes coûte environ $2.17 sur 2.0, contre $0.31 sur 1.0-pro-fast.

La 4k est-elle moins chère ? Oui sur la grille tarifaire, non sur la facture

Sur Seedance 2.0, la 4k bénéficie du tarif par token le plus faible : $4.0 par million, contre $7.7 pour le 1080p. Elle reste pourtant l’option la plus chère. La formule l’explique : la 4k produit environ quatre fois plus de tokens par seconde que le 1080p, soit 194,400 contre 48,960. Malgré son tarif réduit, elle revient donc 2.1x plus cher à la seconde : $0.778/s contre $0.377/s. Notre mesure de référence en 4k, sur 4 secondes, a consommé 785,700 tokens, soit $3.14 pour quatre secondes de vidéo. Pour interpréter une grille tarifaire par token, il faut toujours placer à côté le nombre de tokens par seconde de la résolution concernée. Avec la vidéo facturée au token, le tarif affiché et le coût final peuvent évoluer en sens inverse.

Que change generate_audio ?

Le tarif change, pas les tokens. Sur 1.5-pro, le même clip de 5 secondes a consommé 50,638 tokens avec l’audio activé et 50,638 sans audio. Le tarif public double, de $1.2/M en mode silencieux à $2.4/M avec audio. Une sortie sonorisée coûte donc exactement 2x plus cher, sans surcharge cachée en tokens. Sur la gamme 2.0, l’audio est compris dans le tarif unique du modèle ; aucun calcul lié à une option n’est nécessaire. Si votre pipeline ajoute déjà sa propre musique, 1.5-pro sans audio à $0.0121/s est l’option discrètement la plus économique du catalogue.

Comment fonctionne la facturation des tâches vidéo asynchrones ?

La facturation suit le cycle de vie de la tâche présenté plus haut. Elle n’est appliquée qu’une fois, lorsque la tâche passe pour la première fois à l’état terminé, quel que soit le nombre de requêtes de polling. L’annulation respecte l’état réel du traitement : une tâche encore en file d’attente peut être annulée sans frais. Dès qu’elle est en cours d’exécution, le service amont refuse sa suppression avec une erreur 409 et il faut attendre le résultat. Les générations en échec ne sont pas facturées.

Nos 27 tâches ont aussi fait ressortir trois points opérationnels. Premièrement, les réponses vidéo incluent l’usage en tokens mais aucun champ de coût, contrairement au champ usage.cost du chat. Pour budgéter, multipliez les tokens par le tarif du niveau concerné. Deuxièmement, la sortie est fournie sous forme d’URL signée valable 24 heures. Copiez rapidement le fichier dans votre propre stockage. Troisièmement, espacez les créations de tâches : la plateforme autorise 6 tâches vidéo par workspace et par minute. Chaque tâche en attente réserve sur le solde le coût maximal possible. Lorsqu’un ralentissement en amont fait s’accumuler les créations, une réponse temporaire de quota insuffisant peut donc survenir, même si la dépense finale reste dans les limites du budget.

FAQ

L’API Seedance 2.0 est-elle réellement disponible ?

Oui. Les conditions d’accès du début de l’année 2026, avec identifiants chinois, listes d’attente et déploiement progressif, ne sont plus d’actualité. Toute la gamme, y compris 2.0, est disponible sur l’endpoint /v1/videos de la gateway Synthorai aux tarifs publics de ByteDance. Pages des modèles : Seedance 2.0, 1.5-pro et 1.0-pro-fast. Plusieurs autres plateformes les proposent également. Toute page affirmant que Seedance 2.0 est uniquement accessible via un quota d’expérimentation est antérieure au lancement de l’API.

Pourquoi les tarifs Seedance varient-ils autant selon les fournisseurs ?

La plupart des revendeurs transforment la facturation au token en tarif fixe par seconde ou par clip, avec leur propre marge et leurs règles d’arrondi. Cette conversion masque le calcul des tokens, qui dépend de la résolution et de la durée. La formule de cet article permet de retrouver le coût réel derrière chaque devis : calculez W × H × (24s + 1) / 1024 à partir des dimensions encodées, puis multipliez le résultat par le tarif officiel. Vous pourrez ainsi mesurer précisément la marge de n’importe quel fournisseur.

Le ratio d’image ou le format vertical coûtent-ils plus cher ?

Non. Les formats 16:9 et 9:16 ont consommé exactement le même nombre de tokens pour toutes les résolutions et durées testées. Seules la résolution et la durée font varier le compteur, et l’effet de la durée est strictement linéaire.

Et Seedance 2.5 ?

Il a été annoncé, mais n’est pas encore proposé par les API que nous suivons. La formule des tokens et la structure séparant niveau de résolution et tarif devraient rester valables. Nous referons les mêmes mesures dès sa disponibilité.

Mesures réalisées les 2026-07-22/23 : 27 générations terminées sur cinq modèles Seedance via /v1/videos, nombres de tokens issus des données d’usage de chaque tâche, tarifs publics de ByteDance et matrice de fonctionnalités tirée du catalogue /v1/videos/models en production. Les coûts à la seconde des concurrents correspondent à leurs tarifs publics, pas à nos mesures. La formule correspond exactement à chaque point mesuré. Les dimensions encodées ont été déduites du compteur ; vérifiez-les à nouveau si ByteDance change d’encodeur. Autres articles de cette série par modalité : génération d’images, transcription audio, sessions vocales et tokens de texte.

← Retour au blog