Usage et facturation
Les quotas et statistiques d'usage sont disponibles dans la Console et via le payload de réponse de chaque requête.
Usage dans la réponse
Chaque réponse non-streaming inclut un usage objet :
"usage": {
"prompt_tokens": 120,
"completion_tokens": 45,
"total_tokens": 165
} Quota
Le quota est mesuré en tokens. Les administrateurs définissent les quotas par utilisateur depuis Console → Membres. Les utilisateurs peuvent surveiller leur quota restant dans Console → Limites et facturation.
Les réponses en streaming n'incluent pas de champ usage dans les chunks intermédiaires. Un résumé synthétique final d'usage est disponible dans le dernier chunk avant data: [DONE].
Transformer le nombre de tokens en budget ? Indiquez vos volumes mensuels dans le LLM API cost calculator, ou consultez les tarifs par token dans le model price comparison.