Chaque modèle. Prix réels, zéro majoration.
Comparez des prix transparents à l’usage sur 9 fournisseurs · 107 modèles, USD par million de tokens. En direct depuis /api/pricing.
OpenAI
27 modèlesAnthropic
10 modèlesAlibaba
20 modèlesDeepSeek
2 modèlesMoonshot
3 modèlesMiniMax
1 modèleZ.ai
4 modèlesByteDance
14 modèlesNotes de tarification
- Tous les prix sont en USD. La facturation est basée sur l’usage réel des tokens.
- Tokens d’entrée = votre prompt. Tokens de sortie = la réponse du modèle.
- Tarification par paliers : l’ensemble des tokens d’une requête est facturé au tarif du palier dans lequel se situe son entrée. Les entrées plus grandes passent à un palier supérieur.
- Cache hit : lorsqu’un même préfixe de prompt est réutilisé (mise en cache du contexte), les tokens d’entrée sont facturés au tarif réduit Cache/1M indiqué ci-dessus.
- Les modèles de génération d’image et d’audio sont facturés par appel API.
- Remises sur volume disponibles pour les entreprises. Contactez-nous.
Modèle trouvé ? Lancez votre premier appel en 60 secondes.
Obtenez votre clé API, gratuitFoire aux questions
Comment comparer les prix des API LLM entre fournisseurs ?
La page Modèles de Synthorai est une comparaison de prix en temps réel entre tous les grands fournisseurs — triez par prix d'entrée ou de sortie par million de tokens, filtrez par fournisseur, toujours synchronisé avec les tarifs publics réels de la passerelle. Chaque montant correspond exactement à ce qu'une requête débite de votre solde, avec 0 % de supplément de plateforme.
Quels fournisseurs d'API LLM Synthorai prend-il en charge ?
Synthorai est une passerelle IA multimodale : une seule API et une seule facture pour GPT (OpenAI), Claude (Anthropic), Gemini (Google), Qwen (Alibaba), DeepSeek et d'autres, en chat, image et audio, avec cache de prompts natif, BYOK et rétention des données nulle par défaut. Le tableau ci-dessus liste chaque modèle avec son tarif en temps réel.
Quelle est l'API LLM la moins chère ?
Le tableau ci-dessus est trié par tarif public, vous pouvez donc choisir le modèle le moins cher qui répond à vos exigences de qualité. Le cache de prompts facture les lectures en cache à environ 10 % du prix d'entrée, et il n'y a aucun frais de plateforme — le coût effectif est donc souvent inférieur à celui d'un agrégateur au même tarif public.