Voir les finalités
Les dépenses par équipe, par modèle et par clé, réparties par finalité, avec la prévision de fin de mois et ce que le cache a fait économiser.
Budgets, enveloppes et approbations maîtrisent les dépenses. Garde-fous et classification des données protègent les données. Un journal d'audit où toute altération se voit consigne chaque modification faite dans la console et garde la preuve. Le tout fonctionne en instance dédiée gérée ou dans votre propre réseau.
La passerelle classe chaque appel par finalité : code, analyse, rédaction, recherche, loisirs ou autre. Personne n'a de formulaire à remplir. Les dépenses s'affichent par équipe et par finalité, au tarif public, si bien que la direction financière et l'ingénierie voient le même chiffre.
Les dépenses par équipe, par modèle et par clé, réparties par finalité, avec la prévision de fin de mois et ce que le cache a fait économiser.
Les loisirs au-delà de 2 % notifient le responsable d'équipe. Le palier le plus élevé au-delà de 30 % demande une approbation. Un budget épuisé bloque.
Avec model=auto, une recherche part vers un palier moins cher et une longue analyse vers un modèle plus grand. Chaque décision enregistre son motif.
Cinq autres parties de la même passerelle.
Vos équipes ne changent que leur URL de base et leur clé. Derrière se trouvent les modèles de notre catalogue, les fournisseurs sur vos propres clés et les modèles de votre réseau. La passerelle surveille l'état de chaque amont et bascule vers un autre si nécessaire.
claude-opus-5gpt-5.4deepseek-v4.1 L'organisation a un plafond, les équipes un total, les finalités une part et les personnes une enveloppe quotidienne. Quand l'une de ces limites est dépassée, la passerelle le signale et agit.
Des packs de règles vérifient requêtes et réponses : injection de prompt, données personnelles, secrets et clés, sujets interdits, votre propre liste de mots. Commencez en détection seule, voyez ce qui aurait été fait, puis appliquez.
block 286 mask 912 block 248 detect 6 Avec model=auto, la passerelle lit la requête, choisit un palier et un modèle, et enregistre pourquoi. L'URL de base, le SDK et le tarif public restent les mêmes : une politique de routage peut donc changer sans toucher au code.
# Remplacement direct : une seule ligne change.
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto" Vos collaborateurs se connectent en SSO et leurs comptes sont provisionnés par SCIM ; les rôles viennent des groupes de l'IdP. Chaque modification faite dans la console est inscrite dans un journal d'audit en chaîne de hachage.
Azure eastus 100 → 50 Mark Davis · 3 clés Sarah Brooks · 10 $ → 15 $ par jour Modèle juge → règles locales Votre propre instance, exploitée par nous. Zéro rétention par défaut, ou la politique de conservation que vous fixez. Ancrage régional aux États-Unis, dans l'UE ou en APAC.
Le produit complet, passerelle et console, dans votre VPC ou votre centre de données. Les requêtes ne sortent que vers les fournisseurs que vous autorisez.
Vous choisissez les endpoints du classifieur de routage, du modèle juge et de l'étiqueteur de prompts. La passerelle n'accepte pour eux que HTTPS ou une adresse privée : un prompt ne traverse donc pas l'internet public sans chiffrement.
Voici les contrôles que chaque référentiel demande et la fonction qui fournit chacun d'eux. Ils appuient votre évaluation et ne constituent pas une certification.
Indiquez-nous la taille de votre équipe, les fournisseurs que vous utilisez et où la solution doit être hébergée. Le DPA est disponible sur demande.