Verla
Gasto por equipo, modelo y clave, desglosado por intención, con la previsión a fin de mes y lo que ahorró la caché.
Presupuestos, asignaciones y aprobaciones controlan el gasto. Los guardrails y la clasificación de datos protegen los datos. Un registro de auditoría de cada cambio en la consola, que delata cualquier alteración, conserva la prueba. Funciona como instancia dedicada gestionada o dentro de tu propia red.
La pasarela clasifica cada llamada por su intención: programación, análisis, redacción, consulta, ocio u otros. Nadie rellena un formulario. El gasto se muestra por equipo y por intención a precio de lista, así que Finanzas e Ingeniería ven la misma cifra.
Gasto por equipo, modelo y clave, desglosado por intención, con la previsión a fin de mes y lo que ahorró la caché.
Ocio por encima del 2 % avisa al responsable de equipo. El nivel superior por encima del 30 % exige aprobación. Un presupuesto agotado bloquea.
Con model=auto, una consulta va a un nivel más barato y un análisis largo a un modelo mayor. Cada decisión deja constancia del porqué.
Otras cinco partes de la misma pasarela.
Cada usuario solo cambia su URL base y su clave. Detrás están los modelos de nuestro catálogo, los proveedores con tus propias claves y los modelos dentro de tu red. La pasarela vigila la salud de cada upstream y hace failover a otro.
claude-opus-5gpt-5.4deepseek-v4.1 La organización tiene un tope, los equipos un total, las intenciones una parte y cada persona una asignación diaria. Cuando alguno se supera, la pasarela lo notifica y actúa.
Los paquetes de reglas revisan solicitudes y respuestas: inyección de prompts, datos personales, secretos y claves, temas vetados, tu propia lista de palabras. Empieza en modo solo detección, mira qué habría hecho y luego ponlo en vigor.
block 286 mask 912 block 248 detect 6 Con model=auto la pasarela lee la solicitud, elige un nivel y un modelo y registra el porqué. La URL base, el SDK y el precio de lista no cambian, así que una política de enrutamiento puede cambiar sin tocar el código.
# Reemplazo directo: cambia una sola línea.
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto" Los usuarios inician sesión con SSO y se aprovisionan por SCIM, y los roles vienen de los grupos del IdP. Cada cambio hecho en la consola queda en un registro de auditoría con cadena de hashes.
Azure eastus 100 → 50 Mark Davis · 3 claves Sarah Brooks · 10 $ → 15 $ al día Modelo juez → reglas locales Tu propia instancia, operada por nosotros. Retención cero por defecto, o la política de retención que fijes. Fijación de región en EE. UU., la UE o APAC.
El producto completo, pasarela y consola, en tu VPC o tu centro de datos. Las solicitudes solo salen hacia los proveedores que permitas.
Tú eliges los endpoints del clasificador de enrutamiento, del modelo juez y del etiquetador de prompts. La pasarela solo acepta para ellos HTTPS o una dirección privada, así que un prompt no cruza la internet pública sin cifrar.
Estos son los controles que pide cada marco y la función que aporta cada uno. Sirven de apoyo a tu evaluación y no son una certificación.
Cuéntanos el tamaño de tu equipo, los proveedores que usas y dónde tiene que ejecutarse. El DPA está disponible a petición.