Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

Controla el gasto.Protege los datos.Conserva la prueba.

Presupuestos, asignaciones y aprobaciones controlan el gasto. Los guardrails y la clasificación de datos protegen los datos. Un registro de auditoría de cada cambio en la consola, que delata cualquier alteración, conserva la prueba. Funciona como instancia dedicada gestionada o dentro de tu propia red.

Aprobaciones Tres solicitudes esperan tu respuesta. Presupuesto del equipo: 300,00 $ al día.
  • Emily Carter Asignación diaria 20,00 $ → 50,00 $ · extracción de contratos del trimestre Lo pidió dos veces antes, ambas aprobadas · al equipo le quedan 248,00 $ de 300,00 $
    Escala en 4 h Rechazar Aprobar
  • Jason Miller Acceso a claude-opus-5 · 30 días Primera vez que lo pide · ayer gastó 4,10 $ de una asignación de 20,00 $
    Rechazar Aprobar
  • Sarah Brooks Asignación diaria 20,00 $ → 400,00 $ Supera los 300,00 $ al día del equipo, así que aprobarlo lo envía a un administrador
    Va a un administrador Rechazar Aprobar

Saber para qué usa la IA tu empresa

La pasarela clasifica cada llamada por su intención: programación, análisis, redacción, consulta, ocio u otros. Nadie rellena un formulario. El gasto se muestra por equipo y por intención a precio de lista, así que Finanzas e Ingeniería ven la misma cifra.

  • Logs: una fila por llamada. Ábrela para ver la decisión de enrutamiento, las coincidencias de guardrail y el coste.
  • Donde se conservan los cuerpos, nadie lee un prompt sin un permiso de revisión de duración limitada, y cada lectura queda en el registro de auditoría.
  • Las exportaciones envían el registro de cada solicitud a S3 o a un colector OTLP.
Equipos × intenciones Este mes, a precio de lista
Equipo Reparto por intención Gastado / presupuesto
I+D Programación 72% $4,812 / $8,000
Ventas Redacción 46% $3,960 / $4,500
Soporte Redacción 38% $3,120 / $6,000

Verla

Gasto por equipo, modelo y clave, desglosado por intención, con la previsión a fin de mes y lo que ahorró la caché.

Ponerle políticas

Ocio por encima del 2 % avisa al responsable de equipo. El nivel superior por encima del 30 % exige aprobación. Un presupuesto agotado bloquea.

Enrutar según ella

Con model=auto, una consulta va a un nivel más barato y un análisis largo a un modelo mayor. Cada decisión deja constancia del porqué.

Qué más hace la edición Enterprise.

Otras cinco partes de la misma pasarela.

Una sola URL base delante de todos los modelos

Cada usuario solo cambia su URL base y su clave. Detrás están los modelos de nuestro catálogo, los proveedores con tus propias claves y los modelos dentro de tu red. La pasarela vigila la salud de cada upstream y hace failover a otro.

  • El catálogo indica cuánto cuesta cada modelo y qué hace cada upstream con tus datos: sin retención, puede retener o se queda dentro.
  • Acceso a modelos por equipo: permitido, con aprobación o bloqueado. Gana la primera regla que coincide.
  • Pasa un equipo a sin retención y los upstreams que pueden retener datos se desactivan para ese equipo. El modelo privado sigue disponible.
  • BYOK está incluido, y las claves de proveedor personales se pueden permitir o desactivar para toda la instancia.
Equipos × modelos Las celdas salen de las reglas; cambia las reglas, no las celdas
Equipo claude-opus-5gpt-5.4deepseek-v4.1
Soporte BloqueadoPermitidoPermitido
I+D Con aprobaciónPermitidoPermitido
Ventas Con aprobaciónPermitidoPermitido

Presupuestos que actúan antes de la factura

La organización tiene un tope, los equipos un total, las intenciones una parte y cada persona una asignación diaria. Cuando alguno se supera, la pasarela lo notifica y actúa.

  • Umbrales de alerta al 50, 80 y 95 % del tope. Cuando se agota, las solicitudes nuevas se rechazan con un 402, o se atienden y se marcan: tú eliges.
  • Políticas por intención: avisar al responsable de equipo, exigir aprobación, enrutar a un nivel más barato o bloquear.
  • Una subida temporal se revierte sola. La solicitud de un límite más alto va al responsable de equipo y, si pasan 24 horas sin decisión, a un administrador. Cada una la decide una persona.
  • Centros de coste y un extracto mensual para Finanzas, con el gasto sin asignar listado por clave.
Políticas por intención Se comprueban en cada solicitud, antes de reenviarla
  • Ocio parte por encima del 2 % · todos los equipos Avisar al responsable
  • Análisis nivel superior por encima del 30 % · I+D Con aprobación
  • Consulta parte por encima del 10 % · Soporte Nivel más barato
  • Cualquier intención presupuesto agotado · todos los equipos Bloquear

Guardrails con modelo juez y un registro de herramientas

Los paquetes de reglas revisan solicitudes y respuestas: inyección de prompts, datos personales, secretos y claves, temas vetados, tu propia lista de palabras. Empieza en modo solo detección, mira qué habría hecho y luego ponlo en vigor.

  • Cuatro acciones: bloquear, enmascarar, orientar o detectar. Orientar le dice a la persona qué hacer en su lugar, sin cambiar lo que recibe el modelo.
  • Un modelo juez revisa cada coincidencia por encima de un umbral de confianza, con el texto previamente ocultado. Si el juez va lento o está caído, esa solicitud pasa, queda registrada y genera una alerta de gravedad alta.
  • Clasificación de datos: cuatro niveles y tus propias reglas. Cada nivel dice a qué modelos puede llegar.
  • Los servidores MCP y las skills se registran; uno sin registrar se anota o se bloquea. Las alertas van a Slack, correo, Feishu o PagerDuty, y al desactivar una clave se ve primero qué dejaría de funcionar.
Paquetes de reglas Últimos 7 días · en vigor
Paquete Dirección Acción Coincidencias
Inyección de prompts Entrada block 286
Datos personales Entrada · Salida mask 912
Secretos y claves Entrada block 248
Temas vetados Entrada detect 6

Con model=auto, la pasarela elige el modelo

Con model=auto la pasarela lee la solicitud, elige un nivel y un modelo y registra el porqué. La URL base, el SDK y el precio de lista no cambian, así que una política de enrutamiento puede cambiar sin tocar el código.

  • Detecta la intención por palabras clave, estructura, longitud y herramientas. Las reglas locales deciden dentro de la instancia y nada sale de ella, o puedes apuntarlo a tu propio endpoint de intención.
  • Asigna la intención a un nivel. Las solicitudes largas o que usan herramientas reciben uno superior.
  • Elige el primer modelo disponible en ese momento. Dentro de una conversación, el nivel solo sube.
  • La página de enrutamiento muestra lo que auto ahorró frente a enviarlo todo al nivel más alto.
# Reemplazo directo: cambia una sola línea.
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto"

Identidad desde tu IdP y un registro de auditoría que puedes verificar

Los usuarios inician sesión con SSO y se aprovisionan por SCIM, y los roles vienen de los grupos del IdP. Cada cambio hecho en la consola queda en un registro de auditoría con cadena de hashes.

  • Las cuentas se vinculan al sujeto del IdP, nunca al correo: una dirección parecida no puede heredar la asignación ni las claves de nadie.
  • Las claves dejan de funcionar en menos de cinco minutos tras la desactivación en el IdP, incluidas las solicitudes en curso.
  • El registro de auditoría guarda cada cambio hecho en la consola, campo a campo, y cada lectura de un prompt, nunca cuerpos de solicitud. Expórtalo como JSONL o envíalo en streaming a tu SIEM. Se conserva de forma permanente.
  • Los logs de solicitudes y los cuerpos tienen su propia retención: desactivada, con datos ocultos o completa para depurar.
Registro de auditoría Cadena intacta · verificada hace 3 min
  • Emily Carter · Administradora Cambió el peso de un upstream Azure eastus 100 → 50
  • SCIM Baja, claves revocadas Mark Davis · 3 claves
  • Jason Miller · Responsable de equipo Aprobó una subida Sarah Brooks · 10 $ → 15 $ al día
  • Sistema El juez hizo failover Modelo juez → reglas locales

Adónde van los datos.

Instancia dedicada gestionada

Tu propia instancia, operada por nosotros. Retención cero por defecto, o la política de retención que fijes. Fijación de región en EE. UU., la UE o APAC.

Despliegue privado

El producto completo, pasarela y consola, en tu VPC o tu centro de datos. Las solicitudes solo salen hacia los proveedores que permitas.

Tú eliges los endpoints del clasificador de enrutamiento, del modelo juez y del etiquetador de prompts. La pasarela solo acepta para ellos HTTPS o una dirección privada, así que un prompt no cruza la internet pública sin cifrar.

Qué te ayuda a cumplir.

Lo que pide Cómo lo cubre
Reglamento de IA de la UE, artículo 26: los responsables del despliegue de sistemas de IA de alto riesgo conservan los registros generados automáticamente al menos seis meses y asignan la supervisión humana a personas con autoridad para ejercerla Los eventos de auditoría se conservan de forma permanente y los logs de solicitudes, con la retención que fijes; las aprobaciones y las reglas de guardrail ponen a una persona o una regla sobre la propia solicitud
ISO/IEC 42001: un sistema de gestión de IA con inventario, roles y seguimiento continuo Registro de aplicaciones, equipos y roles, un registro por solicitud con su etiqueta de intención
NIST AI RMF: gobernar, mapear, medir, gestionar Reglas de política, clasificación de datos, analítica de uso por equipo e intención, aprobaciones

Estos son los controles que pide cada marco y la función que aporta cada uno. Sirven de apoyo a tu evaluación y no son una certificación.

Habla con ventas.

Cuéntanos el tamaño de tu equipo, los proveedores que usas y dónde tiene que ejecutarse. El DPA está disponible a petición.

Hablar con ventas