Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Controlla la spesa.Proteggi i dati.Conserva le prove.

Budget, limiti giornalieri e approvazioni controllano la spesa. Guardrail e classificazione dei dati proteggono i dati. Un log di audit di ogni modifica fatta in console, che rende rilevabile ogni manomissione, conserva le prove. Gira come istanza dedicata gestita o nella tua rete.

Approvazioni Tre richieste aspettano una tua risposta. Budget del team: 300,00 $ al giorno.
  • Emily Carter Limite giornaliero 20,00 $ → 50,00 $ · estrazione dei contratti del trimestre Due richieste precedenti, entrambe approvate · al team restano 248,00 $ su 300,00 $
    Escalation tra 4 h Rifiuta Approva
  • Jason Miller Accesso a claude-opus-5 · 30 giorni Prima richiesta · ieri ha speso 4,10 $ su un limite di 20,00 $
    Rifiuta Approva
  • Sarah Brooks Limite giornaliero 20,00 $ → 400,00 $ Oltre i 300,00 $ al giorno del team, quindi approvando passa a un admin
    Va a un admin Rifiuta Approva

Scopri per cosa la tua azienda usa l'AI

Il gateway classifica ogni chiamata per finalità: programmazione, analisi, scrittura, consultazione, svago o altro. Nessuno compila un modulo. La spesa è mostrata per team e per finalità a prezzo di listino, così amministrazione e team tecnico vedono lo stesso numero.

  • Log: una riga per chiamata. Aprila per vedere la decisione di routing, gli hit dei guardrail e il costo.
  • Dove i body vengono conservati, nessuno legge un prompt senza un permesso di revisione a tempo, e ogni lettura finisce nel log di audit.
  • Gli export inviano ogni record di richiesta a S3 o a un collector OTLP.
Team × finalità Questo mese, a prezzo di listino
Team Mix di finalità Speso / budget
R&S Programmazione 72% $4,812 / $8,000
Vendite Scrittura 46% $3,960 / $4,500
Assistenza Scrittura 38% $3,120 / $6,000

Spesa per finalità

La spesa per team, modello e chiave, ripartita per finalità, con la previsione a fine mese e quanto ha fatto risparmiare la cache.

Policy per finalità

Lo svago oltre il 2% avvisa il responsabile del team. La fascia più alta oltre il 30% richiede approvazione. Un budget esaurito blocca.

Routing per finalità

Con model=auto una consultazione va a una fascia più economica e un'analisi lunga a un modello più grande. Ogni decisione registra il perché.

Cos'altro fa l'edizione Enterprise.

Altre cinque parti dello stesso gateway.

Un solo base URL davanti a tutti i modelli

Le persone cambiano solo il base URL e la chiave. Dietro ci sono i modelli del nostro catalogo, i provider sulle tue chiavi e i modelli nella tua rete. Il gateway tiene sotto controllo lo stato di ogni upstream e fa failover su un altro.

  • Il catalogo indica quanto costa ogni modello e cosa fa ogni upstream con i tuoi dati: nessuna retention, retention possibile o dati che restano all'interno.
  • Accesso ai modelli per team: consentito, con approvazione o bloccato. Vince la prima regola che corrisponde.
  • Se passi un team a zero retention, gli upstream che possono conservare i dati vengono disattivati per quel team. Il modello privato resta disponibile.
  • Il BYOK è incluso, e le chiavi personali dei provider si possono consentire o disattivare per l'intera istanza.
Team × modelli Le celle derivano dalle regole; cambia le regole, non le celle
Team claude-opus-5gpt-5.4deepseek-v4.1
Assistenza BloccatoConsentitoConsentito
R&S Con approvazioneConsentitoConsentito
Vendite Con approvazioneConsentitoConsentito

Budget che agiscono prima della fattura

L'organizzazione ha un tetto, i team un totale, le finalità una quota e le persone un limite giornaliero. Quando uno viene superato, il gateway lo segnala e interviene.

  • Soglie di avviso al 50, all'80 e al 95% del tetto. Quando si esaurisce, le nuove richieste vengono rifiutate con un 402, oppure servite e segnalate: decidi tu.
  • Policy per finalità: avvisare il responsabile del team, richiedere approvazione, dirottare su una fascia più economica o bloccare.
  • Un aumento temporaneo rientra da solo. La richiesta di un limite più alto va al responsabile del team, poi a un admin se passano 24 ore senza una decisione. Ognuna la decide una persona.
  • Centri di costo e un rendiconto mensile per l'amministrazione, con la spesa non attribuita elencata per chiave.
Policy per finalità Verificate su ogni richiesta, prima dell'inoltro
  • Svago quota oltre il 2% · tutti i team Avvisa il responsabile
  • Analisi fascia più alta oltre il 30% · R&S Con approvazione
  • Consultazione quota oltre il 10% · Assistenza Fascia più economica
  • Qualsiasi finalità budget esaurito · tutti i team Blocca

Guardrail con un modello giudice e un registro dei tool

I pacchetti di regole controllano richieste e risposte: prompt injection, dati personali, segreti e chiavi, argomenti vietati, la tua lista di parole. Parti in solo rilevamento, guarda cosa avrebbe fatto, poi applica.

  • Quattro azioni: bloccare, mascherare, indirizzare o rilevare. Indirizzare dice alla persona cosa fare in alternativa, senza cambiare ciò che riceve il modello.
  • Un modello giudice rivede ogni hit sopra una soglia di confidenza, con il testo oscurato prima. Se il giudice è lento o non risponde, quella richiesta passa, viene registrata e fa scattare un avviso di gravità alta.
  • Classificazione dei dati: quattro livelli e le tue regole. Ogni livello dice a quali modelli può arrivare.
  • Server MCP e skill sono registrati; uno non registrato viene tracciato o bloccato. Gli avvisi vanno su Slack, email, Feishu o PagerDuty, e prima di disattivare una chiave vedi cosa smetterebbe di funzionare.
Pacchetti di regole Ultimi 7 giorni · in applicazione
Pacchetto Direzione Azione Hit
Prompt injection Ingresso block 286
Dati personali Ingresso · Uscita mask 912
Segreti e chiavi Ingresso block 248
Argomenti vietati Ingresso detect 6

Con model=auto il modello lo sceglie il gateway

Con model=auto il gateway legge la richiesta, sceglie una fascia e un modello e registra il perché. Base URL, SDK e prezzo di listino restano gli stessi, quindi una policy di routing può cambiare senza toccare il codice.

  • Rileva la finalità da parole chiave, struttura, lunghezza e tool. Le regole locali decidono dentro l'istanza e nulla ne esce, oppure puoi puntarlo al tuo endpoint di finalità.
  • Associa la finalità a una fascia. Le richieste lunghe o con tool ne ricevono una più alta.
  • Sceglie il primo modello disponibile in quel momento. All'interno di una conversazione la fascia può solo salire.
  • La pagina del routing mostra quanto auto ha fatto risparmiare rispetto a mandare tutto alla fascia più alta.
# Drop-in. Cambia una sola riga.
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto"

Identità dal tuo IdP, e un log di audit che puoi verificare

Le persone accedono con SSO, gli account vengono creati via SCIM e i ruoli derivano dai gruppi dell'IdP. Ogni modifica fatta in console finisce in un log di audit con catena di hash.

  • Gli account sono legati al subject dell'IdP, mai all'email: un indirizzo simile non può ereditare il limite o le chiavi di qualcun altro.
  • Le chiavi si fermano entro cinque minuti dalla disattivazione nell'IdP, richieste in corso comprese.
  • Il log di audit registra ogni modifica fatta nella console, campo per campo, e ogni lettura di un prompt, mai i body delle richieste. Esportalo in JSONL o inoltralo in streaming al tuo SIEM. Viene conservato in modo permanente.
  • Log e body delle richieste hanno una conservazione propria: disattivata, oscurata o completa per il debug.
Log di audit Catena integra · verificata 3 min fa
  • Emily Carter · Admin Peso upstream modificato Azure eastus 100 → 50
  • SCIM Offboarding, chiavi revocate Mark Davis · 3 chiavi
  • Jason Miller · Responsabile del team Aumento approvato Sarah Brooks · 10 $ → 15 $ al giorno
  • Sistema Giudice in failover Modello giudice → regole locali

Dove vanno i dati.

Istanza dedicata gestita

La tua istanza, gestita da noi. Zero retention di default, o la policy di conservazione che decidi tu. Region pinning negli USA, nell'UE o in APAC.

Deployment privato

L'intero prodotto, gateway e console, nella tua VPC o nel tuo data center. Le richieste escono solo verso i provider che autorizzi.

Gli endpoint del classificatore di routing, del modello giudice e del tagger dei prompt li scegli tu. Il gateway accetta per loro solo HTTPS o un indirizzo privato, quindi un prompt non viaggia sull'internet pubblica senza cifratura.

Le norme che ti aiuta a rispettare.

Richiesto Fornito da
AI Act europeo, articolo 26: i deployer di sistemi di AI ad alto rischio conservano i log generati automaticamente per almeno sei mesi e affidano la supervisione umana a persone con l'autorità per esercitarla Eventi di audit conservati in modo permanente e log delle richieste con la conservazione che imposti; approvazioni e regole di guardrail mettono una persona o una regola sulla richiesta stessa
ISO/IEC 42001: un sistema di gestione dell'AI con inventario, ruoli e monitoraggio continuo Registro delle applicazioni, team e ruoli, record per richiesta con tag di finalità
NIST AI RMF: governare, mappare, misurare, gestire Regole di policy, classificazione dei dati, analisi d'uso per team e finalità, approvazioni

Questi sono i controlli che ogni framework richiede e la funzionalità che fornisce ciascuno. Supportano la tua valutazione e non sono una certificazione.

Contatta il team commerciale.

Dicci la dimensione del team, i provider che usi e dove deve girare. Il DPA è disponibile su richiesta.

Contatta il team commerciale