Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Controle o gasto.Proteja os dados.Guarde a prova.

Orçamentos, cotas e aprovações controlam o gasto. Guardrails e classificação de dados protegem os dados. Um log de auditoria à prova de adulteração, com cada mudança feita no console, guarda a prova. Roda como instância dedicada gerenciada ou dentro da sua própria rede.

Aprovações Três solicitações aguardam a sua decisão. Orçamento da equipe: US$ 300,00 por dia.
  • Emily Carter Cota diária US$ 20,00 → US$ 50,00 · extração de contratos do trimestre Já pediu duas vezes, ambas aprovadas · a equipe ainda tem US$ 248,00 de US$ 300,00
    Escala em 4 h Recusar Aprovar
  • Jason Miller Acesso ao claude-opus-5 · 30 dias Primeiro pedido · gastou US$ 4,10 ontem de uma cota de US$ 20,00
    Recusar Aprovar
  • Sarah Brooks Cota diária US$ 20,00 → US$ 400,00 Acima dos US$ 300,00 por dia da equipe, então aprovar envia isto para um admin
    Vai para um admin Recusar Aprovar

Saiba para que a sua empresa usa IA

O gateway classifica cada chamada por intenção: programação, análise, escrita, consulta, lazer ou outros. Ninguém preenche formulário. O gasto aparece por equipe e por intenção, a preço de tabela, e assim o Financeiro e a Engenharia veem o mesmo número.

  • Logs: uma linha por chamada. Abra para ver a decisão de roteamento, as ocorrências de guardrail e o custo.
  • Onde os corpos são retidos, ninguém lê um prompt sem uma autorização de revisão com prazo de validade, e cada leitura fica no log de auditoria.
  • As exportações enviam o registro de cada requisição para o S3 ou um coletor OTLP.
Equipes × intenções Este mês, a preço de tabela
Equipe Uso por intenção Gasto / orçamento
P&D Programação 72% $4,812 / $8,000
Vendas Escrita 46% $3,960 / $4,500
Suporte Escrita 38% $3,120 / $6,000

Veja o uso

Gasto por equipe, modelo e chave, dividido por intenção, com a previsão de fim de mês e o que o cache economizou.

Defina políticas

Lazer acima de 2% notifica o líder da equipe. A faixa mais alta acima de 30% exige aprovação. Orçamento esgotado bloqueia.

Roteie por intenção

Com model=auto, uma consulta vai para uma faixa mais barata e uma análise longa para um modelo maior. Cada decisão registra o porquê.

O que mais a edição Enterprise faz.

Mais cinco partes do mesmo gateway.

Uma base URL na frente de todos os modelos

As pessoas trocam só a base URL e a chave. Atrás dela ficam os modelos do nosso catálogo, os provedores nas suas próprias chaves e os modelos dentro da sua rede. O gateway monitora a saúde de cada upstream e faz failover para outro.

  • O catálogo mostra quanto cada modelo custa e o que cada upstream faz com os seus dados: não retém, pode reter ou fica dentro da rede.
  • Acesso aos modelos por equipe: permitido, precisa de aprovação ou bloqueado. A primeira regra que casar vence.
  • Coloque uma equipe em retenção zero e os upstreams que podem reter dados são desligados para essa equipe. O modelo privado continua disponível.
  • O BYOK está incluído, e as chaves de provedor pessoais podem ser permitidas ou desligadas para a instância inteira.
Equipes × modelos As células vêm das regras; mude as regras, não as células
Equipe claude-opus-5gpt-5.4deepseek-v4.1
Suporte BloqueadoPermitidoPermitido
P&D Precisa de aprovaçãoPermitidoPermitido
Vendas Precisa de aprovaçãoPermitidoPermitido

Orçamentos que agem antes da fatura

A organização tem um teto, as equipes têm um total, as intenções têm uma fatia e as pessoas têm uma cota diária. Quando um deles é ultrapassado, o gateway avisa e age.

  • Linhas de alerta em 50, 80 e 95% do teto. Quando ele acaba, as novas requisições são recusadas com um 402, ou atendidas e sinalizadas: você escolhe.
  • Políticas por intenção: notificar o líder da equipe, exigir aprovação, rotear para uma faixa mais barata ou bloquear.
  • Um aumento temporário é revertido sozinho. Uma solicitação de limite maior vai para o líder da equipe e, se passarem 24 horas sem decisão, para um admin. Uma pessoa decide cada uma.
  • Centros de custo e um extrato mensal para o Financeiro, com o gasto não alocado listado por chave.
Políticas por intenção Verificadas em cada requisição, antes do encaminhamento
  • Lazer fatia acima de 2% · todas as equipes Notificar líder
  • Análise faixa mais alta acima de 30% · P&D Precisa de aprovação
  • Consulta fatia acima de 10% · Suporte Faixa mais barata
  • Qualquer intenção orçamento esgotado · todas as equipes Bloquear

Guardrails com modelo juiz e um registro de ferramentas

Pacotes de regras verificam requisições e respostas: injeção de prompt, dados pessoais, segredos e chaves, temas proibidos, sua própria lista de palavras. Comece no modo só detecção, veja o que ele teria feito e então aplique.

  • Quatro ações: bloquear, mascarar, orientar ou detectar. Orientar diz à pessoa o que fazer em vez disso, sem mudar o que o modelo recebe.
  • Um modelo juiz revisa cada ocorrência acima de um limiar de confiança, com o texto mascarado antes. Se o juiz estiver lento ou fora do ar, aquela requisição passa, fica registrada e gera um alerta de severidade alta.
  • Classificação de dados: quatro níveis e as suas próprias regras. Cada nível diz a quais modelos pode chegar.
  • Servidores MCP e skills são registrados; um não registrado fica no log ou é bloqueado. Os alertas vão para Slack, e-mail, Feishu ou PagerDuty, e, antes de desativar uma chave, você vê o que isso quebraria.
Pacotes de regras Últimos 7 dias · aplicando
Pacote Direção Ação Ocorrências
Injeção de prompt Entrada block 286
Dados pessoais Entrada · Saída mask 912
Segredos e chaves Entrada block 248
Temas proibidos Entrada detect 6

Com model=auto, o gateway escolhe o modelo

Com model=auto, o gateway lê a requisição, escolhe uma faixa e um modelo e registra o porquê. A base URL, o SDK e o preço de tabela continuam os mesmos, então uma política de roteamento pode mudar sem mudança no código.

  • Detecta a intenção por palavras-chave, estrutura, tamanho e ferramentas. As regras locais decidem dentro da instância e nada sai dela, ou você pode apontar para o seu próprio endpoint de intenção.
  • Mapeia a intenção para uma faixa. Requisições longas ou com ferramentas recebem uma faixa mais alta.
  • Escolhe o primeiro modelo disponível naquele momento. Dentro de uma conversa, a faixa só sobe.
  • A página de roteamento mostra o que o auto economizou em relação a mandar tudo para a faixa mais alta.
# Drop-in. Muda uma linha só.
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto"

Identidade do seu IdP e um log de auditoria que você pode verificar

As pessoas entram com SSO e são provisionadas via SCIM, e os papéis vêm dos grupos do IdP. Cada mudança feita no console vai para um log de auditoria encadeado por hash.

  • As contas se vinculam ao subject do IdP, nunca ao e-mail: um endereço parecido não herda a cota nem as chaves de ninguém.
  • As chaves param em até cinco minutos após a desativação no IdP, incluindo as requisições em andamento.
  • O log de auditoria registra cada mudança feita no console, campo a campo, e cada leitura de um prompt, nunca o corpo das requisições. Exporte como JSONL ou envie por streaming para o seu SIEM. Ele é guardado permanentemente.
  • Os logs e os corpos de requisição têm retenção própria: desligada, mascarada ou completa para depuração.
Log de auditoria Cadeia íntegra · verificada há 3 min
  • Emily Carter · Admin Alterou peso de upstream Azure eastus 100 → 50
  • SCIM Desligamento, chaves revogadas Mark Davis · 3 chaves
  • Jason Miller · Líder de equipe Aprovou um aumento Sarah Brooks · $10 → $15 por dia
  • Sistema Juiz em failover Modelo juiz → regras locais

Para onde os dados vão.

Instância dedicada gerenciada

A sua própria instância, operada por nós. Retenção zero por padrão, ou a política de retenção que você definir. Região fixa nos EUA, na UE ou na região APAC.

Implantação própria

O produto inteiro, gateway e console, na sua VPC ou no seu data center. As requisições só saem para os provedores que você permitir.

Você escolhe os endpoints do classificador de roteamento, do modelo juiz e do tagger de prompts. Para eles, o gateway só aceita HTTPS ou um endereço privado, então um prompt não atravessa a internet pública sem criptografia.

O que ele ajuda a cumprir.

O que pede Fornecido por
AI Act europeu, artigo 26: implantadores de sistemas de IA de alto risco guardam os logs gerados automaticamente por pelo menos seis meses e atribuem a supervisão humana a pessoas com autoridade para exercê-la Eventos de auditoria guardados permanentemente e logs de requisições com a retenção que você definir; aprovações e regras de guardrail colocam uma pessoa ou uma regra na própria requisição
ISO/IEC 42001: um sistema de gestão de IA com inventário, papéis e monitoramento contínuo Registro de aplicações, equipes e papéis, registros por requisição com tags de intenção
NIST AI RMF: governar, mapear, medir, gerenciar Regras de política, classificação de dados, análise de uso por equipe e intenção, aprovações

Estes são os controles que cada framework pede e o recurso que atende a cada um. Eles apoiam a sua avaliação e não são uma certificação.

Fale com vendas.

Informe o tamanho da equipe, os provedores que usa e onde precisa rodar. O DPA está disponível sob solicitação.

Falar com vendas