Veja o uso
Gasto por equipe, modelo e chave, dividido por intenção, com a previsão de fim de mês e o que o cache economizou.
Orçamentos, cotas e aprovações controlam o gasto. Guardrails e classificação de dados protegem os dados. Um log de auditoria à prova de adulteração, com cada mudança feita no console, guarda a prova. Roda como instância dedicada gerenciada ou dentro da sua própria rede.
O gateway classifica cada chamada por intenção: programação, análise, escrita, consulta, lazer ou outros. Ninguém preenche formulário. O gasto aparece por equipe e por intenção, a preço de tabela, e assim o Financeiro e a Engenharia veem o mesmo número.
Gasto por equipe, modelo e chave, dividido por intenção, com a previsão de fim de mês e o que o cache economizou.
Lazer acima de 2% notifica o líder da equipe. A faixa mais alta acima de 30% exige aprovação. Orçamento esgotado bloqueia.
Com model=auto, uma consulta vai para uma faixa mais barata e uma análise longa para um modelo maior. Cada decisão registra o porquê.
Mais cinco partes do mesmo gateway.
As pessoas trocam só a base URL e a chave. Atrás dela ficam os modelos do nosso catálogo, os provedores nas suas próprias chaves e os modelos dentro da sua rede. O gateway monitora a saúde de cada upstream e faz failover para outro.
claude-opus-5gpt-5.4deepseek-v4.1 A organização tem um teto, as equipes têm um total, as intenções têm uma fatia e as pessoas têm uma cota diária. Quando um deles é ultrapassado, o gateway avisa e age.
Pacotes de regras verificam requisições e respostas: injeção de prompt, dados pessoais, segredos e chaves, temas proibidos, sua própria lista de palavras. Comece no modo só detecção, veja o que ele teria feito e então aplique.
block 286 mask 912 block 248 detect 6 Com model=auto, o gateway lê a requisição, escolhe uma faixa e um modelo e registra o porquê. A base URL, o SDK e o preço de tabela continuam os mesmos, então uma política de roteamento pode mudar sem mudança no código.
# Drop-in. Muda uma linha só.
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto" As pessoas entram com SSO e são provisionadas via SCIM, e os papéis vêm dos grupos do IdP. Cada mudança feita no console vai para um log de auditoria encadeado por hash.
Azure eastus 100 → 50 Mark Davis · 3 chaves Sarah Brooks · $10 → $15 por dia Modelo juiz → regras locais A sua própria instância, operada por nós. Retenção zero por padrão, ou a política de retenção que você definir. Região fixa nos EUA, na UE ou na região APAC.
O produto inteiro, gateway e console, na sua VPC ou no seu data center. As requisições só saem para os provedores que você permitir.
Você escolhe os endpoints do classificador de roteamento, do modelo juiz e do tagger de prompts. Para eles, o gateway só aceita HTTPS ou um endereço privado, então um prompt não atravessa a internet pública sem criptografia.
Estes são os controles que cada framework pede e o recurso que atende a cada um. Eles apoiam a sua avaliação e não são uma certificação.
Informe o tamanho da equipe, os provedores que usa e onde precisa rodar. O DPA está disponível sob solicitação.