新人 免费注册,送 10 次调用,最高 $1,无需绑卡。

管住花费,护住数据,留下证据。

预算、限额和审批管住花费;护栏和数据分级护住数据;防篡改的审计日志记下控制台里的每一次改动,留下证据。可以用托管专属实例,也可以部署在你自己的网络里。

审批 有三条申请在等你处理。团队预算每天 $300.00。
  • Emily Carter 每日限额 $20.00 → $50.00 · 季度合同抽取 之前申请过两次,都批了 · 团队今天还剩 $248.00 / $300.00
    4 小时后上报 拒绝 批准
  • Jason Miller 使用 claude-opus-5 · 30 天 第一次申请 · 昨天花了 $4.10,每日限额 $20.00
    拒绝 批准
  • Sarah Brooks 每日限额 $20.00 → $400.00 超过团队每天 $300.00 的预算,批准后会转给管理员
    转管理员 拒绝 批准

看清公司把 AI 用在了哪里

网关按用途给每次调用分类:编码、分析、写作、查询、休闲或其他,不需要任何人填表。花费按团队、按用途展示,统一按官网价计算,财务和工程看到的是同一个数字。

  • 日志:每次调用一行,点开能看到路由决策、护栏命中和费用。
  • 即使留存了正文,也要有限时的审阅授权才能查看提示词,每次查看都记入审计日志。
  • 每条请求记录都可以导出到 S3 或 OTLP 采集器。
团队 × 用途 本月,按官网价
团队 用途构成 已用 / 预算
研发 编码 72% $4,812 / $8,000
销售 写作 46% $3,960 / $4,500
客户支持 写作 38% $3,120 / $6,000

看得见

按团队、模型和 key 看花费,再按用途拆开,附月底预测和缓存省下的金额。

按用途定政策

休闲超过 2% 通知团队负责人,最高档超过 30% 需审批,预算用完就拦截。

按用途路由

用 model=auto 时,查询走更便宜的档位,长篇分析走更大的模型。每次决策都记录原因。

企业版还做什么。

同一个网关的另外五个部分。

一个 base URL,接入所有模型

员工只需要改 base URL 和 key。它后面是我们目录里的模型、走你自己密钥的供应商,以及你网络内的模型。网关监控每个上游的健康状况,出问题就切换到另一个上游。

  • 模型目录列出每个模型的价格,以及每个上游怎么处理你的数据:不留存、可能留存,或不出网络。
  • 按团队的模型访问权限:允许、需审批或禁止。第一条匹配的规则生效。
  • 把某个团队切到不留存,可能留存数据的上游就对这个团队关闭。私有模型照常可用。
  • BYOK 包含在内;是否允许个人使用自己的供应商密钥,可以对整个实例统一开关。
团队 × 模型 单元格由规则生成;要改就改规则,不改单元格
团队 claude-opus-5gpt-5.4deepseek-v4.1
客户支持 禁止允许允许
研发 需审批允许允许
销售 需审批允许允许

账单出来之前就生效的预算

组织有总上限,团队有总额,用途有份额,每个人有每日限额。任何一项超了,网关都会上报并处理。

  • 在总上限的 50%、80% 和 95% 处设告警线。用完后,新请求要么返回 402 拒绝,要么放行并标记,由你选。
  • 用途政策:通知团队负责人、需审批、改走更便宜的档位,或拦截。
  • 临时上调到期自动恢复。提高限额的申请先到团队负责人那里,24 小时内没有决定就转给管理员。每一条都由人来决定。
  • 成本中心,以及给财务的月结单,未分摊的花费按 key 列出。
用途政策 每一次请求转发前都会检查
  • 休闲 占比超过 2% · 所有团队 通知负责人
  • 分析 最高档超过 30% · 研发 需审批
  • 查询 占比超过 10% · 客户支持 改走低价档
  • 任何用途 预算用完 · 所有团队 拦截

护栏带复核模型,工具有登记表

规则包检查请求和响应:提示词注入、个人信息、密钥和 API key、禁止话题、你自己的词表。先用只记录模式起步,看看它本来会怎么处理,再切到强制执行。

  • 四种动作:拦截、脱敏、引导或只记录。引导是告诉当事人该怎么做,而不改动模型收到的内容。
  • 复核模型会复查每一次超过置信度阈值的命中,文本先脱敏再送过去。复核模型变慢或不可用时,这次请求照常通过并留下记录,同时发出高严重级别的告警。
  • 数据分级:四个级别,加上你自己的规则。每个级别规定能发往哪些模型。
  • MCP 服务器和技能要先登记;未登记的会被记录或拦截。告警发到 Slack、邮件、飞书或 PagerDuty,停用一个 key 之前会先显示它会影响什么。
规则包 近 7 天 · 强制执行
规则包 方向 动作 命中
提示词注入 入 block 286
个人信息 入 · 出 mask 912
密钥和 API key 入 block 248
禁止话题 入 detect 6

用 model=auto,由网关选模型

用 model=auto 时,网关读取请求,选定档位和模型,并记录原因。base URL、SDK 和官网价都不变,所以调整路由政策不需要改代码。

  • 从关键词、结构、长度和工具识别用途。本地规则在实例内完成判断,数据不出实例;也可以指向你自己的用途识别端点。
  • 把用途映射到档位。长请求或用到工具的请求会分到更高一档。
  • 选当前第一个可用的模型。同一段对话里,档位只升不降。
  • 路由页面显示,相比全部发到最高档,auto 省了多少。
# 即插即用,只换 base URL 与 key。
base_url="https://api.openai.com/v1"
base_url="https://synthorai.io/v1"
# model="auto"

身份来自你的 IdP,审计日志可以校验

员工通过 SSO 登录,账号由 SCIM 同步创建,角色来自 IdP 的组。控制台里的每一次改动都写入带哈希链的审计日志。

  • 账号绑定的是 IdP subject,不是邮箱,所以用一个相似的邮箱地址拿不到别人的限额或 key。
  • 在 IdP 里停用后,key 在五分钟内失效,进行中的请求也包括在内。
  • 审计日志逐字段记下控制台里的每一次改动,也记下每一次查看提示词,从不记请求正文。可导出为 JSONL,或流式推送到你的 SIEM。永久保留。
  • 请求日志和正文有各自的留存设置:不存、脱敏后存,或为了调试全量存。
审计日志 链完整 · 3 分钟前校验
  • Emily Carter · 管理员 修改了上游权重 Azure eastus 100 → 50
  • SCIM 离职处理,key 已吊销 Mark Davis · 3 个 key
  • Jason Miller · 团队负责人 批准了一次上调 Sarah Brooks · 每天 $10 → $15
  • 系统 复核模型已切换 复核模型 → 本地规则

数据会去哪里。

托管专属实例

你自己的实例,由我们运维。默认零留存,或按你设定的留存政策。可固定在美国、欧盟或亚太区域。

私有化部署

整个产品,网关和控制台,放进你的 VPC 或机房。请求只会发往你允许的供应商。

路由分类器、复核模型和提示词打标器的端点由你指定。网关只接受 HTTPS 或内网地址,所以提示词不会以明文经过公网。

对应哪些合规要求。

要求 对应功能
EU AI Act 第 26 条:高风险 AI 系统的部署者保留系统自动生成的日志至少六个月,并把人工监督交给有相应权限的人 审计事件永久保留,请求日志按你设定的期限留存;审批和护栏规则让人或规则直接在请求上把关
ISO/IEC 42001:有清单、角色和持续监控的 AI 管理体系 应用登记表、团队与角色、带用途标签的请求记录
NIST AI RMF:治理、映射、度量、管理 政策规则、数据分级、按团队和用途的用量分析、审批

这里列的是各框架要求的控制项,以及提供每一项的功能。它们为你的评估提供支持,不构成认证。

联系销售。

告诉我们团队规模、在用的供应商,以及需要部署在哪里。DPA 可按需提供。

联系销售