🎁 新人 免费注册,送 10 次调用,最高 $1,免绑卡。

按上游看参数

有些请求字段在不同厂商那里不是一个意思。本页写明网关在发往每个厂商时对它做了什么——透传、翻译成厂商自己的等价物,还是丢弃。

这不是全部可用字段的清单;各端点页各自记录自己的请求体。这里列的是支不支持无法用是/否回答的字段——因为答案取决于你的模型跑在哪个厂商上。

reasoning_effort

完整指南(含取值与成本影响)→

你调用的 上游 行为 说明
/v1/chat/completions OpenAI-compatible (GPT, GLM, DeepSeek, Qwen, Kimi…) 透传 按原样转发给厂商——网关既不校验取值,也不保证厂商会遵守。常见取值是 minimal、low、medium、high,但接受哪些由厂商决定:OpenAI 还接受 none,GLM 最高到 max。
/v1/chat/completions Google Vertex — Gemini 3.x 映射 转换为 Gemini 的 thinkingLevel:none 和 minimal 都映射为 minimal,low/medium/high 一一对应。请求里显式的 google.thinking_config 优先于此映射。
/v1/chat/completions Google Vertex — Gemini 2.5 丢弃 Gemini 2.5 只认 thinkingBudget,收到 thinkingLevel 会直接拒绝,所以网关两者都不发,让模型保持默认思考行为。要控制 2.5,请用 google.thinking_config 里的 thinking_budget
/v1/chat/completions Anthropic (Claude) 丢弃 不转发。Anthropic 其实有对应语义(thinking.budget_tokens),网关也实现了反方向的映射,但这个方向从未实现——请改用 Anthropic 原生请求形态设置 thinking.budget_tokens
/v1/messages OpenAI-compatible (GPT, GLM, DeepSeek, Qwen, Kimi…) 映射 在扩展思考已启用且预算大于 0 时,由 thinking.budget_tokens 分桶得出:≤2,048 为 low,≤8,192 为 medium,更高为 high。预算为 0 或缺失时不发送该字段。
/v1/responses OpenAI-compatible (GPT, GLM, DeepSeek, Qwen, Kimi…) 映射 从 Responses API 的 reasoning.effort 对象中读出,以扁平的 reasoning_effort 字段发送。

每一行都转录自实现它的转换器,并由 Go 测试钉住;所以这张表不可能在构建不失败的情况下与线上网关脱节。