リーズニング強度(reasoning effort)
reasoning_effort は回答前にモデルがどれだけ考えるかを制限します。既定で無制限に推論するモデルでは最大のコスト調整手段であり、その効き方はモデルがどのアップストリームで動くかで完全に変わります。
値
リクエストボディに次のいずれかを指定します。強度が高いほど課金される推論トークンが増え、応答は遅くなります:
minimal · low · medium · high
リクエスト例
curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer $SYNTHORAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "Refactor this function."}],
"reasoning_effort": "low"
}' アップストリーム別の実際の挙動
ゲートウェイはあなたに対しては一つのプロトコル、各プロバイダーに対しては別のプロトコルを話します。この表は送信時にこのパラメータが何に変換されるか——破棄される場合も含めて——を示します。
| 呼び出し先 | アップストリーム | 挙動 | 説明 |
|---|---|---|---|
/v1/chat/completions | OpenAI-compatible (GPT, GLM, DeepSeek, Qwen, Kimi…) | そのまま転送 | そのままプロバイダーへ転送されます。ゲートウェイは値を検証せず、プロバイダーが従うことも保証しません。一般的な値は minimal・low・medium・high ですが、受け付ける範囲はプロバイダー次第です(OpenAI は none も、GLM は max まで受け付けます)。 |
/v1/chat/completions | Google Vertex — Gemini 3.x | 変換 | Gemini の thinkingLevel に変換されます。none と minimal はどちらも minimal に、low/medium/high はそのまま対応します。リクエストに明示的な google.thinking_config がある場合はそちらが優先されます。 |
/v1/chat/completions | Google Vertex — Gemini 2.5 | 破棄 | Gemini 2.5 は thinkingBudget しか解釈せず、thinkingLevel は拒否します。そのためゲートウェイはどちらも送らず、モデルの既定の思考動作のままにします。2.5 を制御するには google.thinking_config の thinking_budget を使ってください。 |
/v1/chat/completions | Anthropic (Claude) | 破棄 | 転送されません。Anthropic 側にも相当機能(thinking.budget_tokens)があり、ゲートウェイは逆方向の変換を実装していますが、この方向は未実装です。Anthropic ネイティブのリクエスト形式で thinking.budget_tokens を指定してください。 |
/v1/messages | OpenAI-compatible (GPT, GLM, DeepSeek, Qwen, Kimi…) | 変換 | 拡張思考が有効かつ予算が 0 より大きい場合に、thinking.budget_tokens から段階的に導出されます:2,048 以下は low、8,192 以下は medium、それ以上は high。予算が 0 または未指定なら何も送りません。 |
/v1/responses | OpenAI-compatible (GPT, GLM, DeepSeek, Qwen, Kimi…) | 変換 | Responses API の reasoning.effort オブジェクトから読み取り、フラットな reasoning_effort フィールドとして送信します。 |
各行は実装元のコンバーターから転記され、Go のテストで固定されています。したがってビルドを壊さずにこの表が実際のゲートウェイとずれることはありません。
コストへの影響
推論トークンは出力トークンとして課金されます。既定で無制限に推論するモデルでは、強度を明示するかどうかが同じ回答に対して数セントか数ドルかの差になります。既定値を決める前に自分のプロンプトで実測してください。
リーズニング対応モデル
以下のモデルはリーズニングモードを文書化しています。そのアップストリームでの扱いは各モデルページを参照してください:
ByteDance-Seed-1.8 · Dola-Seed-2.0-lite · Dola-Seed-2.0-mini · Dola-Seed-2.0-pro · claude-fable-5 · claude-haiku-4-5 · claude-opus-4-5 · claude-opus-4-6 · claude-opus-4-7 · claude-opus-4-8 · claude-opus-5 · claude-sonnet-4-5 · claude-sonnet-4-6 · claude-sonnet-5 · deepseek-v4-flash · deepseek-v4-pro · gemini-2.5-flash · gemini-2.5-flash-lite · gemini-2.5-flash-native-audio · gemini-2.5-pro · gemini-3-flash-preview · gemini-3-pro-image-preview · gemini-3.1-flash-image-preview · gemini-3.1-flash-lite-image · gemini-3.1-flash-lite-preview · gemini-3.1-flash-live · gemini-3.1-pro-preview · gemini-3.5-flash · gemini-3.5-flash-lite · gemini-3.6-flash · glm-5 · glm-5-turbo · glm-5.1 · glm-5.2 · gpt-5.2 · gpt-5.2-codex · gpt-5.3-codex · gpt-5.4 · gpt-5.4-mini · gpt-5.4-nano · gpt-5.4-pro · gpt-5.5 · gpt-5.5-pro · gpt-5.6 · gpt-5.6-luna · gpt-5.6-sol · gpt-5.6-terra · kimi-k2.5 · kimi-k2.7-code · kimi-k3 · minimax-m3 · qwen3-max · qwen3-vl-flash · qwen3-vl-plus · qwen3.5-flash · qwen3.5-plus · qwen3.6-flash · qwen3.7-max · qwen3.7-plus
リクエストボディの完全なリファレンス: Chat Completions