Chat Completions
POST /v1/chat/completions
指定されたチャット会話に対するモデルのレスポンスを生成します。OpenAI Chat Completions API と互換性があります。
リクエストボディ
| パラメータ | 型 | 説明 |
|---|---|---|
model* | string | 使用するモデルの ID(例:gpt-5.4、qwen3.5-flash、gemini-2.5-flash)。 |
messages* | array | 会話内のメッセージのリスト。各項目は role と content を持ちます。 |
stream | boolean | true の場合、SSE イベントの streaming を返します。デフォルト:false。 |
temperature | number | サンプリング温度 0–2。値が大きいほどランダムになります。デフォルト: 1。 |
max_tokens | integer | 生成する最大 token 数。上限はモデルに依存します。 |
top_p | number | Nucleus サンプリングの確率。0–1。デフォルト: 1。 |
stop | string[] | 最大 4 つのシーケンス。これらに到達すると生成を停止します。 |
n | integer | 生成する補完候補の数。デフォルト:1。 |
リクエスト例
POST /v1/chat/completions
Authorization: Bearer YOUR_API_KEY
{
"model": "gpt-5.4-mini",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "What is the capital of France?"}
],
"temperature": 0.7,
"max_tokens": 256
} レスポンス例
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"created": 1714000000,
"model": "qwen3.5-flash",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "The capital of France is Paris."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 26,
"completion_tokens": 9,
"total_tokens": 35
}
} このエンドポイントはゲートウェイ背後のすべてのプロバイダーにルーティングします。model を model price comparison から選ぶと、トークン単価を並べて比較できます。