Responses API
POST /v1/responses
Compatible con la Responses API de OpenAI. Admite elementos de entrada estructurados, uso de herramientas y razonamiento integrado. El gateway redirige de forma transparente al proveedor upstream.
Cuerpo de la solicitud
| Parámetro | Tipo | Descripción |
|---|---|---|
model* | string | ID del modelo a usar (p. ej. gpt-5.4, gpt-5.4-mini). |
input* | string | array | Cadena de texto o array de elementos de entrada (objetos de mensaje con rol y contenido). |
stream | boolean | Si es true, devuelve un flujo de eventos SSE. Predeterminado: false. |
temperature | number | Temperatura de muestreo 0–2. Predeterminado: 1. |
max_output_tokens | integer | Máximo de tokens a generar en la respuesta. |
tools | array | Lista de definiciones de herramientas que el modelo puede llamar. |
reasoning | object | Configuración de razonamiento (p. ej. { "effort": "high" }) para modelos de la serie o. |
Ejemplo de solicitud
POST /v1/responses
Authorization: Bearer YOUR_API_KEY
{
"model": "gpt-5.4-mini",
"input": "What is the capital of France?",
"max_output_tokens": 256
} Ejemplo de respuesta
{
"id": "resp_abc123",
"object": "response",
"created_at": 1714000000,
"model": "gpt-5.4-mini",
"output": [
{
"type": "message",
"role": "assistant",
"content": [
{ "type": "output_text", "text": "The capital of France is Paris." }
]
}
],
"usage": {
"input_tokens": 12,
"output_tokens": 9,
"total_tokens": 21
}
} ℹ
La Responses API es la forma recomendada de interactuar con los modelos de OpenAI. Admite de forma nativa el uso de herramientas, las salidas estructuradas y la configuración de razonamiento.