Responses API
POST /v1/responses
Compatível com a Responses API da OpenAI. Suporta itens de entrada estruturados, uso de ferramentas e raciocínio integrado. O gateway encaminha de forma transparente para o provedor upstream.
Corpo da requisição
| Parâmetro | Tipo | Descrição |
|---|---|---|
model* | string | ID do modelo a usar (ex.: gpt-5.4, gpt-5.4-mini). |
input* | string | array | String de texto ou array de itens de entrada (objetos de mensagem com role e content). |
stream | boolean | Se true, retorna um fluxo de eventos SSE. Padrão: false. |
temperature | number | Temperatura de amostragem 0–2. Padrão: 1. |
max_output_tokens | integer | Máximo de tokens a gerar na resposta. |
tools | array | Lista de definições de ferramentas que o modelo pode chamar. |
reasoning | object | Configuração de raciocínio (ex.: { "effort": "high" }) para modelos da série o. |
Exemplo de requisição
POST /v1/responses
Authorization: Bearer YOUR_API_KEY
{
"model": "gpt-5.4-mini",
"input": "What is the capital of France?",
"max_output_tokens": 256
} Exemplo de resposta
{
"id": "resp_abc123",
"object": "response",
"created_at": 1714000000,
"model": "gpt-5.4-mini",
"output": [
{
"type": "message",
"role": "assistant",
"content": [
{ "type": "output_text", "text": "The capital of France is Paris." }
]
}
],
"usage": {
"input_tokens": 12,
"output_tokens": 9,
"total_tokens": 21
}
} ℹ
A Responses API é a forma recomendada de interagir com os modelos da OpenAI. Ela suporta nativamente o uso de ferramentas, saídas estruturadas e configuração de raciocínio.