Responses API
POST /v1/responses
Compatible avec la Responses API d'OpenAI. Prend en charge les éléments d'entrée structurés, l'utilisation d'outils et le raisonnement intégré. Le gateway transmet les requêtes de manière transparente au fournisseur en amont.
Corps de la requête
| Paramètre | Type | Description |
|---|---|---|
model* | string | ID du modèle à utiliser (par ex. gpt-5.4, gpt-5.4-mini). |
input* | string | array | Chaîne de texte ou tableau d'éléments d'entrée (objets message avec rôle et contenu). |
stream | boolean | Si true, renvoie un flux d'événements SSE. Par défaut : false. |
temperature | number | Température d'échantillonnage 0–2. Par défaut : 1. |
max_output_tokens | integer | Nombre maximal de tokens à générer dans la réponse. |
tools | array | Liste des définitions d'outils que le modèle peut appeler. |
reasoning | object | Configuration du raisonnement (par ex. { "effort": "high" }) pour les modèles de la série o. |
Exemple de requête
POST /v1/responses
Authorization: Bearer YOUR_API_KEY
{
"model": "gpt-5.4-mini",
"input": "What is the capital of France?",
"max_output_tokens": 256
} Exemple de réponse
{
"id": "resp_abc123",
"object": "response",
"created_at": 1714000000,
"model": "gpt-5.4-mini",
"output": [
{
"type": "message",
"role": "assistant",
"content": [
{ "type": "output_text", "text": "The capital of France is Paris." }
]
}
],
"usage": {
"input_tokens": 12,
"output_tokens": 9,
"total_tokens": 21
}
} ℹ
La Responses API est la méthode recommandée pour interagir avec les modèles OpenAI. Elle prend en charge nativement l'utilisation d'outils, les sorties structurées et la configuration du raisonnement.