Responses API
POST /v1/responses
Kompatibel mit der OpenAI Responses API. Unterstützt strukturierte Eingabe-Items, Tool-Nutzung und integriertes Reasoning. Das Gateway leitet Anfragen transparent an den Upstream-Anbieter weiter.
Anfragetext
| Parameter | Typ | Beschreibung |
|---|---|---|
model* | string | ID des zu verwendenden Modells (z. B. gpt-5.4, gpt-5.4-mini). |
input* | string | array | Textzeichenfolge oder Array von Eingabe-Items (Nachrichtenobjekte mit Rolle und Inhalt). |
stream | boolean | Wenn true, wird ein Stream von SSE-Events zurückgegeben. Standard: false. |
temperature | number | Sampling-Temperatur 0–2. Standard: 1. |
max_output_tokens | integer | Maximale Anzahl der in der Antwort zu generierenden Token. |
tools | array | Liste der Tool-Definitionen, die das Modell aufrufen kann. |
reasoning | object | Reasoning-Konfiguration (z. B. { "effort": "high" }) für o-Serien-Modelle. |
Beispielanfrage
POST /v1/responses
Authorization: Bearer YOUR_API_KEY
{
"model": "gpt-5.4-mini",
"input": "What is the capital of France?",
"max_output_tokens": 256
} Beispielantwort
{
"id": "resp_abc123",
"object": "response",
"created_at": 1714000000,
"model": "gpt-5.4-mini",
"output": [
{
"type": "message",
"role": "assistant",
"content": [
{ "type": "output_text", "text": "The capital of France is Paris." }
]
}
],
"usage": {
"input_tokens": 12,
"output_tokens": 9,
"total_tokens": 21
}
} ℹ
Die Responses API ist die empfohlene Methode zur Interaktion mit OpenAI-Modellen. Sie unterstützt nativ Tool-Nutzung, strukturierte Ausgaben und Reasoning-Konfiguration.