Chat Completions
POST /v1/chat/completions
Crée une réponse du modèle pour la conversation de chat donnée. Compatible avec l'API OpenAI Chat Completions.
Corps de la requête
| Paramètre | Type | Description |
|---|---|---|
model* | string | ID du modèle à utiliser (p. ex. gpt-5.4, qwen3.5-flash, gemini-2.5-flash). |
messages* | array | Liste des messages de la conversation. Chaque élément a un rôle et un contenu. |
stream | boolean | Si true, renvoie un flux d'événements SSE. Par défaut : false. |
temperature | number | Température d'échantillonnage 0–2. Plus élevée = plus aléatoire. Par défaut : 1. |
max_tokens | integer | Nombre maximal de tokens à générer. Plafond dépendant du modèle. |
top_p | number | Probabilité d'échantillonnage nucleus. 0–1. Par défaut : 1. |
stop | string[] | Jusqu'à 4 séquences où la génération s'arrêtera. |
n | integer | Nombre de choix de complétion à générer. Par défaut : 1. |
Exemple de requête
POST /v1/chat/completions
Authorization: Bearer YOUR_API_KEY
{
"model": "gpt-5.4-mini",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "What is the capital of France?"}
],
"temperature": 0.7,
"max_tokens": 256
} Exemple de réponse
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"created": 1714000000,
"model": "qwen3.5-flash",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "The capital of France is Paris."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 26,
"completion_tokens": 9,
"total_tokens": 35
}
} Cet endpoint route vers tous les fournisseurs derrière la passerelle — choisissez un model dans le model price comparison pour comparer les tarifs au token côte à côte.