🎁 Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Chat Completions

POST /v1/chat/completions

Crée une réponse du modèle pour la conversation de chat donnée. Compatible avec l'API OpenAI Chat Completions.

Corps de la requête

ParamètreTypeDescription
model*stringID du modèle à utiliser (p. ex. gpt-5.4, qwen3.5-flash, gemini-2.5-flash).
messages*arrayListe des messages de la conversation. Chaque élément a un rôle et un contenu.
streambooleanSi true, renvoie un flux d'événements SSE. Par défaut : false.
temperaturenumberTempérature d'échantillonnage 0–2. Plus élevée = plus aléatoire. Par défaut : 1.
max_tokensintegerNombre maximal de tokens à générer. Plafond dépendant du modèle.
top_pnumberProbabilité d'échantillonnage nucleus. 0–1. Par défaut : 1.
stopstring[]Jusqu'à 4 séquences où la génération s'arrêtera.
nintegerNombre de choix de complétion à générer. Par défaut : 1.

Exemple de requête

POST /v1/chat/completions
Authorization: Bearer YOUR_API_KEY

{
  "model": "gpt-5.4-mini",
  "messages": [
    {"role": "system", "content": "You are a helpful assistant."},
    {"role": "user",   "content": "What is the capital of France?"}
  ],
  "temperature": 0.7,
  "max_tokens": 256
}

Exemple de réponse

{
  "id": "chatcmpl-abc123",
  "object": "chat.completion",
  "created": 1714000000,
  "model": "qwen3.5-flash",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "The capital of France is Paris."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 26,
    "completion_tokens": 9,
    "total_tokens": 35
  }
}

Cet endpoint route vers tous les fournisseurs derrière la passerelle — choisissez un model dans le model price comparison pour comparer les tarifs au token côte à côte.