🎁 Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Chat Completions

POST /v1/chat/completions

Crea una risposta del modello per la conversazione chat specificata. Compatibile con l'API OpenAI Chat Completions.

Corpo della richiesta

ParametroTipoDescrizione
model*stringID del modello da usare (es. gpt-5.4, qwen3.5-flash, gemini-2.5-flash).
messages*arrayElenco dei messaggi della conversazione. Ogni elemento ha role e content.
streambooleanSe true, restituisce uno stream di eventi SSE. Predefinito: false.
temperaturenumberTemperatura di campionamento 0–2. Più alta = più casuale. Predefinito: 1.
max_tokensintegerNumero massimo di token da generare. Limite dipendente dal modello.
top_pnumberProbabilità di nucleus sampling. 0–1. Predefinito: 1.
stopstring[]Fino a 4 sequenze in corrispondenza delle quali la generazione si interrompe.
nintegerNumero di scelte di completamento da generare. Predefinito: 1.

Esempio di richiesta

POST /v1/chat/completions
Authorization: Bearer YOUR_API_KEY

{
  "model": "gpt-5.4-mini",
  "messages": [
    {"role": "system", "content": "You are a helpful assistant."},
    {"role": "user",   "content": "What is the capital of France?"}
  ],
  "temperature": 0.7,
  "max_tokens": 256
}

Esempio di risposta

{
  "id": "chatcmpl-abc123",
  "object": "chat.completion",
  "created": 1714000000,
  "model": "qwen3.5-flash",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "The capital of France is Paris."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 26,
    "completion_tokens": 9,
    "total_tokens": 35
  }
}

Questo endpoint instrada verso ogni provider dietro il gateway — scegli un model nel model price comparison per confrontare i prezzi per token affiancati.