Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Claude Sonnet 4.5

Rilasciato 2025-09-29

chatCodiceRagionamentoChiamata di strumentiVisioneCaching dei prompt

Claude Sonnet 4.5 è un modello Sonnet della generazione precedente che resta disponibile sulla piattaforma Claude.

Input
testo immagine $3/M
Output
testo $15/M
Lettura cache
$0.3/M
Contesto
200K
vs GPT-4o
~40% più economico
Cutoff di conoscenza
2025-01

Benchmark

Sopra la media1 / 6
Claude Sonnet 4.5 altri modelli misurati media dei modelli confrontati nessun altro modello ha fatto meglio
SciCode
45%
GPQA Diamond
83%

Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Il prezzo nel contesto

Posizione del prezzo tra 60 modelli comparabili

Input$3/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Output$15/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lettura da cache$0.3/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Token

Finestra di contesto (specifica del fornitore) 200.000
Output massimo (specifica del vendor) 64.000
Cutoff di conoscenza 2025-01
Dati di addestramento fino a 2025-07 conoscenza fino a 2025-01

Caching prompt

Modalità esplicito (opt-in)
Prefisso min. 1.024
Durata 5 min predefinito, 1 ora opzionale
Costo di scrittura 1.25x (5m) / 2x (1h)

Ragionamento

Parametro del fornitore thinking.type "enabled" + budget_tokens
Valori accettati budget_tokens at least 1,024 and below max_tokens; "adaptive" returns 400
Valore predefinito disattivato, senza thinking a meno che non sia la richiesta a impostarlo applicato se la richiesta non specifica nulla
Disattivabile
Comportamento del ragionamento Solo extended thinking, senza parametro di effort; i blocchi di thinking dei turni precedenti vengono rimossi mantenendo solo l'ultimo; l'interleaved thinking richiede l'header beta interleaved-thinking-2025-05-14.
Parametro reasoning_effort
Valori minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra

Modello

Modalità testo + immagine → testo
  • Modello legacy
  • la beta del contesto da 1M (context-1m-2025-08-07) è stata ritirata il 2026-04-30, ora è limitato a 200k di contesto / 64k di output massimo

fonte: documentazione ufficiale Anthropic ↗

Usa Claude Sonnet 4.5 in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-sonnet-4-5",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Informazioni su Claude Sonnet 4.5

  • Abbina una latenza comparativamente rapida a un ragionamento solido, supportando una finestra di contesto da 200K token, fino a 64K token di output, extended thinking, input visivo e l'intero stack di uso di strumenti di Claude a $3/$15 per milione di token.
  • Anthropic lo ha presentato come il suo modello migliore per agent e coding complessi, con l'intelligenza più alta sulla maggior parte dei compiti all'epoca, ed è il rilascio in cui gli output strutturati sono arrivati per la prima volta in beta pubblica, prima di passare alla disponibilità generale.
  • Un limite merita attenzione prima di dimensionare un carico di lavoro: la sua beta con contesto da 1M di token è stata ritirata ad aprile 2026, e le richieste sopra la finestra standard da 200K ora restituiscono un errore anziché troncare silenziosamente.
  • Il thinking è quello in stile extended più vecchio, con un budget di token esplicito, il tipo di thinking adattivo restituisce un errore e non esiste un parametro di effort; il thinking interleaved richiede un header beta e i blocchi di thinking dei turni precedenti vengono rimossi anziché riportati avanti.
  • Il caching dei prompt parte da un prefisso di 1.024 token.
  • Anthropic ora raccomanda i rilasci Sonnet più recenti per prestazioni migliori, ma Sonnet 4.5 resta uno snapshot stabile e fissato per i carichi di lavoro tarati su di esso.
  • Synthorai continua a servirlo dietro la stessa API compatibile OpenAI del resto del catalogo.

FAQ

L'API di Claude Sonnet 4.5 si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $3/M token in input, quel credito da solo copre circa 41 richieste da ~8K token verso Claude Sonnet 4.5.

In cosa eccelle Claude Sonnet 4.5?

Latenza rapida abbinata a ragionamento forte; $3/$15 per milione con contesto da 200K; snapshot stabile e fissato per carichi di lavoro tarati. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa Claude Sonnet 4.5?

Su Synthorai, Claude Sonnet 4.5 costa $3 per milione di token in input e $15 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.3/M.

Claude Sonnet 4.5 supporta il caching dei prompt?

Sì, su opt-in: marca i prefissi stabili con breakpoint cache_control. I token di input in cache si fatturano a $0.3/M contro $3/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5 min predefinito, 1 ora opzionale). Guida al caching dei prompt →

Come ottengo l'accesso a Claude Sonnet 4.5?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="claude-sonnet-4-5" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Qual è il cutoff di conoscenza di Claude Sonnet 4.5?

Il cutoff di conoscenza di Claude Sonnet 4.5 è 2025-01, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →