Claude Sonnet 4.5 è un modello Sonnet della generazione precedente che resta disponibile sulla piattaforma Claude.
- Input
- testo immagine $3/M
- Output
- testo $15/M
- Lettura cache
- $0.3/M
- Contesto
- 200K
- vs GPT-4o
- ~40% più economico
- Cutoff di conoscenza
- 2025-01
Benchmark
Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
Il prezzo nel contesto
Posizione del prezzo tra 60 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 200.000 |
|---|---|
| Output massimo (specifica del vendor) | 64.000 |
| Cutoff di conoscenza | 2025-01 |
| Dati di addestramento fino a | 2025-07 conoscenza fino a 2025-01 |
Caching prompt
| Modalità | esplicito (opt-in) |
|---|---|
| Prefisso min. | 1.024 |
| Durata | 5 min predefinito, 1 ora opzionale |
| Costo di scrittura | 1.25x (5m) / 2x (1h) |
Ragionamento
| Parametro del fornitore | thinking.type "enabled" + budget_tokens |
|---|---|
| Valori accettati | budget_tokens at least 1,024 and below max_tokens; "adaptive" returns 400 |
| Valore predefinito | disattivato, senza thinking a meno che non sia la richiesta a impostarlo applicato se la richiesta non specifica nulla |
| Disattivabile | Sì |
| Comportamento del ragionamento | Solo extended thinking, senza parametro di effort; i blocchi di thinking dei turni precedenti vengono rimossi mantenendo solo l'ultimo; l'interleaved thinking richiede l'header beta interleaved-thinking-2025-05-14. |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine → testo |
|---|
- Modello legacy
- la beta del contesto da 1M (context-1m-2025-08-07) è stata ritirata il 2026-04-30, ora è limitato a 200k di contesto / 64k di output massimo
Usa Claude Sonnet 4.5 in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="claude-sonnet-4-5",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "claude-sonnet-4-5",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-4-5",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "claude-sonnet-4-5",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("claude-sonnet-4-5")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su Claude Sonnet 4.5
- Abbina una latenza comparativamente rapida a un ragionamento solido, supportando una finestra di contesto da 200K token, fino a 64K token di output, extended thinking, input visivo e l'intero stack di uso di strumenti di Claude a $3/$15 per milione di token.
- Anthropic lo ha presentato come il suo modello migliore per agent e coding complessi, con l'intelligenza più alta sulla maggior parte dei compiti all'epoca, ed è il rilascio in cui gli output strutturati sono arrivati per la prima volta in beta pubblica, prima di passare alla disponibilità generale.
- Un limite merita attenzione prima di dimensionare un carico di lavoro: la sua beta con contesto da 1M di token è stata ritirata ad aprile 2026, e le richieste sopra la finestra standard da 200K ora restituiscono un errore anziché troncare silenziosamente.
- Il thinking è quello in stile extended più vecchio, con un budget di token esplicito, il tipo di thinking adattivo restituisce un errore e non esiste un parametro di effort; il thinking interleaved richiede un header beta e i blocchi di thinking dei turni precedenti vengono rimossi anziché riportati avanti.
- Il caching dei prompt parte da un prefisso di 1.024 token.
- Anthropic ora raccomanda i rilasci Sonnet più recenti per prestazioni migliori, ma Sonnet 4.5 resta uno snapshot stabile e fissato per i carichi di lavoro tarati su di esso.
- Synthorai continua a servirlo dietro la stessa API compatibile OpenAI del resto del catalogo.
FAQ
L'API di Claude Sonnet 4.5 si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $3/M token in input, quel credito da solo copre circa 41 richieste da ~8K token verso Claude Sonnet 4.5.
In cosa eccelle Claude Sonnet 4.5?
Latenza rapida abbinata a ragionamento forte; $3/$15 per milione con contesto da 200K; snapshot stabile e fissato per carichi di lavoro tarati. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa Claude Sonnet 4.5?
Su Synthorai, Claude Sonnet 4.5 costa $3 per milione di token in input e $15 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.3/M.
Claude Sonnet 4.5 supporta il caching dei prompt?
Sì, su opt-in: marca i prefissi stabili con breakpoint cache_control. I token di input in cache si fatturano a $0.3/M contro $3/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5 min predefinito, 1 ora opzionale). Guida al caching dei prompt →
Come ottengo l'accesso a Claude Sonnet 4.5?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="claude-sonnet-4-5" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Qual è il cutoff di conoscenza di Claude Sonnet 4.5?
Il cutoff di conoscenza di Claude Sonnet 4.5 è 2025-01, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.