Claude Opus 4.5 è un modello Opus della generazione precedente, il rilascio che ha riposizionato il livello di punta di Anthropic a $5/$25 per milione di token, in calo dai $15/$75 di Claude Opus 4.1.
- Input
- testo immagine $5/M
- Output
- testo $25/M
- Lettura cache
- $0.5/M
- Contesto
- 200K
- Cutoff di conoscenza
- 2025-05
Benchmark
Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
Il prezzo nel contesto
Posizione del prezzo tra 60 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 200.000 |
|---|---|
| Output massimo (specifica del vendor) | 64.000 |
| Cutoff di conoscenza | 2025-05 |
| Dati di addestramento fino a | 2025-08 conoscenza fino a 2025-05 |
Caching prompt
| Modalità | esplicito (opt-in) |
|---|---|
| Prefisso min. | 4.096 predefinito del provider: 1.024 |
| Durata | 5 min predefinito, 1 ora opzionale |
| Costo di scrittura | 1.25x (5m) / 2x (1h) |
Ragionamento
| Parametro del fornitore | thinking.type "enabled" + budget_tokens, plus output_config.effort |
|---|---|
| Valori accettati | budget_tokens at least 1,024 and below max_tokens; effort low · medium · high (no xhigh, no max); "adaptive" returns 400 |
| Valore predefinito | thinking disattivato; effort high applicato se la richiesta non specifica nulla |
| Disattivabile | Sì |
| Comportamento del ragionamento | L'unico modello solo-extended-thinking che supporta l'effort: l'effort modella l'intera risposta mentre budget_tokens imposta la profondità del ragionamento, quindi impostali entrambi; i blocchi di thinking dei turni precedenti restano nel contesto e vengono fatturati come input; l'interleaved thinking richiede l'header beta interleaved-thinking-2025-05-14. |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine → testo |
|---|
- Modello legacy
- ha introdotto il parametro di effort (beta pubblica al lancio)
- 200k di contesto / 64k di output massimo
Usa Claude Opus 4.5 in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="claude-opus-4-5",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "claude-opus-4-5",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-4-5",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "claude-opus-4-5",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("claude-opus-4-5")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su Claude Opus 4.5
- Anthropic lo ha presentato come il suo modello più intelligente, capace di combinare la massima capacità con prestazioni pratiche, rivolto a compiti complessi e specializzati, all'ingegneria del software professionale e agli agent avanzati, con miglioramenti radicali in vision, coding e computer use.
- Supporta una finestra di contesto da 200K token, fino a 64K token di output, extended thinking, input visivo e le funzionalità di uso di strumenti e caching di Claude, con latenza moderata.
- È anche un ibrido in un modo rivelatore: è l'unico modello con solo extended thinking che accetta il parametro effort, e la raccomandazione di Anthropic è di impostarli entrambi.
- L'effort modella la risposta complessiva mentre il budget di thinking definisce la profondità del ragionamento.
- Qui l'effort copre da low fino a max ma non xhigh, che arriva con Opus 4.7.
- Richiedere il thinking adattivo restituisce un errore, il thinking è disattivato se non viene abilitato e il thinking interleaved richiede un header beta.
- A differenza del livello Haiku, i blocchi di thinking dei turni precedenti vengono conservati nel contesto e fatturati come input.
- Il caching dei prompt richiede un prefisso minimo di 4.096 token.
- Anthropic lo elenca come modello legacy e raccomanda la migrazione ai rilasci Opus più recenti.
- Per i team standardizzati sugli SDK OpenAI, Synthorai serve Claude Opus 4.5 tramite la sua chat API compatibile OpenAI.
FAQ
L'API di Claude Opus 4.5 si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $5/M token in input, quel credito da solo copre circa 24 richieste da ~8K token verso Claude Opus 4.5.
In cosa eccelle Claude Opus 4.5?
Livello di punta riposizionato a $5/$25 per milione; contesto da 200K con extended thinking; elencato come legacy, migrazione ai più recenti raccomandata. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa Claude Opus 4.5?
Su Synthorai, Claude Opus 4.5 costa $5 per milione di token in input e $25 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.5/M.
Claude Opus 4.5 supporta il caching dei prompt?
Sì, su opt-in: marca i prefissi stabili con breakpoint cache_control. I token di input in cache si fatturano a $0.5/M contro $5/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 4,096 token (TTL 5 min predefinito, 1 ora opzionale). Guida al caching dei prompt →
Come ottengo l'accesso a Claude Opus 4.5?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="claude-opus-4-5" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Qual è il cutoff di conoscenza di Claude Opus 4.5?
Il cutoff di conoscenza di Claude Opus 4.5 è 2025-05, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-09).
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.