Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Claude Opus 5.5

Date de sortie : 2026-09-22

chatCodeRaisonnementAppel d'outilsVisionMise en cache des prompts

Claude Opus 5.5 est le modèle d'Anthropic pour le codage agentique de longue durée et le travail intellectuel, sorti le 22 septembre 2026, et la vue d'ensemble des modèles d'Anthropic recommande de commencer par lui pour la plupart des charges, en réservant Claude Fable 5.1 au raisonnement le plus exigeant.

Entrée
texte image $4/M
Sortie
texte $20/M
Lecture de cache
$0.2/M
Contexte
1M
vs GPT-4o
~20% moins cher
Coupure des connaissances
2026-06

Benchmarks

Au-dessus de la moyenneAucun meilleur9 / 97 / 9
Claude Opus 5.5 autres modèles mesurés moyenne des modèles comparés aucun autre modèle n'a fait mieux
Terminal-bench 4.0
aucun autre modèle n'a fait mieux 66.4%
OSWorld 2.0 partial
aucun autre modèle n'a fait mieux 81.8%
Terminal-Bench-Science 0.1
58.7%
Humanity's Last Exam with tools
aucun autre modèle n'a fait mieux 67.7%
AutomationBench
40%
Chartography with tools
aucun autre modèle n'a fait mieux 89%

Chiffres publiés par les fournisseurs : Alibaba (Qwen) Anthropic DeepSeek Google Moonshot OpenAI Z.ai

Le prix en contexte

Position du prix parmi 67 modèles comparables

Entrée$4/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Sortie$20/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lecture en cache$0.2/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.

Spécifications et limites

Tokens

Fenêtre de contexte (spécification du fournisseur) 1 000 000
Sortie max (spéc. fournisseur) 128 000
Coupure des connaissances 2026-06

Mise en cache

Mode explicite (sur activation)
Préfixe min. 512 défaut du fournisseur : 1 024
Durée de vie 5 min par défaut, 1 heure en option
Coût d'écriture 1.25x (5m) / 2x (1h)

Raisonnement

Paramètre du fournisseur output_config.effort
Valeurs acceptées low · medium · high · xhigh · max
Valeur par défaut medium appliquée si la requête ne précise rien
Désactivable Non
Comportement du raisonnement Adaptive thinking is always on: thinking {"type": "disabled"} and a manual {"type": "enabled", "budget_tokens": N} both return a 400 error, so effort is the only depth control. The default dropped from high on Claude Opus 5 to medium.
Paramètre reasoning_effort
Valeurs minimal · low · medium · high la surface de paramètres de la passerelle - le mappage fournisseur ci-dessus s'applique

Modèle

Modalités texte + image → texte
  • 1M context at standard pricing with no long-context tier
  • prompt-cache reads cost 0.05x input ($0.20/M) rather than the usual 0.1x
  • minimum cacheable prompt 512 tokens
  • forced tool use (tool_choice any or tool) returns a 400
  • thinking blocks are tied to the model and conversation that produced them
  • up to 300k output tokens on the Message Batches API with the output-300k-2026-03-24 beta header
  • fast mode is a research preview on the Claude API only

selon docs officielles Anthropic ↗

Un prompt, mesuré via la passerelle

PROMPT Explain to a CFO, in exactly three sentences, why our LLM bill doubled after we enabled reasoning. VÉRIFIER exactement 3 phrases

Claude Opus 5.5 réussi · 3 sentences

When we turned on reasoning, the model began "thinking out loud" before each answer, generating thousands of internal working tokens that users never see but that we are billed for just like the final response. Those hidden tokens are charged at the output rate, typically the most expensive rate, so the same question with the same visible answer now costs roughly twice as much or more. We can bring the bill back down without losing the quality gains by capping the reasoning budget and reserving reasoning mode for the complex tasks that actually benefit from it.

sortie 263 tok (+102 réflexion) latence 5.7 s

Suivi de l'instruction (exactement trois phrases - comptables), adaptation à l'audience (registre CFO), et l'écart de facturation lié à la réflexion cachée que les compteurs de tokens ci-dessous révèlent.

PROMPT This function is supposed to return the longest run of consecutive equal items, but callers report it is off by one on single-element inputs and misses runs that end at the last index. Fix it and explain the bug in one paragraph. VÉRIFIER le correctif passe les tests

Claude Opus 5.5 réussi · 8/8 cases

```python def longest_run(xs): if not xs: return 0 best = 1 cur = 1 for i in range(1, len(xs)): if xs[i] == xs[i - 1]: cur += 1 best = max(best, cur) else: cur = 1 return best ``` **Explanation:** The original code counted *matching adjacent pairs* rather than *items in a run*. Both `cur` and `best` started at 0, and `cur` reset to 0 on a mismatch, so a run of length *n* was reported as *n − 1*. For a single-element list the loop never executes, so it returned 0 instead of 1. For `[5, 5]` it returned 1 instead of 2. The fix treats every element as the start of a run of length 1: `best` and `cur` start at 1, and `cur` resets to 1 (not 0) when the value changes. An explicit check returns 0 for an empty list. The "misses runs at the last index" reports are the same off-by-one bug rather than a separate one. […]

sortie 723 tok (+303 réflexion) latence 10.4 s

Si le correctif est réellement juste (exécutable), la densité de l'explication, et l'efficacité en tokens sur une tâche bornée.

PROMPT Extract a JSON object with fields {company, quarter, revenue_usd_m, growth_pct, guidance} from this text. Use null for anything not stated; add no other fields. VÉRIFIER JSON valide, schéma exact

Claude Opus 5.5 réussi · 5/5 fields, guidance "Withheld pending Q4 close"

```json { "company": "Meridian Robotics", "quarter": "September quarter", "revenue_usd_m": 412, "growth_pct": 11, "guidance": "Withheld pending Q4 close" } ``` **Judgment calls to check:** - **quarter**: Kept as "September quarter" rather than "Q3", since the fiscal calendar isn't stated. The text mentions an upcoming "Q4 close," so it may be fiscal Q3, but that's not certain. - **revenue_usd_m**: The text says only "412 for the topline." It doesn't state currency or units, and the figure is on a constant-currency basis, not reported USD. USD millions is an assumption. Use `null` if you need strictly stated values. - **growth_pct**: The source says "eleven and change," so the true figure is slightly above 11. 11 is an approximation. - **guidance**: Guidance was explicitly withheld. I recorded that rather than `null`, since the text addresses it directly.

sortie 829 tok (+488 réflexion) latence 10.9 s

Respect du schéma (aucun champ inventé), pression d'hallucination (guidance est explicitement retenue), et différences de chemin pour la sortie structurée.

PROMPT Write a 120-word product announcement for an API gateway feature that caches prompts across providers. Forbidden words: "seamless", "unlock", "game-changer", "revolutionize", "empower". Exactly one sentence must be a question. VÉRIFIER 120 mots, 0 mot interdit

Claude Opus 5.5 réussi · 120 words, 0 banned, 1 question

Today we're launching Cross-Provider Prompt Caching for our API gateway. Why pay twice for the same context? Our gateway now stores repeated prompt prefixes, system instructions, and document chunks, then reuses them whether your request goes to OpenAI, Anthropic, Google, or an open-source model. Teams running retrieval pipelines or long agent loops can cut token costs by up to 60 percent and trim latency on every cached call. Setup takes one configuration flag; no code changes are required. Cache rules respect tenant boundaries, expire on your schedule, and log every hit for audit review. Dashboards show savings by provider, route, and application in real time. Cross-Provider Prompt Caching is available on all Pro and Enterprise plans. Turn it on today.

sortie 1263 tok (+1007 réflexion) latence 13.5 s

Respect des contraintes (budget de mots, liste de mots interdits, l'unique question), empreinte stylistique, et contrôle de la longueur.

Utilisez Claude Opus 5.5 en 30 secondes

Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-opus-5-5",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

À propos de Claude Opus 5.5

  • Il coûte $4 par million de tokens d'entrée et $20 par million de tokens de sortie, et les lectures du cache de prompts sont facturées à 5 % du prix d'entrée ($0.20 par million) au lieu des 10 % habituels, ce qui rend nettement moins chères les boucles d'agents qui renvoient un préfixe stable.
  • Il conserve une fenêtre de contexte de 1M tokens sans surcoût de contexte long, 128K de sortie maximale, l'entrée texte et image, et une date limite de connaissances fixée à juin 2026.
  • La documentation d'Anthropic liste quatre changements incompatibles pour le code qui quitte Claude Opus 5 : la réflexion adaptative est toujours active, si bien que la désactiver ou fixer un budget manuel renvoie une erreur et que le paramètre effort, désormais medium par défaut, est le seul réglage de profondeur ; l'usage forcé d'outils via tool_choice any ou tool est refusé, il faut donc garder tool_choice sur auto et recourir à l'usage strict des outils ou aux sorties structurées pour obtenir un JSON conforme au schéma ; les blocs de réflexion sont liés au modèle et à la conversation qui les ont produits ; et l'ancien outil computer_20251124 n'est pas accepté sur la Claude API.
  • Les courtes notes que le modèle écrit entre deux appels d'outils arrivent désormais sous forme de blocs de réflexion, de sorte que les interfaces qui les diffusent en streaming doivent définir une valeur display pour thinking.
  • Synthorai propose Claude Opus 5.5 via les mêmes API que le reste de la gamme Claude.

FAQ

Peut-on essayer l'API Claude Opus 5.5 gratuitement ?

Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $4/M de tokens en entrée, ce crédit couvre à lui seul environ 31 requêtes de ~8K tokens sur Claude Opus 5.5.

Quels sont les points forts de Claude Opus 5.5 ?

Le point de départ recommandé par Anthropic pour la plupart des charges ; lectures de cache à 5 % de l'entrée, $0.20 par million de tokens ; réflexion toujours active ; effort medium par défaut. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.

Combien coûte Claude Opus 5.5 ?

Sur Synthorai, Claude Opus 5.5 coûte $4 par million de tokens en entrée et $20 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.2/M.

Claude Opus 5.5 prend-il en charge la mise en cache des prompts ?

Oui, sur activation : marquez les préfixes stables avec des points d'arrêt cache_control. Les tokens d'entrée en cache sont facturés $0.2/M contre $4/M hors cache ; les prompts doivent avoir un préfixe stable de 512 tokens pour être mis en cache (TTL 5 min par défaut, 1 heure en option). Guide de mise en cache des prompts →

Comment obtenir l'accès à Claude Opus 5.5 ?

Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="claude-opus-5-5", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.

Quelle est la date de coupure des connaissances de Claude Opus 5.5 ?

La date de coupure des connaissances de Claude Opus 5.5 est 2026-06, selon la documentation officielle du fournisseur (au 2026-09-23).

Modèles associés

Comparer

Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.

Obtenez votre clé API Comparez votre coût →