Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Claude Sonnet 5

Date de sortie : 2026-06-30

chatCodeRaisonnementAppel d'outilsVisionMise en cache des prompts

Claude Sonnet 5 est la nouvelle génération de la famille Sonnet d'Anthropic (« la meilleure combinaison de vitesse et d'intelligence »), positionnée comme une mise à niveau de capacités prête à l'emploi par rapport à Sonnet 4.6, avec les gains les plus importants sur le codage et les tâches agentiques.

Entrée
texte image $2/M
Sortie
texte $10/M
Lecture de cache
$0.2/M
Contexte
1M
vs GPT-4o
~60% moins cher
Coupure des connaissances
2026-01

Benchmarks

Au-dessus de la moyenneAucun meilleur8 / 181 / 18
Claude Sonnet 5 autres modèles mesurés moyenne des modèles comparés aucun autre modèle n'a fait mieux
Terminal-Bench 2.1
80.4%
BioMysteryBench hard
34.1%
GDPval-AA v2 Elo · 642-1861
1598
Harvey Lab-AA
90.1%
HLE-Verified
31%
AutomationBench
10.7%
LVBench
68.5%

Chiffres publiés par les fournisseurs : Alibaba (Qwen) Anthropic DeepSeek Google Moonshot OpenAI Tencent

Le prix en contexte

Position du prix parmi 60 modèles comparables

Entrée$2/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Sortie$10/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lecture en cache$0.2/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.

Spécifications et limites

Tokens

Fenêtre de contexte (spécification du fournisseur) 1 000 000
Sortie max (spéc. fournisseur) 128 000
Coupure des connaissances 2026-01

Mise en cache

Mode explicite (sur activation)
Préfixe min. 1 024
Durée de vie 5 min par défaut, 1 heure en option
Coût d'écriture 1.25x (5m) / 2x (1h)

Raisonnement

Paramètre du fournisseur thinking.type "adaptive" + output_config.effort
Valeurs acceptées thinking.type adaptive · disabled; effort low · medium · high · xhigh · max; "enabled" returns 400
Valeur par défaut réflexion activée (adaptive) ; effort high appliquée si la requête ne précise rien
Désactivable Oui
Comportement du raisonnement La réflexion est active sans aucune configuration, et thinking {type « disabled »} est accepté à tout niveau d'effort, contrairement à Opus 5 ; display vaut « omitted » par défaut ; les blocs de réflexion des tours précédents sont conservés dans le contexte et facturés en entrée.
Paramètre reasoning_effort
Valeurs minimal · low · medium · high la surface de paramètres de la passerelle - le mappage fournisseur ci-dessus s'applique

Modèle

Modalités texte + image → texte
  • Tarification de lancement à 2 $/10 $ par MTok jusqu'au 2026-08-31
  • contexte de 1M
  • réflexion adaptative activée par défaut
  • nouveau tokenizer (~30 % de tokens en plus)
  • les paramètres d'échantillonnage non par défaut renvoient 400
  • pas de Priority Tier

selon docs officielles Anthropic ↗

Un prompt, mesuré via la passerelle

PROMPT Explain to a CFO, in exactly three sentences, why our LLM bill doubled after we enabled reasoning. VÉRIFIER exactement 3 phrases

Claude Sonnet 5 réussi · 3 sentences

Reasoning mode works by having the model generate extended internal "thinking" steps before producing its final answer, and since we're billed on total tokens, that hidden reasoning text adds significantly to what we pay for—even though you never see it in the output. This is different from simply getting longer visible responses; the model is essentially "showing its work" behind the scenes, and complex prompts can trigger thousands of extra reasoning tokens per request. The upside is improved accuracy on complex tasks, but if we want to control costs, we should selectively enable reasoning only for queries that truly need it, rather than applying it universally.

sortie 194 tok latence 4.3 s

Suivi de l'instruction (exactement trois phrases - comptables), adaptation à l'audience (registre CFO), et l'écart de facturation lié à la réflexion cachée que les compteurs de tokens ci-dessous révèlent.

PROMPT This function is supposed to return the longest run of consecutive equal items, but callers report it is off by one on single-element inputs and misses runs that end at the last index. Fix it and explain the bug in one paragraph. VÉRIFIER le correctif passe les tests

Claude Sonnet 5 réussi · 8/8 cases

## The Bug The function has two related off-by-one issues rooted in the same cause: `cur` and `best` are initialized to `0` instead of `1`, treating run lengths as the number of *matches* between adjacent elements rather than the number of *elements* in the run. This means a single-element input never enters the loop (since `range(1, 1)` is empty) and returns `0` instead of the correct answer of `1`. It also means that for any input, the run length is undercounted by exactly one — a run of 3 equal elements only produces 2 "match" increments, so `best` ends up as 2 instead of 3. The claim that it "misses runs that end at the last index" is actually a symptom of this same undercount: the logic does update `best` correctly on every iteration (including the last), but because it's counting matches instead of elements, the final reported value is always one less than the true longest run. […]

sortie 536 tok latence 7.1 s

Si le correctif est réellement juste (exécutable), la densité de l'explication, et l'efficacité en tokens sur une tâche bornée.

PROMPT Extract a JSON object with fields {company, quarter, revenue_usd_m, growth_pct, guidance} from this text. Use null for anything not stated; add no other fields. VÉRIFIER JSON valide, schéma exact

Claude Sonnet 5 réussi · 5/5 fields, guidance null

```json { "company": "Meridian Robotics", "quarter": "Q3", "revenue_usd_m": 412, "growth_pct": 11.5, "guidance": null } ```

sortie 348 tok latence 5.3 s

Respect du schéma (aucun champ inventé), pression d'hallucination (guidance est explicitement retenue), et différences de chemin pour la sortie structurée.

PROMPT Write a 120-word product announcement for an API gateway feature that caches prompts across providers. Forbidden words: "seamless", "unlock", "game-changer", "revolutionize", "empower". Exactly one sentence must be a question. VÉRIFIER 120 mots, 0 mot interdit

Claude Sonnet 5 réussi · 123 words, 0 banned, 1 question

## Introducing Cross-Provider Prompt Caching We're rolling out a new caching layer for our API gateway that works across every major LLM provider you connect through it. Instead of resending identical prompts and paying full price each time, the gateway recognizes repeated requests and serves cached responses in milliseconds—regardless of whether you're routing to OpenAI, Anthropic, or Google. What does this mean for your bill and your latency? Both drop, often significantly, especially for teams running high-volume, repetitive workloads like customer support bots or batch content generation. The cache is configurable per route, with adjustable TTLs and invalidation rules, so you stay in control of freshness versus cost. Available now for all Pro and Enterprise plans. Check your dashboard to enable it today.

sortie 259 tok latence 4.8 s

Respect des contraintes (budget de mots, liste de mots interdits, l'unique question), empreinte stylistique, et contrôle de la longueur.

Utilisez Claude Sonnet 5 en 30 secondes

Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

À propos de Claude Sonnet 5

  • Anthropic le destine à la génération de code, à l'analyse de données, à la création de contenu, à la compréhension visuelle et à l'utilisation agentique d'outils, et le présente comme l'option pour le travail qui demande plus que Sonnet 4.6 sans passer à un modèle de classe Opus.
  • Il embarque par défaut une fenêtre de contexte de 1M de tokens, 128K en sortie maximale, la réflexion adaptative activée par défaut avec contrôle du niveau d'effort, un nouveau tokenizer, l'entrée visuelle et l'ensemble complet des outils de Claude ; une tarification de lancement s'applique jusqu'au 31 août 2026.
  • La fenêtre de 1M est à la fois la valeur par défaut et le maximum (il n'existe pas de variante à contexte plus réduit), et l'effort atteint xhigh, ce qu'aucun autre modèle non Opus ne propose, medium étant décrit comme à peu près comparable à Sonnet 4.6 à effort high.
  • Trois changements de comportement comptent lors de la migration.
  • Le nouveau tokenizer produit environ 30 % de tokens en plus pour le même texte, ce qui modifie les compteurs d'usage, les budgets de sortie et le coût par requête sans aucun changement d'API.
  • Les paramètres d'échantillonnage non par défaut renvoient désormais une erreur, restriction auparavant réservée à Opus 4.7 et suivants.
  • Et c'est le premier modèle du palier Sonnet doté de garde-fous de cybersécurité en temps réel, où une requête refusée revient sous la forme d'une réponse réussie portant une raison d'arrêt de refus plutôt que d'une erreur.
  • Sur Synthorai, Claude Sonnet 5 répond sur la même API compatible OpenAI que tout autre modèle du catalogue.

FAQ

Peut-on essayer l'API Claude Sonnet 5 gratuitement ?

Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $2/M de tokens en entrée, ce crédit couvre à lui seul environ 62 requêtes de ~8K tokens sur Claude Sonnet 5.

Quels sont les points forts de Claude Sonnet 5 ?

Gains les plus importants sur le codage et les tâches agentiques ; fenêtre de contexte de 1M de tokens par défaut ; mise à niveau de capacités prête à l'emploi depuis Sonnet 4.6. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.

Combien coûte Claude Sonnet 5 ?

Sur Synthorai, Claude Sonnet 5 coûte $2 par million de tokens en entrée et $10 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.2/M.

Claude Sonnet 5 prend-il en charge la mise en cache des prompts ?

Oui, sur activation : marquez les préfixes stables avec des points d'arrêt cache_control. Les tokens d'entrée en cache sont facturés $0.2/M contre $2/M hors cache ; les prompts doivent avoir un préfixe stable de 1,024 tokens pour être mis en cache (TTL 5 min par défaut, 1 heure en option). Guide de mise en cache des prompts →

Comment obtenir l'accès à Claude Sonnet 5 ?

Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="claude-sonnet-5", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.

Quelle est la date de coupure des connaissances de Claude Sonnet 5 ?

La date de coupure des connaissances de Claude Sonnet 5 est 2026-01, selon la documentation officielle du fournisseur (au 2026-07-09).

Modèles associés

Comparer

Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.

Obtenez votre clé API Comparez votre coût →