Claude Sonnet 5 est la nouvelle génération de la famille Sonnet d'Anthropic (« la meilleure combinaison de vitesse et d'intelligence »), positionnée comme une mise à niveau de capacités prête à l'emploi par rapport à Sonnet 4.6, avec les gains les plus importants sur le codage et les tâches agentiques.
- Entrée
- texte image $2/M
- Sortie
- texte $10/M
- Lecture de cache
- $0.2/M
- Contexte
- 1M
- vs GPT-4o
- ~60% moins cher
- Coupure des connaissances
- 2026-01
Benchmarks
Chiffres publiés par les fournisseurs : Alibaba (Qwen) Anthropic DeepSeek Google Moonshot OpenAI Tencent
Le prix en contexte
Position du prix parmi 60 modèles comparables
La barre montre où se situe le prix de ce modèle parmi tous les modèles du même type sur Synthorai. Le moins cher et le plus cher sont nommés à chaque extrémité. Ce sont des tarifs de base ; les remises lot, région et écriture en cache figurent sur la page des tarifs.
Spécifications et limites
Tokens
| Fenêtre de contexte (spécification du fournisseur) | 1 000 000 |
|---|---|
| Sortie max (spéc. fournisseur) | 128 000 |
| Coupure des connaissances | 2026-01 |
Mise en cache
| Mode | explicite (sur activation) |
|---|---|
| Préfixe min. | 1 024 |
| Durée de vie | 5 min par défaut, 1 heure en option |
| Coût d'écriture | 1.25x (5m) / 2x (1h) |
Raisonnement
| Paramètre du fournisseur | thinking.type "adaptive" + output_config.effort |
|---|---|
| Valeurs acceptées | thinking.type adaptive · disabled; effort low · medium · high · xhigh · max; "enabled" returns 400 |
| Valeur par défaut | réflexion activée (adaptive) ; effort high appliquée si la requête ne précise rien |
| Désactivable | Oui |
| Comportement du raisonnement | La réflexion est active sans aucune configuration, et thinking {type « disabled »} est accepté à tout niveau d'effort, contrairement à Opus 5 ; display vaut « omitted » par défaut ; les blocs de réflexion des tours précédents sont conservés dans le contexte et facturés en entrée. |
| Paramètre | reasoning_effort |
| Valeurs | minimal · low · medium · high la surface de paramètres de la passerelle - le mappage fournisseur ci-dessus s'applique |
Modèle
| Modalités | texte + image → texte |
|---|
- Tarification de lancement à 2 $/10 $ par MTok jusqu'au 2026-08-31
- contexte de 1M
- réflexion adaptative activée par défaut
- nouveau tokenizer (~30 % de tokens en plus)
- les paramètres d'échantillonnage non par défaut renvoient 400
- pas de Priority Tier
Un prompt, mesuré via la passerelle
Claude Sonnet 5 réussi · 3 sentences
Reasoning mode works by having the model generate extended internal "thinking" steps before producing its final answer, and since we're billed on total tokens, that hidden reasoning text adds significantly to what we pay for—even though you never see it in the output. This is different from simply getting longer visible responses; the model is essentially "showing its work" behind the scenes, and complex prompts can trigger thousands of extra reasoning tokens per request. The upside is improved accuracy on complex tasks, but if we want to control costs, we should selectively enable reasoning only for queries that truly need it, rather than applying it universally.
sortie 194 tok latence 4.3 s
Suivi de l'instruction (exactement trois phrases - comptables), adaptation à l'audience (registre CFO), et l'écart de facturation lié à la réflexion cachée que les compteurs de tokens ci-dessous révèlent.
Claude Sonnet 5 réussi · 8/8 cases
## The Bug The function has two related off-by-one issues rooted in the same cause: `cur` and `best` are initialized to `0` instead of `1`, treating run lengths as the number of *matches* between adjacent elements rather than the number of *elements* in the run. This means a single-element input never enters the loop (since `range(1, 1)` is empty) and returns `0` instead of the correct answer of `1`. It also means that for any input, the run length is undercounted by exactly one — a run of 3 equal elements only produces 2 "match" increments, so `best` ends up as 2 instead of 3. The claim that it "misses runs that end at the last index" is actually a symptom of this same undercount: the logic does update `best` correctly on every iteration (including the last), but because it's counting matches instead of elements, the final reported value is always one less than the true longest run. […]
sortie 536 tok latence 7.1 s
Si le correctif est réellement juste (exécutable), la densité de l'explication, et l'efficacité en tokens sur une tâche bornée.
Claude Sonnet 5 réussi · 5/5 fields, guidance null
```json { "company": "Meridian Robotics", "quarter": "Q3", "revenue_usd_m": 412, "growth_pct": 11.5, "guidance": null } ```
sortie 348 tok latence 5.3 s
Respect du schéma (aucun champ inventé), pression d'hallucination (guidance est explicitement retenue), et différences de chemin pour la sortie structurée.
Claude Sonnet 5 réussi · 123 words, 0 banned, 1 question
## Introducing Cross-Provider Prompt Caching We're rolling out a new caching layer for our API gateway that works across every major LLM provider you connect through it. Instead of resending identical prompts and paying full price each time, the gateway recognizes repeated requests and serves cached responses in milliseconds—regardless of whether you're routing to OpenAI, Anthropic, or Google. What does this mean for your bill and your latency? Both drop, often significantly, especially for teams running high-volume, repetitive workloads like customer support bots or batch content generation. The cache is configurable per route, with adjustable TTLs and invalidation rules, so you stay in control of freshness versus cost. Available now for all Pro and Enterprise plans. Check your dashboard to enable it today.
sortie 259 tok latence 4.8 s
Respect des contraintes (budget de mots, liste de mots interdits, l'unique question), empreinte stylistique, et contrôle de la longueur.
Utilisez Claude Sonnet 5 en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "claude-sonnet-5",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "claude-sonnet-5",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("claude-sonnet-5")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));À propos de Claude Sonnet 5
- Anthropic le destine à la génération de code, à l'analyse de données, à la création de contenu, à la compréhension visuelle et à l'utilisation agentique d'outils, et le présente comme l'option pour le travail qui demande plus que Sonnet 4.6 sans passer à un modèle de classe Opus.
- Il embarque par défaut une fenêtre de contexte de 1M de tokens, 128K en sortie maximale, la réflexion adaptative activée par défaut avec contrôle du niveau d'effort, un nouveau tokenizer, l'entrée visuelle et l'ensemble complet des outils de Claude ; une tarification de lancement s'applique jusqu'au 31 août 2026.
- La fenêtre de 1M est à la fois la valeur par défaut et le maximum (il n'existe pas de variante à contexte plus réduit), et l'effort atteint xhigh, ce qu'aucun autre modèle non Opus ne propose, medium étant décrit comme à peu près comparable à Sonnet 4.6 à effort high.
- Trois changements de comportement comptent lors de la migration.
- Le nouveau tokenizer produit environ 30 % de tokens en plus pour le même texte, ce qui modifie les compteurs d'usage, les budgets de sortie et le coût par requête sans aucun changement d'API.
- Les paramètres d'échantillonnage non par défaut renvoient désormais une erreur, restriction auparavant réservée à Opus 4.7 et suivants.
- Et c'est le premier modèle du palier Sonnet doté de garde-fous de cybersécurité en temps réel, où une requête refusée revient sous la forme d'une réponse réussie portant une raison d'arrêt de refus plutôt que d'une erreur.
- Sur Synthorai, Claude Sonnet 5 répond sur la même API compatible OpenAI que tout autre modèle du catalogue.
FAQ
Peut-on essayer l'API Claude Sonnet 5 gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $2/M de tokens en entrée, ce crédit couvre à lui seul environ 62 requêtes de ~8K tokens sur Claude Sonnet 5.
Quels sont les points forts de Claude Sonnet 5 ?
Gains les plus importants sur le codage et les tâches agentiques ; fenêtre de contexte de 1M de tokens par défaut ; mise à niveau de capacités prête à l'emploi depuis Sonnet 4.6. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte Claude Sonnet 5 ?
Sur Synthorai, Claude Sonnet 5 coûte $2 par million de tokens en entrée et $10 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.2/M.
Claude Sonnet 5 prend-il en charge la mise en cache des prompts ?
Oui, sur activation : marquez les préfixes stables avec des points d'arrêt cache_control. Les tokens d'entrée en cache sont facturés $0.2/M contre $2/M hors cache ; les prompts doivent avoir un préfixe stable de 1,024 tokens pour être mis en cache (TTL 5 min par défaut, 1 heure en option). Guide de mise en cache des prompts →
Comment obtenir l'accès à Claude Sonnet 5 ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="claude-sonnet-5", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.
Quelle est la date de coupure des connaissances de Claude Sonnet 5 ?
La date de coupure des connaissances de Claude Sonnet 5 est 2026-01, selon la documentation officielle du fournisseur (au 2026-07-09).
Modèles associés
Comparer
Chaque valeur de cette page est transcrite de la documentation du fournisseur, liée ci-dessus, et porte la date de sa vérification. Les prix sont comparés à l'échelle du catalogue ; les valeurs de spécification que les fournisseurs définissent différemment sont présentées avec la différence indiquée plutôt que mises en graphique. Rien ici n'est mesuré par nous, et rien n'est noté.