Notre avis sur Claude Sonnet 5.5
Un modèle quotidien plus rapide, avec un contrat API qui mérite plus d’attention que son numéro de version.
Claude Sonnet 5.5 est la mise à niveau pratique de la famille Claude 5.5 d’Anthropic. Sorti le 28 septembre 2026, il conserve le tarif standard de Sonnet 5, mais Anthropic annonce une génération 30 % plus rapide et un coût par tâche jusqu’à 30 % inférieur grâce à une consommation de tokens plus faible. Ses résultats publiés en programmation et en travail de connaissance se rapprochent aussi d’Opus 5.5.
Cela ne fait pas de Sonnet 5.5 un remplacement universel d’Opus. Il convient surtout au développement quotidien, aux bugs reproductibles, aux documents, aux feuilles de calcul et aux boucles d’agent rapides. Le point délicat pour les développeurs est le contrat API : une intégration Sonnet 5 qui désactive thinking, force un outil, utilise l’ancien computer use ou lit seulement content[0] doit être vérifiée avant le changement d’ID.
Vérifié le 29 septembre 2026. Cet article s’appuie sur l’annonce d’Anthropic et la documentation Claude Platform actuelle. Les scores, la vitesse et les économies sont rapportés par Anthropic ; nous n’avons effectué ni benchmark indépendant payant ni mesure de latence. Les exemples de coût utilisent le tarif direct mondial et un volume de tokens constant.
Fiche technique
| Élément | Claude Sonnet 5.5 |
|---|---|
| Sortie | 28 septembre 2026 |
| ID Claude API | claude-sonnet-5-5 |
| Contexte | 1M tokens |
| Sortie maximale standard | 128K tokens |
| Entrée / sortie | $2 / $10 par million de tokens |
| Écriture / lecture du cache | $2.50 / $0.20 par million |
| Thinking | Adaptive par défaut |
| Effort par défaut | high |
| Latence relative | Fast |
| Connaissances fiables jusqu’à | Juin 2026 |
| Entrée et sortie | Texte et images → texte |
Le modèle est disponible dans Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS. L’identifiant peut varier selon la plateforme ; vérifiez sa table de disponibilité avant la production. Messages synchrone conserve 1M de contexte et 128K de sortie, tandis que Batch API peut atteindre 300K avec son en-tête bêta.
Les progrès face à Sonnet 5
Anthropic met en avant plus de 30 % de vitesse de génération et jusqu’à 30 % de coût en moins par tâche. Le prix de chaque token ne baisse pas : l’économie vient de sorties et d’étapes d’outils plus courtes.
L’annonce publie ces résultats face à Sonnet 5 :
| Évaluation | Sonnet 5.5 | Sonnet 5 | Mesure |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6 % | 10,3 % | Programmation terminal en plusieurs étapes |
| CursorBench 4.0 | 55,5 % | 34,1 % | Tâches ambiguës d’agent de code |
| GDPval-AA v2.1 | 1844 | 1449 | Travail de connaissance multi-métiers |
| AA-Briefcase v1.1 | 1811 | 1359 | Travail de connaissance long |
| Humanity’s Last Exam | 64,5 % | 54,9 % | Raisonnement multidisciplinaire avec outils |
| OSWorld 2.1 | 80,1 % partial | 57,0 % partial | Computer use |
| Chartography | 61,6 % | 15,6 % | Lecture visuelle de graphiques |
Ces résultats sont des signaux de test, pas le taux de réussite de votre dépôt. CursorBench est proche des 57,8 % d’Opus 5.5 et GDPval de son score 1846, tandis qu’Anthropic juge Opus toujours supérieur pour le travail ouvert qui demande un jugement continu. La conclusion raisonnable est que Sonnet 5.5 réduit l’écart sur les tâches répétables, sans supprimer le besoin d’un modèle d’escalade.
Les courbes de coût incluent effort, outils et tokens de toute la tâche. Gardez prompt, commit, permissions et test d’acceptation identiques pour comparer avec la fiche Opus 5.5 ou votre route Sonnet actuelle.
Les prix API restent ceux de Sonnet 5
Sonnet 5.5 conserve la grille tarifaire directe de Sonnet 5 :
| Facturation | Prix |
|---|---|
| Entrée sans cache | $2 / MTok |
| Sortie, tokens thinking facturés inclus | $10 / MTok |
| Écriture cache 5 minutes | $2.50 / MTok |
| Écriture cache 1 heure | $4 / MTok |
| Lecture cache | $0.20 / MTok |
| Batch API | 50 % de remise sur entrée et sortie |
Une tâche sans cache de 100K tokens d’entrée et 20K de sortie coûte 0.1 × $2 + 0.02 × $10 = $0.40. Si 80K tokens d’entrée sont lus depuis le cache, le même volume coûte 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, hors première écriture. Thinking, outils, reprises et nombre de tours changent la facture réelle.
« Jusqu’à 30 % moins cher par tâche » n’est donc pas une remise uniforme. Mesurez le coût total par modification acceptée, après tests ou revue. Le tarif OmniaKey est une autre route ; consultez le catalogue de modèles avant de prévoir votre budget.
Six vérifications avant de migrer
L’ID devient claude-sonnet-5-5, mais tous les paramètres de Sonnet 5 ne restent pas valides.
- Thinking est Adaptive par défaut. Omettez
thinkingou utilisez{"type":"adaptive"}. Pour supprimer la réflexion initiale, utilisezthinking: {"type":"between_tools"}.{"type":"disabled"}etbudget_tokensmanuel renvoient 400. - Les appels d’outils forcés sont refusés.
tool_choicede typeanyoutoolrenvoie 400. Utilisezautoounone, puis strict tools ou structured outputs pour le schéma. - Les thinking blocks dépendent du modèle et de la conversation. Sonnet 5.5 lit ceux de Sonnet 5, mais Opus 5 et Opus 5.5 ne lisent pas ceux produits par Sonnet 5.5. Un changement au milieu modifie donc le contexte utilisable.
- Ne modifiez pas l’historique puis ne rejouez pas le bloc sans contrôle. Modifier system, tools ou un ancien message peut renvoyer 400 avec les contrôles de binding récents. Ajoutez les instructions ou suivez le mécanisme documenté.
- Computer use dépend de la plateforme. Claude API et Google Cloud exigent
computer_toolset_20260801; Bedrock accepte encorecomputer_20251124. - Lisez les réponses par type de bloc. Le texte de progression entre deux outils peut arriver dans
thinking. Un client qui n’affiche quetextsemblera silencieux.
Une requête adaptive minimale :
{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [
{"role": "user", "content": "Vérifie cette migration et liste ses trois principaux risques."}
]
}
Revérifiez aussi temperature, top_p et top_k non par défaut : l’endpoint actuel les rejette. Gardez une marge dans max_tokens pour le raisonnement et la réponse visible.
Sa place dans un vrai flux de travail
Commencez avec Sonnet 5.5 pour une fonctionnalité cadrée, un bug reproduit, des tests autour d’une interface connue, une revue ciblée, un premier document ou des étapes d’agent à fort volume. Tests, typecheck, build et captures permettent de juger rapidement si le modèle moins cher suffit.
Augmentez l’effort ou passez à un modèle plus puissant lorsque la tâche traverse plusieurs services, exige une architecture difficilement réversible ou manque d’informations. Si Sonnet a reçu les bons fichiers et outils mais se trompe encore de cause, c’est une limite de capacité. Si le contexte est incomplet, améliorez d’abord le contexte.
Dans Claude Code, comparez des sessions neuves avec le même commit, prompt, permissions et test d’acceptation. Notez le premier résultat utile, le temps total, les tokens, les reprises, les outils échoués et les minutes de correction humaine. Une génération plus rapide peut être annulée par une revue supplémentaire.
Verdict
Claude Sonnet 5.5 est un excellent premier candidat pour le coding et le travail de connaissance quotidien. Le prix ne bouge pas, la vitesse et les scores publiés progressent, et les tâches bien définies ont une vraie raison de migrer depuis Sonnet 5.
Ne déployez cependant pas un simple remplacement de chaîne. Testez thinking, tool choice, le parseur de blocs et computer use. Gardez Opus 5.5 pour l’architecture ambiguë, le débogage difficile et les décisions à fort impact. Pour comparer les options, consultez aussi le comparatif Opus 5.5 et Sonnet 5.
Questions fréquentes
Quand Claude Sonnet 5.5 est-il sorti ?
Anthropic l’a lancé le 28 septembre 2026 sous l’ID direct claude-sonnet-5-5.
Est-il moins cher que Sonnet 5 ?
Le tarif par token est identique : $2 en entrée, $10 en sortie et $0.20 pour la lecture du cache par million. Anthropic annonce jusqu’à 30 % de moins par tâche grâce à une consommation inférieure.
Est-il meilleur qu’Opus 5.5 ?
Sonnet est plus rapide et moins cher pour les tâches cadrées ; Opus garde l’avantage sur le jugement complexe et ouvert. Mesurez résultats acceptés, coût total et corrections.
Peut-on désactiver thinking ?
Pas avec thinking: {"type":"disabled"}. Utilisez Adaptive ou thinking: {"type":"between_tools"} avec un niveau d’effort accepté.
Le contexte est-il de 1M ?
Oui, avec une sortie standard maximale de 128K. Il s’agit de limites de capacité, pas de crédits gratuits ou illimités.