Anthropic a sorti Claude Sonnet 5.5 le 28 septembre 2026, au même prix que Sonnet 5 (2 $ par million de tokens en entrée, 10 $ en sortie). Selon Anthropic, il répond plus de 30 % plus vite, une tâche coûte jusqu'à 30 % de moins parce qu'il consomme moins de tokens, et ses résultats sont très proches de ceux d'Opus 5.5, sorti six jours plus tôt à un prix deux fois plus élevé.
Pour la plupart des automatisations et des assistants internes d'une PME, Sonnet 5.5 est donc le modèle Claude par défaut raisonnable. Opus 5.5 garde l'avantage sur les agents longs et le raisonnement difficile, quand votre propre test montre un écart. Et si une automatisation tourne déjà sur Sonnet 5, la migration tient en un changement d'identifiant, mais le format des réponses et les appels d'outils doivent être vérifiés avant de basculer.
En résumé
- ✓ Même prix que Sonnet 5 (2 $ / 10 $ par million de tokens), soit la moitié du prix d'Opus 5.5.
- ✓ Plus de 30 % plus rapide et jusqu'à 30 % moins cher par tâche selon Anthropic. Le gain réel se mesure sur vos cas.
- ✓ Très proche d'Opus 5.5 sur la plupart des tests publiés, en retrait sur le code et le raisonnement les plus difficiles.
- ✓ Le modèle Claude par défaut raisonnable pour les automatisations et les assistants. Opus 5.5 quand votre évaluation montre un écart.
- ✓ Migration simple côté code, mais format de sortie, appels d'outils et longueur des réponses sont à retester.
Qu'est-ce qui change entre Sonnet 5 et Sonnet 5.5 ?
Sonnet 5.5 garde le prix de Sonnet 5 et progresse sur trois points qui comptent en production, la vitesse, la consommation de tokens par tâche et la qualité du travail de bureau. Sonnet 5, sorti fin juin 2026, avait rendu finançables beaucoup d'automatisations multi-étapes, comme nous l'expliquions dans notre article sur Sonnet 5 et l'automatisation en PME. Trois mois plus tard, la version 5.5 fait le même travail plus vite et avec moins de tokens, selon Anthropic.
Voici ce qu'annonce Anthropic sur la page officielle de Claude Sonnet 5.5.
- Vitesse. Les réponses sont générées plus de 30 % plus vite qu'avec Sonnet 5. C'est le Sonnet le plus rapide à ce jour.
- Coût par tâche. Jusqu'à 30 % de moins « sur la plupart des travaux », parce que le modèle écrit moins de tokens en sortie, fait moins d'appels d'outils et regroupe plus souvent ses appels.
- Travail de bureau. Anthropic le décrit comme le plus fort sur les tâches quotidiennes bien cadrées, la correction de bugs et la production de documents, de présentations et de tableurs soignés. Comme Opus 5.5, il écrit plus clairement que la génération précédente.
- Tâches longues et images. Il progresse sur le travail qui s'étale sur de nombreuses étapes et sur la compréhension d'images, graphiques ou captures d'écran.
- Cybersécurité. Ses capacités dans ce domaine ont nettement progressé, il est donc déployé avec des garde-fous proches de ceux d'Opus 5.5. Chercher et corriger des bugs reste possible, mais les tâches de sécurité jugées à risque basculent visiblement sur Sonnet 5.
- Disponibilité. API Claude (identifiant
claude-sonnet-5-5), AWS, Google Cloud, Microsoft Azure, applications Claude et Claude Code.
| Sonnet 5 | Sonnet 5.5 | |
|---|---|---|
| Sortie | Fin juin 2026 | 28 septembre 2026 |
| Prix entrée / sortie (par million de tokens) | 2 $ / 10 $ | 2 $ / 10 $ |
| Lecture de cache (par million de tokens) | 0,20 $ | 0,20 $ |
| Vitesse de génération | Référence | Plus de 30 % plus rapide |
| Coût par tâche | Référence | Jusqu'à 30 % de moins (annonce Anthropic) |
| GDPval-AA v2.1 (travail de connaissance) | 1 449 | 1 844 |
| Identifiant API | claude-sonnet-5 |
claude-sonnet-5-5 |
Une précision sur GDPval-AA. C'est un classement relatif, recalculé à chaque version du test. Ses scores se comparent entre modèles mesurés ensemble, pas avec les chiffres publiés en juin pour Sonnet 5 sur la version précédente.
Combien coûte une tâche avec Sonnet 5.5 ?
Le prix au token de Sonnet 5.5 est identique à celui de Sonnet 5. Ce qui baisse, c'est le nombre de tokens qu'une tâche consomme, et c'est ce nombre qui fait la facture.
Un agent qui traite une demande en six appels d'outils renvoie le contexte au modèle à chaque tour, il paie donc plusieurs fois la lecture des mêmes informations. S'il termine en quatre appels, ou s'il en lance deux en même temps, il relit moins. Côté sortie, chaque token écrit coûte cinq fois plus cher qu'un token lu (10 $ contre 2 $ par million), une réponse plus courte pèse donc directement sur la facture.
Le « jusqu'à 30 % » est un chiffre d'éditeur. Il décrit les cas favorables, pas forcément le vôtre. Parmi les retours clients publiés par Anthropic, Atlassian annonce des agents jusqu'à 30 % plus rapides. Une classification d'emails qui répond en un mot n'a presque rien à gagner côté sortie. Un agent qui enchaîne recherches, lectures et saisies a beaucoup plus à gagner.
Un exemple chiffré sur une automatisation type
Prenons une automatisation qui traite des demandes fournisseurs. Elle lit l'email et sa pièce jointe, cherche la commande dans l'ERP et prépare une réponse. On suppose, sans cache, 20 000 tokens lus et 2 000 tokens écrits par demande, et 500 demandes par jour ouvré, soit environ 10 500 par mois. Ce sont des hypothèses d'illustration, pas une mesure.
| Modèle et hypothèse | Coût par demande | Coût mensuel (10 500 demandes) |
|---|---|---|
| Sonnet 5 | 0,060 $ | 630 $ |
| Sonnet 5.5, 10 % de tokens en moins | 0,054 $ | 567 $ |
| Sonnet 5.5, 30 % de tokens en moins | 0,042 $ | 441 $ |
| Opus 5.5, même consommation que Sonnet 5 | 0,120 $ | 1 260 $ |
À ce volume, l'écart entre Sonnet 5 et Sonnet 5.5 se compte en dizaines ou en centaines de dollars par mois. L'écart avec Opus 5.5 est plus net, du simple au double. Le cache réduit encore ces montants quand une grande partie du contexte (instructions, documents de référence) se répète d'une demande à l'autre, puisque la lecture de cache coûte 0,20 $ par million au lieu de 2 $. Et la facture de modèle reste souvent petite face au coût de l'intégration et de la supervision, comme le montre notre guide sur le coût d'un projet IA en PME.
Sonnet 5.5 ou Opus 5.5, lequel prendre ?
Sonnet 5.5 coûte exactement la moitié d'Opus 5.5 (2 $ / 10 $ contre 4 $ / 20 $) et s'en approche sur la plupart des tests publiés par Anthropic. Pour la majorité des automatisations et des assistants, c'est le point de départ raisonnable. Opus 5.5 se justifie là où votre propre évaluation montre un écart qui compte.
Opus 5.5 est sorti le 22 septembre 2026 avec une baisse de prix de 20 % par rapport à Opus 5, et notre article sur Claude Opus 5.5 détaille ce qu'il apporte. Six jours plus tard, Sonnet 5.5 arrive presque au même niveau pour moitié prix. Voici les chiffres publiés par Anthropic pour les trois modèles.
| Test | Ce qu'il mesure | Sonnet 5 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | Travail de connaissance professionnel (score relatif) | 1 449 | 1 844 | 1 846 |
| OSWorld 2.1 | Utiliser un ordinateur, logiciels et navigateur | 57,0 % | 80,1 % | 81,8 % |
| Terminal-Bench 4.0 | Code et tâches techniques en terminal | 10,3 % | 70,6 % | 66,4 % |
| Humanity's Last Exam (avec outils) | Raisonnement sur des questions très difficiles | 54,9 % | 64,5 % | 67,7 % |
| FrontierCode 1.1 | Code très difficile | 42,4 % | 46,2 % (effort maximal) | 54,4 % |
| Chartography (sans outils) | Lecture de graphiques | 15,6 % | 61,6 % | 64,4 % |
Sur le travail de connaissance et l'usage d'un ordinateur, les deux modèles sont à égalité ou presque, et Sonnet 5.5 passe même devant sur le test en terminal. Opus 5.5 garde une avance nette sur le code le plus difficile (54,4 % contre 46,2 %, score que Sonnet obtient à son effort maximal) et sur le raisonnement très difficile. Ces tests d'éditeur indiquent où chercher l'écart, pas lequel des deux fera mieux sur vos devis ou vos contrats. Ça, seule une évaluation sur vos propres cas peut le trancher.
Là où Sonnet 5.5 suffit
- Le tri et la réponse aux emails entrants, avec les informations reportées dans le CRM ou l'ERP (automatisation des emails).
- L'extraction de données depuis des factures, des bons de commande ou des contrats (extraction de documents).
- Un assistant interne qui répond sur votre base documentaire.
- La rédaction cadrée (réponses types, comptes rendus, notes internes) et la production de documents ou de tableurs.
- Les agents à périmètre étroit, avec quelques outils et une validation humaine avant toute action qui engage l'entreprise.
Là où Opus 5.5 garde l'avantage
Opus 5.5 se justifie quand la difficulté est réelle et qu'une erreur coûte cher. C'est le cas d'un agent qui enchaîne des dizaines d'étapes sur un dossier complexe, d'une analyse juridique ou technique fine, ou de code difficile sur une base ancienne, le terrain de nos agents IA sur mesure les plus exigeants. Au-dessus, Claude Fable 5.1 (10 $ / 50 $) reste réservé aux problèmes où la capacité brute prime sur le coût.
Les deux modèles ne s'excluent pas. Une architecture courante confie le flux courant à Sonnet 5.5 et route vers Opus 5.5 les cas repérés comme difficiles (type de demande, document atypique, contrôle de cohérence en échec). Un détail de prix facilite ce montage. La lecture de cache coûte 0,20 $ par million de tokens sur les deux modèles, donc pour un assistant dont les instructions et les documents de référence sont en cache, l'écart côté entrée se resserre. Il reste entier sur les tokens hors cache et sur la sortie.
Point terrain Tensoria
« Quand on choisit un modèle pour un client, on part du moins cher qui a une chance de passer, on le mesure sur ses vrais cas, et on monte en gamme seulement si les erreurs le justifient. Avec Sonnet 5.5, ce point de départ se situe à un niveau qu'on réservait encore à Opus cet été. » Anas Rabhi, fondateur de Tensoria
Vous avez un processus à confier à Sonnet 5.5 ?
On part d'un processus réel (emails entrants, devis, saisie dans le CRM ou l'ERP), on le teste sur vos documents et on met en production ce qui passe la mesure, avec une validation humaine là où elle compte.
Et face à GPT-6 Sol, vendu au même prix ?
GPT-6 Sol, sorti le 22 septembre 2026, est facturé comme Sonnet 5.5, 2 $ en entrée et 10 $ en sortie par million de tokens. À prix égal, le choix se fait sur votre tâche et sur votre environnement technique, pas sur les annonces des deux éditeurs.
Chacun publie des chiffres qui le placent devant. OpenAI annonce pour Sol environ deux fois moins d'erreurs que son prédécesseur et une fiabilité proche de GPT-6 Astra, et affirme que Sol et Luna dépassent Fable et Opus, comme le rapporte TechCrunch. Dans le tableau d'Anthropic, Sonnet 5.5 devance GPT-6 Sol sur le travail de connaissance (1 844 contre 1 487 sur GDPval-AA) et sur la lecture de graphiques (61,6 % contre 53,6 %), tandis que Sol devance Sonnet 5.5 sur le code très difficile (49,3 % contre 46,2 % sur FrontierCode). Aucun de ces tests n'a été passé sur vos documents.
Un même prix au token ne donne pas le même coût par tâche. Chaque éditeur découpe le texte en tokens à sa façon, un même document ne pèse donc pas le même nombre de tokens chez l'un et chez l'autre. La longueur des réponses et le nombre d'appels d'outils varient aussi d'un modèle à l'autre. Pour votre budget, le chiffre utile est le coût par tâche réussie, mesuré sur un échantillon de vos cas.
Restent les critères pratiques. Sonnet 5.5 est disponible chez AWS, Google Cloud et Microsoft Azure, ce qui simplifie les choses si vos données y sont déjà. Pour l'usage quotidien, la question porte plutôt sur l'outil que votre équipe utilise déjà. Notre comparatif Sonnet 5.5, Opus 5.5, GPT-6 Sol et Gemini 3.8 met les modèles côte à côte, et notre article sur GPT-6 Sol et Luna détaille l'offre d'OpenAI.
Pour le très gros volume sur des tâches simples, aucun des deux n'est forcément le bon choix. GPT-6 Luna (0,10 $ / 0,50 $) et Gemini 3.8 Flash coûtent bien moins cher, comme le montre notre calcul pour automatiser à gros volume. Côté Anthropic, Claude Haiku 5.5 est annoncé pour les prochaines semaines.
Qu'est-ce que ça change pour une équipe qui travaille avec Claude ?
Pour une équipe qui utilise Claude au quotidien, Sonnet 5.5 se remarque surtout sur les livrables, avec des documents, présentations et tableurs plus soignés et des réponses plus claires et plus rapides. La règle de base ne bouge pas pour autant. Une demande floue donne un résultat moyen, quel que soit le modèle.
Les usages qui en profitent le plus sont ceux où Claude produit un fichier, comme une note de synthèse tirée de plusieurs documents, une présentation client à partir d'un compte rendu ou un tableau de suivi mis en forme. La meilleure lecture des images aide aussi sur un graphique ou une capture d'écran de logiciel.
Un tableur plus propre n'est pas un tableur juste. Si le fichier source est mal structuré, l'analyse sera fausse, aussi soignée soit-elle, comme nous le détaillons dans notre article sur ce que Claude pour Excel fait et ne fait pas. Les chiffres d'un document produit par Claude se vérifient avant diffusion, avec les réflexes décrits dans comment vérifier une réponse de Claude.
Pour les équipes de développement sur Claude Code, Sonnet 5.5 est plus rapide sur la correction de bugs. Une équipe qui fait de l'audit de sécurité peut en revanche voir certaines demandes basculer sur Sonnet 5, conséquence des garde-fous cyber décrits plus haut.
Deux équipes qui ont le même abonnement et le même modèle obtiennent des résultats très différents selon leur pratique. Savoir donner le contexte, le format attendu et les bons fichiers pèse plus que le passage de Sonnet 5 à 5.5. C'est ce que nous travaillons dans notre formation Claude en entreprise, sur les fichiers et les cas réels de l'équipe.
Comment passer une automatisation de Sonnet 5 à Sonnet 5.5 sans rien casser ?
Techniquement, migrer revient à remplacer l'identifiant claude-sonnet-5 par claude-sonnet-5-5. Ce qui peut casser, ce n'est pas l'appel au modèle, c'est tout ce qui dépend de la forme de sa réponse.
Les progrès annoncés sont des changements de comportement (moins de tokens écrits, moins d'appels d'outils, des appels regroupés, une écriture plus claire). Pour un humain qui lit, c'est un progrès. Pour un programme qui attend une réponse d'une forme précise, c'est un changement à vérifier.
Un réglage à changer avant de basculer
Si votre automatisation appelle Sonnet avec la réflexion désactivée, Anthropic demande de passer au nouveau réglage between_tools, qui maintient la réflexion préalable désactivée, avant de passer à Sonnet 5.5. C'est la consigne de migration explicite de l'annonce, à vérifier en premier.
Ce qu'il faut tester sur vos vrais cas
| Point à tester | Ce qui peut changer | Comment le vérifier |
|---|---|---|
| Format de sortie | Champ manquant ou renommé dans un JSON, phrases reformulées, structure de texte différente | Valider chaque sortie contre le schéma attendu par vos outils en aval (CRM, ERP, tableur), sur tout le jeu de test |
| Appels d'outils | Moins d'appels, appels lancés ensemble, étape de contrôle sautée | Journaliser la séquence d'appels et vérifier que chaque action prévue a lieu, dans un ordre compatible avec vos systèmes |
| Longueur des réponses | Résumés plus courts, détails omis, réponses client plus sèches | Comparer les longueurs et faire relire un échantillon par la personne métier qui utilise le résultat |
| Coût et latence réels | Gain inférieur ou supérieur aux 30 % annoncés | Mesurer tokens et temps par tâche sur le même échantillon, avec l'ancien et le nouveau modèle |
| Tâches de sécurité | Bascule vers Sonnet 5 sur les demandes jugées à risque | Si l'automatisation analyse des journaux ou des vulnérabilités, tester ces demandes en particulier |
Le regroupement des appels d'outils mérite une attention particulière. Si votre orchestration suppose qu'un seul outil est appelé à la fois, ou qu'une écriture dans l'ERP suit toujours une lecture de contrôle, deux appels lancés ensemble peuvent produire un résultat inattendu. Même logique pour le format. Si la sortie est contrainte par une sortie structurée en JSON, le risque de casse est faible. Si votre code découpe un texte libre, il est élevé.
Une bascule progressive et réversible
La méthode est la même à chaque sortie de modèle. On rejoue un jeu de cas réels, quelques dizaines à quelques centaines selon le volume, sur l'ancien et le nouveau modèle, à prompt et données identiques. On fait ensuite tourner Sonnet 5.5 en parallèle de la production sans qu'il agisse, puis on lui confie une part croissante du flux. L'identifiant du modèle reste un paramètre de configuration, pour revenir en arrière en une ligne si un problème apparaît. Notre guide de déploiement d'un LLM en production détaille cette architecture.
Si le gain mesuré est faible et que tout fonctionne, rester sur Sonnet 5 quelque temps est un choix défendable. Surveillez simplement le calendrier de retrait des anciens modèles publié par Anthropic, pour ne pas migrer dans l'urgence. Et un meilleur modèle ne corrige ni des données mal rangées, ni un processus mal cadré, ni l'absence de validation humaine sur les actions qui engagent l'entreprise.
Votre automatisation tourne déjà sur Sonnet 5 ou un autre modèle ?
On fait passer Sonnet 5.5 sur vos vrais cas, à prompt identique, et vous voyez l'écart de qualité, de coût par tâche et de latence avant de toucher à la production.
Pour aller plus loin
- La nouvelle génération côte à côte, dans notre comparatif Sonnet 5.5, Opus 5.5, GPT-6 Sol et Gemini 3.8.
- Le modèle du dessus, avec ce que Claude Opus 5.5 change pour une entreprise.
- Le point de départ de cette série, avec Claude Sonnet 5 et l'automatisation en PME.
- Le choix d'un modèle selon la tâche, dans notre guide pour choisir un modèle d'IA pour automatiser.
- Un cadre commun pour l'usage de Claude dans l'équipe, avec notre charte d'usage de Claude en entreprise.