Anthropic a publié Claude Opus 5.5 le 22 septembre 2026, deux mois après Opus 5. Il coûte 4 $ par million de tokens en entrée et 20 $ en sortie, soit 20 % de moins qu'Opus 5, et la relecture du cache passe de 0,50 $ à 0,20 $. Anthropic le place au niveau de Claude Fable 5.1 sur la plupart des tâches, pour environ 40 % de moins qu'Opus 5 sur des charges de travail typiques.
Pour une entreprise, la lecture est assez directe. Si un agent ou un assistant tourne aujourd'hui sur Opus 5, l'économie est presque mécanique, à condition de la vérifier sur vos propres cas. Si vous avez choisi Fable 5.1 (10 $ / 50 $) pour sa qualité, la question est de savoir si Opus 5.5 fait le même travail pour deux fois et demie moins cher. Et le même jour, OpenAI a sorti GPT-6 Sol à 2 $ / 10 $, ce qui oblige à regarder aussi de l'autre côté.
En résumé
- ✓ Claude Opus 5.5 est sorti le 22 septembre 2026 à 4 $ / 20 $ par million de tokens, 20 % sous Opus 5.
- ✓ La lecture du cache tombe à 0,20 $ contre 0,50 $, ce qui allège surtout les assistants et les agents qui relisent le même contexte.
- ✓ Anthropic annonce le niveau de Fable 5.1 sur la plupart des tâches et environ 40 % de coût en moins qu'Opus 5 à l'usage.
- ✓ Opus reste justifié pour les agents longs, l'analyse fine et le code complexe. Pour les tâches cadrées, Sonnet 5 à 2 $ / 10 $ suffit souvent.
- ✓ Changer l'identifiant n'est pas neutre (raisonnement toujours actif, appels d'outils forcés refusés). On teste avant de migrer.
Qu'est-ce qui change avec Claude Opus 5.5 ?
Claude Opus 5.5 succède à Claude Opus 5 sous l'identifiant API claude-opus-5-5. Il garde la même fenêtre de contexte d'un million de tokens, la même sortie maximale de 128 000 tokens et le même découpage en tokens, donc un texte donné compte le même nombre de tokens sur les deux modèles. Ce qui change, c'est le prix, la quantité de raisonnement produite par défaut et quelques règles d'API.
| Tarif API, par million de tokens | Opus 5 | Opus 5.5 | Fable 5.1 |
|---|---|---|---|
| Entrée | 5 $ | 4 $ | 10 $ |
| Sortie (raisonnement compris) | 25 $ | 20 $ | 50 $ |
| Écriture du cache (5 minutes) | 6,25 $ | 5 $ | 12,50 $ |
| Lecture du cache | 0,50 $ | 0,20 $ | 0,25 $ |
| Traitement par lots (entrée / sortie) | 2,50 $ / 12,50 $ | 2 $ / 10 $ | 5 $ / 25 $ |
| Contexte | 1 million | 1 million | 1 million |
Le modèle est disponible sur l'API Claude, AWS, Google Cloud et Microsoft Azure, ainsi que dans Claude.ai (offres Pro, Max, Team et Enterprise) et Claude Code, selon la présentation officielle d'Anthropic.
Ce qu'Anthropic revendique
Les chiffres publiés le jour du lancement, repris notamment par Unite.AI et BetaNews, vont tous dans le même sens.
- Un niveau comparable à Fable 5.1 sur la plupart des tâches, et supérieur sur le code agentique, le travail d'analyse, l'usage d'un ordinateur et la lecture de graphiques.
- Une génération de texte plus de 30 % plus rapide qu'Opus 5.
- 66,4 % sur Terminal-Bench 4.0, contre 57,9 % pour GPT-6 Astra dans le tableau publié par Anthropic.
- Chez Deloitte, 72 % des bugs connus retrouvés en revue de code au réglage d'effort le plus bas, contre 56 % pour Opus 5 au réglage élevé.
- Moins de chiffres ou de sources affirmés sans appui dans les documents fournis, d'après la documentation d'Anthropic.
À lire avec prudence
Ce sont des résultats d'éditeur, sur des tâches choisies par l'éditeur. Ils disent dans quelle direction le modèle a progressé, pas ce qu'il donnera sur vos contrats ou votre base documentaire. Le dernier point est celui qui intéresse le plus un assistant métier, à vérifier sur vos propres documents.
Pour une équipe qui utilise Claude.ai au quotidien, Opus 5.5 apparaît simplement dans le sélecteur de modèle. Le gain le plus visible viendra moins de ce changement de menu que de la façon de travailler avec l'outil (contexte, fichiers, format de sortie attendu), ce que nous travaillons dans la formation Claude en entreprise.
D'où viennent les 40 % d'économie par rapport à Opus 5 ?
Les 40 % annoncés par Anthropic ne viennent pas seulement du tarif. Ils combinent deux effets, un prix par token plus bas de 20 % et moins de tokens consommés pour finir la même tâche.
Le second effet tient au raisonnement. Opus 5.5 réfléchit avant de répondre, et ces tokens de réflexion sont facturés comme de la sortie, au tarif le plus cher. Anthropic a abaissé l'effort par défaut à medium (contre high sur Opus 5) et indique qu'Opus 5.5 en medium fait au moins aussi bien qu'Opus 5 en high sur le code et l'analyse, avec moins de tokens.
Un réglage peut toutefois annuler une partie du gain. À réglage égal, Opus 5.5 a tendance à raisonner davantage par tour qu'Opus 5, surtout en xhigh et max. Si votre intégration impose un effort élevé hérité d'Opus 5, vous payez le token moins cher mais vous en consommez plus, et l'économie fond. Repartez de medium et testez les niveaux voisins.
Vous payez Opus 5 aujourd'hui
Même prompt, même contexte, un tarif plus bas sur chaque ligne de la facture. La baisse est quasi mécanique, mais le « quasi » compte. Une trentaine de cas réels suffisent à vérifier que la qualité tient, que le coût par tâche réussie baisse vraiment avec votre réglage d'effort, et que rien ne casse dans l'intégration. Notre guide pour évaluer un LLM en entreprise avec les bonnes métriques détaille comment construire ce jeu de cas.
Pourquoi la baisse du cache compte pour un assistant documentaire
La lecture du cache passe de 0,50 $ à 0,20 $ par million de tokens, soit 60 % de moins. Pour un assistant qui relit à chaque question le même socle de contexte, c'est souvent la ligne qui bouge le plus sur la facture.
À chaque question, un assistant interne envoie au modèle un début de requête qui ne change pas (consignes, règles métier, description des outils, parfois un catalogue ou des conditions générales), puis la partie variable, les extraits retrouvés et la question. Le cache garde ce début de requête en mémoire quelques minutes. Tant qu'il est chaud, sa relecture est facturée 0,20 $ le million de tokens au lieu de 4 $, vingt fois moins que l'entrée normale.
Pour un agent, l'effet est encore plus fort. À chaque étape, il renvoie tout l'historique de la tâche, et sur cinquante étapes le même contexte est relu cinquante fois, au tarif du cache.
Un exemple chiffré
Prenons un assistant interne qui répond sur vos procédures. À chaque question, il relit un socle de 50 000 tokens en cache, reçoit 1 000 tokens de question et d'extraits, et produit 700 tokens de réponse. Ce sont des hypothèses d'illustration, calculées aux tarifs publics et sans compter les tokens de raisonnement.
| Modèle | Dont relecture du cache | Coût par question | Pour 10 000 questions |
|---|---|---|---|
| Opus 5 | 0,025 $ | 0,0475 $ | 475 $ |
| Opus 5.5 | 0,010 $ | 0,028 $ | 280 $ |
| Fable 5.1 | 0,0125 $ | 0,0575 $ | 575 $ |
Sur cet exemple, Opus 5.5 coûte 41 % de moins qu'Opus 5 et un peu moins de la moitié de Fable 5.1. Plus des trois quarts de l'écart avec Opus 5 viennent du cache, pas du prix d'entrée ou de sortie. Ce calcul a deux limites. Le cache expire après quelques minutes sans requête (cinq minutes par défaut), donc un assistant peu sollicité repaie plus souvent l'écriture. Et les tokens de raisonnement, absents ici, peuvent peser lourd sur des questions difficiles.
La conception compte autant que le tarif. Un cache ne sert que si le début de la requête reste strictement identique. Une date du jour ou un identifiant de session en tête de prompt suffit à l'invalider. Nous le vérifions systématiquement sur un assistant IA interne, parce que ce réglage fait souvent plus pour la facture qu'un changement de modèle.
Vous avez choisi Fable 5.1, Opus 5.5 suffit-il ?
Pour une partie des usages, probablement. Anthropic place Opus 5.5 au niveau de Claude Fable 5.1 sur la plupart des tâches, pour un tarif deux fois et demie plus bas (4 $ / 20 $ contre 10 $ / 50 $). Mais « la plupart » n'est pas « toutes », et la seule façon de savoir dans quelle catégorie tombe votre cas est de le mesurer.
Anthropic cite un test interne sur une tâche de code de longue durée, terminée en 9 h 30 par Opus 5.5 contre 12 heures pour Fable 5.1, pour un coût inférieur de 51 %. C'est un seul exemple, choisi par l'éditeur, qui donne une direction et pas une garantie. La réponse dépend surtout de la raison pour laquelle vous avez retenu Fable 5.1.
- Vous l'avez pris par précaution, sans mesure montrant qu'Opus 5 ne suffisait pas. Opus 5.5 est alors le premier candidat à tester, et c'est là que l'économie potentielle est la plus forte.
- Vous avez mesuré qu'Opus 5 atteignait sa limite sur vos cas les plus durs. Rejouez exactement ces cas sur Opus 5.5. C'est sur eux que le positionnement « niveau Fable » se vérifie ou non.
- Vous traitez un mélange de tâches simples et difficiles. Le schéma le plus économique est souvent un routage, Opus 5.5 par défaut et Fable 5.1 réservé aux dossiers où vos évaluations montrent un écart.
La vitesse compte aussi. Les premiers tests indépendants de Fable 5.1 le montraient lent sur les tâches difficiles. Pour un assistant où quelqu'un attend la réponse, la latence peut peser autant que le prix.
Opus 5.5 ou Sonnet 5, quand Opus reste-t-il justifié ?
Même après la baisse, Opus 5.5 coûte deux fois le prix de Claude Sonnet 5 (2 $ / 10 $). Le bon modèle reste le moins cher qui atteint la qualité attendue sur votre tâche, et pour beaucoup de tâches métier ce n'est pas Opus.
| Type de tâche | Point de départ | Pourquoi |
|---|---|---|
| Agent qui enchaîne des dizaines d'étapes et d'appels d'outils | Opus 5.5 | Une erreur tôt dans la chaîne fait dérailler toute la suite, la régularité vaut le surcoût |
| Analyse croisée de documents longs (contrats, dossiers techniques, appels d'offres) | Opus 5.5 | Il faut tenir le fil sur beaucoup de pages et relever les incohérences |
| Code complexe sur plusieurs fichiers, revue de code | Opus 5.5 | C'est là que les gains annoncés par Anthropic sont les plus nets |
| Lecture de graphiques, schémas, tableaux denses | Opus 5.5, à tester | Anthropic annonce un net progrès en lecture visuelle |
| Classification d'emails, routage de tickets | Sonnet 5 ou plus petit | Format fixe, peu d'interprétation |
| Extraction de champs (factures, bons de commande) | Sonnet 5 ou plus petit | Tâche cadrée, volume élevé |
| Assistant documentaire aux questions simples, rédaction cadrée | Sonnet 5 | La qualité tient, le coût est divisé par deux |
Pour le volume pur, GPT-6 Luna (sorti le même jour à 0,10 $ / 0,50 $) ou Gemini 3.8 Flash traitent la classification et l'extraction pour une fraction du prix d'Opus. Et quand un agent déraille, le modèle est rarement seul en cause, comme le montre notre article sur les agents IA qui bouclent ou dérapent.
Point terrain Tensoria
Sur un agent en production, la facture dépend du nombre d'étapes, de la longueur du raisonnement et des relances, bien plus que du prix affiché. Un modèle plus cher au token qui finit en deux fois moins d'étapes peut revenir moins cher. On compare donc des coûts par tâche réussie, jamais des prix au million de tokens.
Vous préparez un agent et hésitez entre Opus et Sonnet ?
On part de la tâche à automatiser, on sépare ce qui demande Opus de ce qu'un modèle moins cher traite aussi bien, puis on construit l'agent dans vos outils, avec une validation humaine là où elle compte.
Opus 5.5 ou GPT-6 Sol, que dit une comparaison honnête ?
Le même jour, OpenAI a sorti GPT-6 Sol et GPT-6 Luna. Sol est facturé 2 $ / 10 $, deux fois moins cher qu'Opus 5.5 au token. OpenAI annonce environ deux fois moins d'erreurs que son prédécesseur et une fiabilité proche de GPT-6 Astra, et affirme que Sol dépasse Fable et Opus, selon TechCrunch. De son côté, Anthropic publie des scores où Opus 5.5 devance GPT-6 Astra. Ce sont deux affirmations d'éditeurs, et aucune évaluation indépendante ne permettait de trancher le jour de la sortie.
| Critère | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|
| Prix (entrée / sortie, par M tokens) | 4 $ / 20 $ | 2 $ / 10 $ |
| Place dans la gamme | Sous Fable 5.1, au-dessus de Sonnet | Sous Astra, au-dessus de Luna |
| Positionnement de l'éditeur | Niveau Fable 5.1 sur la plupart des tâches | Fiabilité proche d'Astra pour bien moins cher |
| Terrain mis en avant | Agents longs, code, analyse, lecture visuelle | Tâches exigeantes du quotidien, dont le code |
Trois éléments aident à lire cet écart de prix sans se tromper.
- Par rang, Sol fait face à Opus 5.5. Par prix, il fait face à Sonnet 5, vendu au même tarif. Si Sol vous intéresse pour son prix, le comparatif juste inclut aussi Sonnet 5.
- Le coût par tâche compte plus que le prix du token. Un modèle qui raisonne plus longtemps ou relance plus souvent peut effacer un écart de prix de un à deux.
- Changer d'éditeur coûte plus cher que changer de modèle. Prompts à réajuster, format des appels d'outils différent, contrat de traitement des données et région d'hébergement à revérifier. Si votre système tourne bien sur Claude, Opus 5.5 est le test le moins coûteux. Si vous partez de zéro ou êtes déjà chez OpenAI, Sol mérite sa place dans le comparatif.
Une architecture où le modèle est un paramètre, et non un choix gravé dans le code, rend cette comparaison peu coûteuse à refaire à chaque sortie, et garde un second fournisseur prêt en cas de besoin.
Faut-il migrer vers Opus 5.5, et qu'est-ce qui peut casser ?
Oui en candidat, non par réflexe. Le prix plaide pour Opus 5.5 dès qu'Opus 5 tourne en production, mais changer l'identifiant n'est pas neutre. La documentation de migration d'Anthropic liste quatre changements qui peuvent casser une intégration.
- Le raisonnement ne se désactive plus. Couper la réflexion, possible sur Opus 5, renvoie une erreur. Le seul levier est le réglage d'effort, à fixer explicitement, avec assez de marge dans la longueur maximale de réponse.
- Les appels d'outils forcés sont refusés. Beaucoup de chaînes d'extraction forcent l'appel d'un outil pour obtenir un JSON propre. Il faut passer au mode automatique avec un schéma strict, ou aux sorties structurées, comme sur Fable 5.1.
- L'historique doit rester en ajout seul. Les blocs de raisonnement sont liés à la conversation. Un code qui réécrit l'historique entre deux appels peut les invalider, avec une erreur pour les comptes créés depuis le 31 août 2026.
- L'usage d'un ordinateur passe par le nouvel ensemble d'outils (
computer_toolset_20260801), l'ancien outil est refusé.
S'y ajoute un filtre de sécurité élargi à la biologie, qui peut refuser des demandes de recherche à double usage. Peu de PME sont concernées, mais un laboratoire doit prévoir la gestion des refus et un modèle de repli. La méthode de test, elle, ne change pas.
- Sélectionner 20 à 50 cas réels issus de la production, dont les plus difficiles.
- Les rejouer sur Opus 5 et Opus 5.5 à prompt et données identiques, avec deux ou trois niveaux d'effort, et sur Sonnet 5 si la tâche est cadrée.
- Comparer la qualité, le coût par tâche réussie et la latence, puis migrer route par route en gardant l'ancien modèle comme repli le temps de valider.
Pour un assistant documentaire, les métriques d'évaluation d'un RAG en production s'appliquent directement à ce test. C'est aussi le cœur d'un audit de RAG ou d'agent IA en production, une base de référence sur vos vraies questions, puis des changements mesurés un par un, le modèle compris.
Vous payez Opus 5 ou Fable 5.1 pour un agent ou un assistant en production ?
On rejoue vos vrais cas sur Opus 5.5, et sur Sonnet quand c'est pertinent, à prompt identique. Vous voyez la qualité, le coût par tâche et la latence avant de toucher à la production.
Questions fréquentes sur Claude Opus 5.5
Pour aller plus loin
- Claude Opus 5 pour une PME, le lancement de juillet et le changement de prix du niveau frontière.
- Fable 5.1 face à Opus 5, GPT-5.6 Sol et Gemini 3.1 Pro, le comparatif de début septembre.
- Quel modèle d'IA choisir pour automatiser, la méthode de choix par tâche.
- Le coût d'un projet RAG en entreprise, pour replacer la facture du modèle dans le budget total.
Sources
- Anthropic, présentation de Claude Opus 5.5 (22 septembre 2026)
- Claude Platform, tarifs officiels des modèles
- Unite.AI, prix, benchmarks et garde-fous d'Opus 5.5
- BetaNews, lancement et baisse de prix d'Opus 5.5
- TechCrunch, lancement de GPT-6 Sol et GPT-6 Luna
Ce qui a bougé depuis le 22 septembre
Le 28 septembre 2026, Anthropic a sorti Claude Sonnet 5.5, au même tarif que Sonnet 5 (2 $ / 10 $, lecture du cache à 0,20 $). Anthropic le présente comme très proche d'Opus 5.5 en performance pour moitié prix, et plus de 30 % plus rapide que Sonnet 5.
Sur les tâches où l'on hésitait entre Opus 5.5 et Sonnet, Sonnet 5.5 est désormais le premier candidat à tester, et Opus 5.5 se concentre encore davantage sur les agents les plus longs et les analyses les plus fines. Le détail est dans notre article sur Claude Sonnet 5.5 en entreprise et dans le comparatif Sonnet 5.5, Opus 5.5, GPT-6 Sol et Gemini 3.8. Pour les traitements à gros volume, notre calcul de coût avec GPT-6 Luna et Gemini 3.8 Flash complète le tableau. Anthropic annonce aussi Claude Haiku 5.5 dans les prochaines semaines.