Outils & Modèles Par
Dernière mise à jour :

Claude Opus 5.5 : ce qui change pour votre PME

Anthropic a publié Claude Opus 5.5 le 22 septembre 2026, deux mois après Opus 5. Il coûte 4 $ par million de tokens en entrée et 20 $ en sortie, soit 20 % de moins qu'Opus 5, et la relecture du cache passe de 0,50 $ à 0,20 $. Anthropic le place au niveau de Claude Fable 5.1 sur la plupart des tâches, pour environ 40 % de moins qu'Opus 5 sur des charges de travail typiques.

Pour une entreprise, la lecture est assez directe. Si un agent ou un assistant tourne aujourd'hui sur Opus 5, l'économie est presque mécanique, à condition de la vérifier sur vos propres cas. Si vous avez choisi Fable 5.1 (10 $ / 50 $) pour sa qualité, la question est de savoir si Opus 5.5 fait le même travail pour deux fois et demie moins cher. Et le même jour, OpenAI a sorti GPT-6 Sol à 2 $ / 10 $, ce qui oblige à regarder aussi de l'autre côté.

En résumé

  • ✓ Claude Opus 5.5 est sorti le 22 septembre 2026 à 4 $ / 20 $ par million de tokens, 20 % sous Opus 5.
  • ✓ La lecture du cache tombe à 0,20 $ contre 0,50 $, ce qui allège surtout les assistants et les agents qui relisent le même contexte.
  • ✓ Anthropic annonce le niveau de Fable 5.1 sur la plupart des tâches et environ 40 % de coût en moins qu'Opus 5 à l'usage.
  • ✓ Opus reste justifié pour les agents longs, l'analyse fine et le code complexe. Pour les tâches cadrées, Sonnet 5 à 2 $ / 10 $ suffit souvent.
  • ✓ Changer l'identifiant n'est pas neutre (raisonnement toujours actif, appels d'outils forcés refusés). On teste avant de migrer.

Qu'est-ce qui change avec Claude Opus 5.5 ?

Claude Opus 5.5 succède à Claude Opus 5 sous l'identifiant API claude-opus-5-5. Il garde la même fenêtre de contexte d'un million de tokens, la même sortie maximale de 128 000 tokens et le même découpage en tokens, donc un texte donné compte le même nombre de tokens sur les deux modèles. Ce qui change, c'est le prix, la quantité de raisonnement produite par défaut et quelques règles d'API.

Tarif API, par million de tokens Opus 5 Opus 5.5 Fable 5.1
Entrée5 $4 $10 $
Sortie (raisonnement compris)25 $20 $50 $
Écriture du cache (5 minutes)6,25 $5 $12,50 $
Lecture du cache0,50 $0,20 $0,25 $
Traitement par lots (entrée / sortie)2,50 $ / 12,50 $2 $ / 10 $5 $ / 25 $
Contexte1 million1 million1 million

Le modèle est disponible sur l'API Claude, AWS, Google Cloud et Microsoft Azure, ainsi que dans Claude.ai (offres Pro, Max, Team et Enterprise) et Claude Code, selon la présentation officielle d'Anthropic.

Ce qu'Anthropic revendique

Les chiffres publiés le jour du lancement, repris notamment par Unite.AI et BetaNews, vont tous dans le même sens.

  • Un niveau comparable à Fable 5.1 sur la plupart des tâches, et supérieur sur le code agentique, le travail d'analyse, l'usage d'un ordinateur et la lecture de graphiques.
  • Une génération de texte plus de 30 % plus rapide qu'Opus 5.
  • 66,4 % sur Terminal-Bench 4.0, contre 57,9 % pour GPT-6 Astra dans le tableau publié par Anthropic.
  • Chez Deloitte, 72 % des bugs connus retrouvés en revue de code au réglage d'effort le plus bas, contre 56 % pour Opus 5 au réglage élevé.
  • Moins de chiffres ou de sources affirmés sans appui dans les documents fournis, d'après la documentation d'Anthropic.

À lire avec prudence

Ce sont des résultats d'éditeur, sur des tâches choisies par l'éditeur. Ils disent dans quelle direction le modèle a progressé, pas ce qu'il donnera sur vos contrats ou votre base documentaire. Le dernier point est celui qui intéresse le plus un assistant métier, à vérifier sur vos propres documents.

Pour une équipe qui utilise Claude.ai au quotidien, Opus 5.5 apparaît simplement dans le sélecteur de modèle. Le gain le plus visible viendra moins de ce changement de menu que de la façon de travailler avec l'outil (contexte, fichiers, format de sortie attendu), ce que nous travaillons dans la formation Claude en entreprise.

D'où viennent les 40 % d'économie par rapport à Opus 5 ?

Les 40 % annoncés par Anthropic ne viennent pas seulement du tarif. Ils combinent deux effets, un prix par token plus bas de 20 % et moins de tokens consommés pour finir la même tâche.

Le second effet tient au raisonnement. Opus 5.5 réfléchit avant de répondre, et ces tokens de réflexion sont facturés comme de la sortie, au tarif le plus cher. Anthropic a abaissé l'effort par défaut à medium (contre high sur Opus 5) et indique qu'Opus 5.5 en medium fait au moins aussi bien qu'Opus 5 en high sur le code et l'analyse, avec moins de tokens.

Un réglage peut toutefois annuler une partie du gain. À réglage égal, Opus 5.5 a tendance à raisonner davantage par tour qu'Opus 5, surtout en xhigh et max. Si votre intégration impose un effort élevé hérité d'Opus 5, vous payez le token moins cher mais vous en consommez plus, et l'économie fond. Repartez de medium et testez les niveaux voisins.

Vous payez Opus 5 aujourd'hui

Même prompt, même contexte, un tarif plus bas sur chaque ligne de la facture. La baisse est quasi mécanique, mais le « quasi » compte. Une trentaine de cas réels suffisent à vérifier que la qualité tient, que le coût par tâche réussie baisse vraiment avec votre réglage d'effort, et que rien ne casse dans l'intégration. Notre guide pour évaluer un LLM en entreprise avec les bonnes métriques détaille comment construire ce jeu de cas.

Pourquoi la baisse du cache compte pour un assistant documentaire

La lecture du cache passe de 0,50 $ à 0,20 $ par million de tokens, soit 60 % de moins. Pour un assistant qui relit à chaque question le même socle de contexte, c'est souvent la ligne qui bouge le plus sur la facture.

À chaque question, un assistant interne envoie au modèle un début de requête qui ne change pas (consignes, règles métier, description des outils, parfois un catalogue ou des conditions générales), puis la partie variable, les extraits retrouvés et la question. Le cache garde ce début de requête en mémoire quelques minutes. Tant qu'il est chaud, sa relecture est facturée 0,20 $ le million de tokens au lieu de 4 $, vingt fois moins que l'entrée normale.

Pour un agent, l'effet est encore plus fort. À chaque étape, il renvoie tout l'historique de la tâche, et sur cinquante étapes le même contexte est relu cinquante fois, au tarif du cache.

Un exemple chiffré

Prenons un assistant interne qui répond sur vos procédures. À chaque question, il relit un socle de 50 000 tokens en cache, reçoit 1 000 tokens de question et d'extraits, et produit 700 tokens de réponse. Ce sont des hypothèses d'illustration, calculées aux tarifs publics et sans compter les tokens de raisonnement.

Modèle Dont relecture du cache Coût par question Pour 10 000 questions
Opus 50,025 $0,0475 $475 $
Opus 5.50,010 $0,028 $280 $
Fable 5.10,0125 $0,0575 $575 $

Sur cet exemple, Opus 5.5 coûte 41 % de moins qu'Opus 5 et un peu moins de la moitié de Fable 5.1. Plus des trois quarts de l'écart avec Opus 5 viennent du cache, pas du prix d'entrée ou de sortie. Ce calcul a deux limites. Le cache expire après quelques minutes sans requête (cinq minutes par défaut), donc un assistant peu sollicité repaie plus souvent l'écriture. Et les tokens de raisonnement, absents ici, peuvent peser lourd sur des questions difficiles.

La conception compte autant que le tarif. Un cache ne sert que si le début de la requête reste strictement identique. Une date du jour ou un identifiant de session en tête de prompt suffit à l'invalider. Nous le vérifions systématiquement sur un assistant IA interne, parce que ce réglage fait souvent plus pour la facture qu'un changement de modèle.

Vous avez choisi Fable 5.1, Opus 5.5 suffit-il ?

Pour une partie des usages, probablement. Anthropic place Opus 5.5 au niveau de Claude Fable 5.1 sur la plupart des tâches, pour un tarif deux fois et demie plus bas (4 $ / 20 $ contre 10 $ / 50 $). Mais « la plupart » n'est pas « toutes », et la seule façon de savoir dans quelle catégorie tombe votre cas est de le mesurer.

Anthropic cite un test interne sur une tâche de code de longue durée, terminée en 9 h 30 par Opus 5.5 contre 12 heures pour Fable 5.1, pour un coût inférieur de 51 %. C'est un seul exemple, choisi par l'éditeur, qui donne une direction et pas une garantie. La réponse dépend surtout de la raison pour laquelle vous avez retenu Fable 5.1.

  • Vous l'avez pris par précaution, sans mesure montrant qu'Opus 5 ne suffisait pas. Opus 5.5 est alors le premier candidat à tester, et c'est là que l'économie potentielle est la plus forte.
  • Vous avez mesuré qu'Opus 5 atteignait sa limite sur vos cas les plus durs. Rejouez exactement ces cas sur Opus 5.5. C'est sur eux que le positionnement « niveau Fable » se vérifie ou non.
  • Vous traitez un mélange de tâches simples et difficiles. Le schéma le plus économique est souvent un routage, Opus 5.5 par défaut et Fable 5.1 réservé aux dossiers où vos évaluations montrent un écart.

La vitesse compte aussi. Les premiers tests indépendants de Fable 5.1 le montraient lent sur les tâches difficiles. Pour un assistant où quelqu'un attend la réponse, la latence peut peser autant que le prix.

Opus 5.5 ou Sonnet 5, quand Opus reste-t-il justifié ?

Même après la baisse, Opus 5.5 coûte deux fois le prix de Claude Sonnet 5 (2 $ / 10 $). Le bon modèle reste le moins cher qui atteint la qualité attendue sur votre tâche, et pour beaucoup de tâches métier ce n'est pas Opus.

Type de tâche Point de départ Pourquoi
Agent qui enchaîne des dizaines d'étapes et d'appels d'outilsOpus 5.5Une erreur tôt dans la chaîne fait dérailler toute la suite, la régularité vaut le surcoût
Analyse croisée de documents longs (contrats, dossiers techniques, appels d'offres)Opus 5.5Il faut tenir le fil sur beaucoup de pages et relever les incohérences
Code complexe sur plusieurs fichiers, revue de codeOpus 5.5C'est là que les gains annoncés par Anthropic sont les plus nets
Lecture de graphiques, schémas, tableaux densesOpus 5.5, à testerAnthropic annonce un net progrès en lecture visuelle
Classification d'emails, routage de ticketsSonnet 5 ou plus petitFormat fixe, peu d'interprétation
Extraction de champs (factures, bons de commande)Sonnet 5 ou plus petitTâche cadrée, volume élevé
Assistant documentaire aux questions simples, rédaction cadréeSonnet 5La qualité tient, le coût est divisé par deux

Pour le volume pur, GPT-6 Luna (sorti le même jour à 0,10 $ / 0,50 $) ou Gemini 3.8 Flash traitent la classification et l'extraction pour une fraction du prix d'Opus. Et quand un agent déraille, le modèle est rarement seul en cause, comme le montre notre article sur les agents IA qui bouclent ou dérapent.

Point terrain Tensoria

Sur un agent en production, la facture dépend du nombre d'étapes, de la longueur du raisonnement et des relances, bien plus que du prix affiché. Un modèle plus cher au token qui finit en deux fois moins d'étapes peut revenir moins cher. On compare donc des coûts par tâche réussie, jamais des prix au million de tokens.

Vous préparez un agent et hésitez entre Opus et Sonnet ?

On part de la tâche à automatiser, on sépare ce qui demande Opus de ce qu'un modèle moins cher traite aussi bien, puis on construit l'agent dans vos outils, avec une validation humaine là où elle compte.

Opus 5.5 ou GPT-6 Sol, que dit une comparaison honnête ?

Le même jour, OpenAI a sorti GPT-6 Sol et GPT-6 Luna. Sol est facturé 2 $ / 10 $, deux fois moins cher qu'Opus 5.5 au token. OpenAI annonce environ deux fois moins d'erreurs que son prédécesseur et une fiabilité proche de GPT-6 Astra, et affirme que Sol dépasse Fable et Opus, selon TechCrunch. De son côté, Anthropic publie des scores où Opus 5.5 devance GPT-6 Astra. Ce sont deux affirmations d'éditeurs, et aucune évaluation indépendante ne permettait de trancher le jour de la sortie.

Critère Claude Opus 5.5 GPT-6 Sol
Prix (entrée / sortie, par M tokens)4 $ / 20 $2 $ / 10 $
Place dans la gammeSous Fable 5.1, au-dessus de SonnetSous Astra, au-dessus de Luna
Positionnement de l'éditeurNiveau Fable 5.1 sur la plupart des tâchesFiabilité proche d'Astra pour bien moins cher
Terrain mis en avantAgents longs, code, analyse, lecture visuelleTâches exigeantes du quotidien, dont le code

Trois éléments aident à lire cet écart de prix sans se tromper.

  • Par rang, Sol fait face à Opus 5.5. Par prix, il fait face à Sonnet 5, vendu au même tarif. Si Sol vous intéresse pour son prix, le comparatif juste inclut aussi Sonnet 5.
  • Le coût par tâche compte plus que le prix du token. Un modèle qui raisonne plus longtemps ou relance plus souvent peut effacer un écart de prix de un à deux.
  • Changer d'éditeur coûte plus cher que changer de modèle. Prompts à réajuster, format des appels d'outils différent, contrat de traitement des données et région d'hébergement à revérifier. Si votre système tourne bien sur Claude, Opus 5.5 est le test le moins coûteux. Si vous partez de zéro ou êtes déjà chez OpenAI, Sol mérite sa place dans le comparatif.

Une architecture où le modèle est un paramètre, et non un choix gravé dans le code, rend cette comparaison peu coûteuse à refaire à chaque sortie, et garde un second fournisseur prêt en cas de besoin.

Faut-il migrer vers Opus 5.5, et qu'est-ce qui peut casser ?

Oui en candidat, non par réflexe. Le prix plaide pour Opus 5.5 dès qu'Opus 5 tourne en production, mais changer l'identifiant n'est pas neutre. La documentation de migration d'Anthropic liste quatre changements qui peuvent casser une intégration.

  1. Le raisonnement ne se désactive plus. Couper la réflexion, possible sur Opus 5, renvoie une erreur. Le seul levier est le réglage d'effort, à fixer explicitement, avec assez de marge dans la longueur maximale de réponse.
  2. Les appels d'outils forcés sont refusés. Beaucoup de chaînes d'extraction forcent l'appel d'un outil pour obtenir un JSON propre. Il faut passer au mode automatique avec un schéma strict, ou aux sorties structurées, comme sur Fable 5.1.
  3. L'historique doit rester en ajout seul. Les blocs de raisonnement sont liés à la conversation. Un code qui réécrit l'historique entre deux appels peut les invalider, avec une erreur pour les comptes créés depuis le 31 août 2026.
  4. L'usage d'un ordinateur passe par le nouvel ensemble d'outils (computer_toolset_20260801), l'ancien outil est refusé.

S'y ajoute un filtre de sécurité élargi à la biologie, qui peut refuser des demandes de recherche à double usage. Peu de PME sont concernées, mais un laboratoire doit prévoir la gestion des refus et un modèle de repli. La méthode de test, elle, ne change pas.

  1. Sélectionner 20 à 50 cas réels issus de la production, dont les plus difficiles.
  2. Les rejouer sur Opus 5 et Opus 5.5 à prompt et données identiques, avec deux ou trois niveaux d'effort, et sur Sonnet 5 si la tâche est cadrée.
  3. Comparer la qualité, le coût par tâche réussie et la latence, puis migrer route par route en gardant l'ancien modèle comme repli le temps de valider.

Pour un assistant documentaire, les métriques d'évaluation d'un RAG en production s'appliquent directement à ce test. C'est aussi le cœur d'un audit de RAG ou d'agent IA en production, une base de référence sur vos vraies questions, puis des changements mesurés un par un, le modèle compris.

Vous payez Opus 5 ou Fable 5.1 pour un agent ou un assistant en production ?

On rejoue vos vrais cas sur Opus 5.5, et sur Sonnet quand c'est pertinent, à prompt identique. Vous voyez la qualité, le coût par tâche et la latence avant de toucher à la production.

Questions fréquentes sur Claude Opus 5.5

Claude Opus 5.5 coûte 4 dollars par million de tokens en entrée et 20 dollars en sortie, soit 20 % de moins qu'Opus 5 (5 et 25 dollars). La lecture du cache passe à 0,20 dollar par million de tokens contre 0,50 dollar, et l'écriture du cache à 5 dollars contre 6,25 dollars. Le traitement par lots divise les tarifs d'entrée et de sortie par deux. Anthropic estime le coût à l'usage environ 40 % inférieur à celui d'Opus 5 sur des charges typiques, parce que le modèle consomme aussi moins de tokens pour finir une tâche.
Selon Anthropic, Opus 5.5 atteint le niveau de Claude Fable 5.1 sur la plupart des tâches et le dépasse sur le code agentique, le travail d'analyse, l'usage d'un ordinateur et la lecture de graphiques, pour un tarif deux fois et demie plus bas (4 et 20 dollars contre 10 et 50 dollars). Ce sont des résultats publiés par l'éditeur. Fable 5.1 reste le palier le plus haut de la gamme, et la seule façon de savoir si Opus 5.5 suffit pour vos cas est de rejouer vos tâches les plus difficiles sur les deux modèles.
Oui comme candidat, mais après un test. Le tarif baisse sur chaque ligne de la facture, ce qui rend l'économie presque mécanique. En revanche, le raisonnement ne se désactive plus, les appels d'outils forcés sont refusés et l'historique de conversation doit rester en ajout seul. Il faut donc rejouer 20 à 50 cas réels à prompt identique, fixer explicitement le niveau d'effort, et migrer seulement si la qualité tient et que le coût par tâche réussie baisse.
GPT-6 Sol, sorti le même jour, coûte 2 dollars en entrée et 10 dollars en sortie par million de tokens, deux fois moins qu'Opus 5.5. Les deux éditeurs revendiquent l'avantage sur des benchmarks, sans évaluation indépendante disponible au moment de la sortie. Le coût réel dépend du nombre de tokens et d'étapes par tâche, et changer d'éditeur oblige à réajuster les prompts, les appels d'outils et le contrat de traitement des données. Si votre système tourne bien sur Claude, Opus 5.5 est le test le plus simple à lancer. Si vous partez de zéro, les deux méritent d'être comparés sur vos cas.
Pour les tâches cadrées (classification d'emails, extraction de champs, assistant documentaire aux questions simples, rédaction encadrée), Claude Sonnet 5 à 2 et 10 dollars par million de tokens donne souvent la même qualité pour moitié prix. Opus 5.5 se justifie pour les agents qui enchaînent de nombreuses étapes, l'analyse croisée de documents longs, le code complexe et la lecture de visuels denses. La règle reste de prendre le modèle le moins cher qui atteint la qualité attendue sur votre tâche.
Un assistant ou un agent renvoie au modèle, à chaque requête, un début de contexte identique (consignes, règles métier, description des outils, documents de référence, historique de la tâche). Le cache évite de payer ce contexte au tarif plein. Sur Opus 5.5, sa relecture coûte 0,20 dollar par million de tokens, vingt fois moins que l'entrée normale, contre 0,50 dollar sur Opus 5. Pour un assistant qui relit le même socle à chaque question, c'est souvent la ligne qui baisse le plus sur la facture.

Pour aller plus loin

Sources

Ce qui a bougé depuis le 22 septembre

Le 28 septembre 2026, Anthropic a sorti Claude Sonnet 5.5, au même tarif que Sonnet 5 (2 $ / 10 $, lecture du cache à 0,20 $). Anthropic le présente comme très proche d'Opus 5.5 en performance pour moitié prix, et plus de 30 % plus rapide que Sonnet 5.

Sur les tâches où l'on hésitait entre Opus 5.5 et Sonnet, Sonnet 5.5 est désormais le premier candidat à tester, et Opus 5.5 se concentre encore davantage sur les agents les plus longs et les analyses les plus fines. Le détail est dans notre article sur Claude Sonnet 5.5 en entreprise et dans le comparatif Sonnet 5.5, Opus 5.5, GPT-6 Sol et Gemini 3.8. Pour les traitements à gros volume, notre calcul de coût avec GPT-6 Luna et Gemini 3.8 Flash complète le tableau. Anthropic annonce aussi Claude Haiku 5.5 dans les prochaines semaines.

Mesurer avant de migrer

Votre agent ou votre assistant tourne sur Opus 5 ou Fable 5.1 ?

On fait passer Opus 5.5, et Sonnet quand la tâche le permet, sur vos vrais cas à prompt et données identiques. Vous voyez la qualité, le coût par tâche réussie et la latence de chaque modèle, et vous ne migrez que si le gain est prouvé.

Articles liés

Outils & Modèles

Vérifier une réponse de Claude avant de s'en servir

Une méthode en cinq étapes pour vérifier la fiabilité des réponses de Claude avant de les transmettre à un client, un dirigeant ou une administration.

Lire l'article
Outils & Modèles

Écrire un CLAUDE.md qui tient pour une équipe de développement

Comment rédiger un fichier CLAUDE.md utile et durable pour une équipe de développement : contenu, emplacement, monorepo, versionnement et mise à jour.

Lire l'article
Outils & Modèles

Déployer Claude Code dans une équipe de développement

Comment introduire Claude Code dans une équipe déjà en place, sur une base de code existante, sans faire diverger les pratiques ni casser la revue de code.

Lire l'article
Outils & Modèles

Claude pour Excel : ce que l'add-in fait et ce qu'il ne fait pas

Formules, TCD, consolidation, macros : ce que l'add-in Claude pour Excel gère vraiment et où il faut garder la main, d'après deux sessions de formation terrain.

Lire l'article
Outils & Modèles

Claude Code : ce qui sort de l'entreprise et ce que l'agent exécute

Claude Code sécurité entreprise : ce qui est transmis, ce que l'agent peut exécuter sans validation, et comment cadrer permissions et relecture du code.

Lire l'article
Stratégie IA

Ce qu'on ne colle pas dans Claude : écrire une charte d'usage

Quelles données ne pas coller dans Claude ? Le guide pour écrire une charte d'usage courte et applicable, avec un modèle d'une page prêt à réutiliser en équipe.

Lire l'article
Anas Rabhi, ingénieur IA et data scientist, fondateur de Tensoria
Anas R. Ingénieur IA, fondateur de Tensoria ianas.fr

Je suis ingénieur IA et data scientist, fondateur de Tensoria. Depuis plus de 6 ans, j'accompagne les entreprises dans l'exploitation concrète de l'IA pour leur métier : assistants internes basés sur RAG, agents IA en production, automatisations sur mesure, traitement intelligent de documents. J'interviens du cadrage initial à la mise en production, sur stacks LLM modernes (Mistral, Claude, GPT) et infrastructures souveraines quand la confidentialité l'exige.