Anthropic a lancé Claude Opus 5.5 le 22 septembre, premier modèle de la famille Claude 5.5. La baisse de prix attire naturellement l'attention, mais le changement le plus intéressant pour les équipes qui exploitent des agents est double : Anthropic affirme que le modèle consomme moins de jetons pour accomplir de nombreuses tâches longues, et certaines requêtes sensibles peuvent être prises en charge de façon transparente par un autre modèle dans le cadre des garde-fous du fournisseur.

Opus 5.5 coûte 4 dollars par million de jetons en entrée et 20 dollars en sortie. La lecture du cache est facturée 0,20 dollar par million de jetons. Anthropic indique que les tarifs unitaires sont inférieurs de 20 % à ceux d'Opus 5 et que le coût d'un travail typique facturé au jeton baisse d'environ 40 % lorsque l'on tient compte de l'efficacité du modèle. Le mode rapide coûte 8 dollars en entrée et 40 dollars en sortie par million de jetons.

Le bon indicateur est le coût du travail accepté

Pour un agent de développement, le tarif du jeton ne suffit pas. Un modèle qui termine une tâche avec moins d'étapes, moins d'appels d'outils et moins de sortie peut générer une économie supérieure à la remise affichée. À l'inverse, des reprises fréquentes ou des résultats intermédiaires inutilisables peuvent annuler cet avantage.

Anthropic estime qu'Opus 5.5 réduit d'environ 40 % le coût de travaux typiques par rapport à Opus 5 et produit sa sortie plus de 30 % plus vite. Les benchmarks et évaluations de clients publiés au lancement vont dans ce sens, mais ils restent des résultats fournis par Anthropic ou ses partenaires et ne constituent pas une garantie universelle.

Une comparaison utile doit donc conserver les mêmes outils, droits, instructions et critères d'acceptation, puis mesurer le coût par tâche acceptée, la durée, le nombre d'appels d'outils, les reprises et le travail de vérification humaine.

Les garde-fous peuvent modifier le chemin d'exécution

Le détail d'architecture le plus notable concerne le routage lié aux garde-fous. Anthropic applique à Opus 5.5 des protections proches de celles de Fable 5.1 pour la cybersécurité, la biologie et certains risques de distillation. L'entreprise précise que la plupart des tâches de cybersécurité sont redirigées de manière transparente vers Claude Opus 4.8, avec des programmes d'accès élargi pour des professionnels vérifiés.

Le modèle demandé par une application n'est donc pas nécessairement celui qui traite chaque requête jusqu'au bout. Pour une utilisation courante, ce mécanisme peut rester invisible. Pour un benchmark, un audit, un environnement réglementé ou l'analyse d'un incident, il devient important.

L'analyse d'Aipolix est que les équipes devraient enregistrer, lorsqu'elles y ont accès, non seulement le modèle demandé, la latence et les jetons consommés, mais aussi le résultat du routage ou d'une intervention de sécurité. Sans cela, un benchmark peut agréger plusieurs chemins d'exécution sous une seule étiquette de modèle.

Le preserved thinking change certaines hypothèses d'intégration

Opus 5.5 arrive aussi avec le mécanisme preserved thinking pour les comptes API plus récents. Anthropic l'a introduit comme protection contre les tentatives de distillation et indique qu'il empêche un client API de modifier librement le contexte de raisonnement antérieur de Claude. La mesure s'applique à Opus 5.5 et Fable 5.1 pour les comptes créés à partir du 31 août 2026.

La conséquence pour les développeurs est simple : l'état durable d'un workflow ne devrait pas dépendre de la possibilité de manipuler le raisonnement interne du modèle. Les applications doivent conserver leur propre état dans des données explicites, les résultats d'outils et les messages observables.

Anthropic indique également qu'Opus 5.5 reste disponible avec rétention nulle des données et conserve les mesures de filigranage destinées à répondre aux exigences de l'AI Act européen.

Les agents longs bénéficient davantage de la nouvelle économie

La réduction du prix du cache est particulièrement importante pour les sessions longues. Le coût de lecture passe de 0,50 dollar par million de jetons sur Opus 5 à 0,20 dollar sur Opus 5.5. Les agents qui réutilisent régulièrement un grand contexte de code ou de documents peuvent donc voir une différence sensible.

Cela ne remplace pas l'ingénierie de l'orchestration. Les limites de permission, les contrôles d'outils, les points de reprise, l'évaluation et la gestion des erreurs restent nécessaires. La nouveauté est que le seuil économique pour confier une tâche longue à un modèle haut de gamme descend.

Ce qu'il faut mesurer avant de basculer la production

Un déploiement progressif devrait comparer Opus 5.5 au modèle actuellement utilisé sur des tâches représentatives. Il faut suivre le taux de réussite, les appels d'outils, les jetons de sortie et de cache, le temps total, les interventions des garde-fous et la charge de relecture humaine.

Opus 5.5 est une sortie importante parce qu'elle modifie à la fois le coût et, pour certaines requêtes, le chemin d'exécution. Le tarif inférieur est immédiatement visible ; le coût inférieur d'un résultat fiable doit encore être démontré dans chaque application.

Sources
- Anthropic — Introducing Claude Opus 5.5
- Anthropic — Claude Opus availability and pricing