Anthropic a sorti Claude Opus 5.5 ce 22 septembre, et le chiffre mis en avant n'est pas un score de benchmark : c'est une baisse de coût de 40% par rapport à Opus 5 sur des charges de travail typiques.
Côté perfs, Anthropic annonce 66,4% sur Terminal-Bench 4.0 (contre 57,9 % pour GPT-6 Astra) et cite une réécriture de HAProxy du C vers Rust bouclée en 9 h 30, contre 12 h pour Fable 5.1, pour 51 % moins cher.
Et cette baisse de coût repose sur plusieurs leviers :
- un prix au token en baisse : 4$ en entrée et 20$ en sortie par million, contre 5$ et 25$ pour Opus 5
- des cache reads à 0,20$ au lieu de 0,50$, soit -60% sur le poste qui pèse le plus en agentique
- moins de tokens consommés par tâche, avec une génération annoncée 30% plus rapide
C'est exactement ce que je répète ici depuis des mois : le prix au token ne veut rien dire, seul compte ce que coûte une tâche de bout en bout.
Et voir un labo en faire son argument principal, c'est plutôt une bonne nouvelle. Mais il faut bien retenir une chose : tous ces chiffres sont auto-déclarés par Anthropic et ses early testers (GitHub, Stripe, Lovable, Spotify...), et Artificial Analysis n'a encore rien publié sur Opus 5.5 au moment où j'écris.
Pour ceux qui l'intègrent en API, deux détails comptent aussi : le thinking ne peut plus être désactivé, et la plupart des tâches cyber sont redirigées de façon transparente vers Opus 4.8.
Donc je ne crie pas au miracle, d'autant que mes services en prod tournent sur DeepSeek V4.1-Flash à environ 4 cents par jour, et qu'un Opus même à -40 % ne joue pas dans la même cour.
Opus, Je m'en sers pour des taches plus complexes mais pas automatiques.
J'attends les mesures indépendantes et mes propres runs avant de dire si ces 40% tiennent sur du vrai code.