Chargement…

Claude Opus 5.5 optimisation des taches

Claude Opus 5.5 optimisation des taches

Anthropic a sorti Claude Opus 5.5 ce 22 septembre, et le chiffre mis en avant n'est pas un score de benchmark : c'est une baisse de coût de 40% par rapport à Opus 5 sur des charges de travail typiques.

Côté perfs, Anthropic annonce 66,4% sur Terminal-Bench 4.0 (contre 57,9 % pour GPT-6 Astra) et cite une réécriture de HAProxy du C vers Rust bouclée en 9 h 30, contre 12 h pour Fable 5.1, pour 51 % moins cher.

Et cette baisse de coût repose sur plusieurs leviers :

  • un prix au token en baisse : 4$ en entrée et 20$ en sortie par million, contre 5$ et 25$ pour Opus 5
  • des cache reads à 0,20$ au lieu de 0,50$, soit -60% sur le poste qui pèse le plus en agentique
  • moins de tokens consommés par tâche, avec une génération annoncée 30% plus rapide

C'est exactement ce que je répète ici depuis des mois : le prix au token ne veut rien dire, seul compte ce que coûte une tâche de bout en bout.

Et voir un labo en faire son argument principal, c'est plutôt une bonne nouvelle. Mais il faut bien retenir une chose : tous ces chiffres sont auto-déclarés par Anthropic et ses early testers (GitHub, Stripe, Lovable, Spotify...), et Artificial Analysis n'a encore rien publié sur Opus 5.5 au moment où j'écris.

Pour ceux qui l'intègrent en API, deux détails comptent aussi : le thinking ne peut plus être désactivé, et la plupart des tâches cyber sont redirigées de façon transparente vers Opus 4.8.

Donc je ne crie pas au miracle, d'autant que mes services en prod tournent sur DeepSeek V4.1-Flash à environ 4 cents par jour, et qu'un Opus même à -40 % ne joue pas dans la même cour.

Opus, Je m'en sers pour des taches plus complexes mais pas automatiques.

J'attends les mesures indépendantes et mes propres runs avant de dire si ces 40% tiennent sur du vrai code.

FAQ

Qu'est-ce qui change concrètement avec Claude Opus 5.5 par rapport à Opus 5 ?

Le principal changement est une baisse de coût d'environ 40% sur les charges de travail typiques, portée par un prix au token réduit, des cache reads moins chers et une consommation de tokens plus faible par tâche. Les prix passent à 4$ en entrée et 20$ en sortie par million de tokens, contre 5$ et 25$ pour Opus 5.

Peut-on faire confiance aux chiffres de performance annoncés par Anthropic ?

Il faut rester prudent car ces chiffres sont auto-déclarés par Anthropic et ses early testers comme GitHub, Stripe ou Spotify. Aucune mesure indépendante d'Artificial Analysis n'a encore été publiée au moment de la rédaction de l'article.

Le thinking peut-il être désactivé sur Opus 5.5 en API ?

Non, une différence notable pour les intégrations API est que le mode thinking ne peut plus être désactivé sur cette version. C'est un détail à prendre en compte si votre usage nécessitait de le couper.

Que deviennent les tâches liées à la cybersécurité avec ce nouveau modèle ?

La plupart des tâches cyber sont redirigées de manière transparente vers Opus 4.8 plutôt que traitées directement par Opus 5.5. Ce comportement se fait sans action particulière de l'utilisateur.

Opus 5.5 est-il une bonne option pour un usage quotidien en production ?

Cela dépend fortement du cas d'usage et du budget, puisque des alternatives comme DeepSeek V4.1-Flash tournent pour environ 4 centimes par jour, un ordre de grandeur très différent même avec la baisse de 40%. Opus reste plutôt pertinent pour des tâches complexes et ponctuelles plutôt que pour de l'automatisation à grande échelle.

Faut-il attendre avant d'adopter Opus 5.5 pour du vrai code en production ?

Il semble raisonnable d'attendre des benchmarks indépendants et des tests personnels avant de valider que les gains de coût annoncés se confirment sur des projets de code réels. L'auteur lui-même indique vouloir vérifier ces 40% avec ses propres runs avant de se prononcer.


Poursuivre la lecture

DeepSeek V4.1-Flash: petit mais fort News
#deepseek#code agentique#model

DeepSeek V4.1-Flash: petit mais fort

DeepSeek V4.1-Flash remplace discrètement le modèle Pro et promet plus de rapidité pour moins cher : la promesse tient-elle face au coût réel par tâche ?

Alexandre P.
L'affaire Jacob Coxon News
#ia#code agentique#modeles

L'affaire Jacob Coxon

Un chercheur démissionne d'Anthropic et prédit l'extinction avant 2030, déclenchant 200 millions de vues et une salve de réactions chez OpenAI, DeepMind et Trump.

Alexandre P.