Chargement…

Claude Haiku 5.5 : Anthropic casse enfin les prix

Claude Haiku 5.5 : Anthropic casse enfin les prix

Un modèle low cost, de quoi alléger les factures ?

Un petit modèle qui ne fait plus de la figuration

Anthropic a sorti Claude Haiku 5.5 le 7 octobre, et je vais être honnête : Haiku 4.5 j'ai fini par lâcher à cause des tâches que je lui donnais. C'était des conditions, ou de la petite traduction et pour le coût j'étais passé sur Jev ou Deepseek 4.1 Flash.

Mais voyons un peu où en est Haiku.

Sur Terminal-Bench 4.0, il plafonnait à 0 %. Zéro.

Haiku 5.5 monte à 39,2 %, et à 72,4 % sur OSWorld 2.1 (contre 15,7 % pour son prédécesseur). Il prend aussi un réglage d'effort, comme Sonnet et Opus, ce qui est une première sur la gamme Haiku.

Mais il faut bien retenir une chose : ces chiffres sortent tous de chez Anthropic.

Artificial Analysis n'a encore rien publié de son côté, donc j'attends leurs mesures avant de m'emballer.

Et Anthropic le dit lui-même : pour du coding agentique complexe, Sonnet 5.5 et Opus 5.5 restent loin devant (70,6 % sur Terminal-Bench pour Sonnet).

Mais le vrai coup, c'est le prix

Voici la grille par million de tokens, pour les prompts sous 100k tokens :

  • Input : 0,10 $ (contre 1 $ sur Haiku 4.5)
  • Output : 0,50 $ (contre 5 $)
  • Cache read : 0,01 $ (contre 0,10 $)

On parle de 90 % de baisse sur ce segment, qui représentait 90 % des requêtes sur Haiku 4.5.

Au-delà de 100k, la baisse tombe à 50 %.

Et le nouveau tokenizer consomme un peu plus de tokens par tâche, d'où le chiffre officiel plus prudent de 75 % d'économie moyenne.

Dans la foulée, Anthropic divise par 2 le cache read de Sonnet 5.5 (environ 20 % moins cher sur du travail agentique) et offre des crédits API mensuels : 100 $ pour Max 5x, 200 $ pour Max 20x, jusqu'à 500 $ mutualisés pour Team.

Donc, est-ce que je reviens chez Anthropic ?

Mes services en prod tournent aujourd'hui sur DeepSeek V4.1-Flash, que j'ai migrés depuis Haiku parce que la facture passait de 30 cents à 4 cents par jour de process.

Haiku 5.5 vise exactement ce terrain : résumés, classification, compaction, sous-agents, browser use. Le combo qui m'intéresse, c'est Opus ou Sonnet en lead, avec Haiku 5.5 en sous-agent qui fait le sale boulot pour quelques centimes.

La vérité c'est que le marché des petits modèles se joue désormais au centime près. Et la question n'est plus de savoir quel modèle est le plus intelligent, mais lequel est assez bon pour une tâche donnée au prix le plus bas.

Si vous avez déjà migré des workflows dessus, je suis preneur de vos retours.

FAQ

Haiku 5.5 est-il fiable pour du coding agentique complexe ?

Non, Anthropic reconnaît lui-même que Sonnet 5.5 et Opus 5.5 restent largement devant sur ce terrain, avec 70,6 % sur Terminal-Bench pour Sonnet contre 39,2 % pour Haiku 5.5. Haiku 5.5 vise plutôt des tâches plus simples comme les résumés, la classification ou le browser use.

Pourquoi se méfier des chiffres annoncés par Anthropic ?

Parce qu'ils proviennent uniquement des benchmarks internes de l'entreprise, sans validation indépendante pour l'instant. Artificial Analysis n'a encore rien publié sur Haiku 5.5, donc une vérification externe reste à venir avant de tirer des conclusions définitives.

La baisse de prix s'applique-t-elle à tous les usages ?

Pas uniformément. La baisse de 90 % concerne les prompts sous 100k tokens, qui représentent la majorité des requêtes, mais elle tombe à 50 % au-delà de ce seuil. Le nouveau tokenizer consomme aussi un peu plus de tokens par tâche, ce qui explique le chiffre officiel plus prudent de 75 % d'économie moyenne.

Faut-il abandonner DeepSeek ou Jev pour revenir sur Haiku 5.5 ?

Pas forcément de façon radicale, mais le rapport qualité-prix de Haiku 5.5 mérite un nouveau test, surtout en complément d'un modèle plus puissant comme Opus ou Sonnet en lead. L'auteur lui-même envisage ce combo plutôt qu'un remplacement complet de sa stack actuelle basée sur DeepSeek V4.1-Flash.

Les crédits API annoncés par Anthropic changent-ils la donne ?

Ils réduisent le coût d'entrée pour tester la nouvelle gamme, avec jusqu'à 500 dollars de crédits mutualisés pour les équipes et 100 à 200 dollars selon les offres Max. Combinés à la baisse de prix sur le cache read de Sonnet 5.5, ils rendent l'écosystème Anthropic plus compétitif face à des alternatives comme DeepSeek.