Chargement…

Fable 5.1: pas forcément moins cher

Fable 5.1: pas forcément moins cher

Anthropic sort Fable 5.1 et Mythos 5.1, le même modèle avec deux niveaux de garde-fous. Et le chiffre que tout le monde a retenu, c'est la baisse de prix.

Sur le papier, la montée en capacité est réelle.

Terminal-Bench-Science passe de 24,7 % à 52,6 %, AutomationBench de 17,1 % à 31,4 %, Humanity's Last Exam à 60,9 % sans outils.

Artificial Analysis, qui n'est pas Anthropic, confirme la direction avec un score de 66 sur son Intelligence Index en effort max, le meilleur qu'ils aient mesuré, devant Opus 5 (63) et Fable 5 (62).

Côté tarif, les tokens ne bougent pas (10$ /M en entrée, 50$ en sortie), mais les cache reads tombent à 0,25 $ /M, soit 75% de moins. Anthropic en déduit environ 25 % d'économie sur une charge classique, et jusqu'à 45% sur de l'agentique lourd.

Sauf qu'une facture ne se lit pas au token, elle se lit à la tâche. Je m'explique. Artificial Analysis mesure environ 3,7$ par tâche de son Intelligence Index, soit à peu près 20 % de plus que Fable 5.

Le modèle est nettement plus verbeux : 160M de tokens générés sur l'index contre une médiane de 79M, et un facteur 11 entre l'effort low et l'effort max.

La remise sur le cache est vraie, mais elle est mangée par le volume de sortie.

Autre détail qui compte : ce score de 66 a été obtenu avec le fallback serveur actif, environ 4 % des tokens de sortie ayant été servis par Opus 4.8 ou Opus 5 quand un garde-fou se déclenchait.

Ce n'est donc pas un résultat mono-modèle.

Je ne l'ai pas encore mis en production sur mes propres workflows, donc je ne vais pas vous vendre un ressenti que je n'ai pas.

Ce que je retiens pour l'instant : le gain se concentre sur le travail long, outillé, non supervisé, et il reste à un chiffre sur le code quotidien court.

Avant de basculer votre pipeline, mesurez votre coût par tâche sur une semaine réelle plutôt que votre coût par million de tokens.

C'est le seul des deux qui apparaît sur votre relevé bancaire.

FAQ

Fable 5.1 est-il vraiment moins cher que Fable 5 à l'usage ?

Pas forcément. Malgré la baisse de 75% sur les cache reads, le modèle génère beaucoup plus de tokens en sortie, ce qui fait grimper le coût réel par tâche à environ 3,7$ selon Artificial Analysis, soit 20% de plus que Fable 5.

Quelle est la différence entre Fable 5.1 et Mythos 5.1 ?

Ce sont deux déclinaisons du même modèle avec des niveaux de garde-fous différents, Mythos étant la version avec des restrictions plus strictes. Le choix entre les deux dépend donc du niveau de supervision souhaité plutôt que de capacités distinctes.

Le score de 66 sur l'Intelligence Index reflète-t-il les capacités propres du modèle ?

Pas entièrement, puisque environ 4% des tokens de sortie ont été servis par Opus 4.8 ou Opus 5 via un mécanisme de fallback serveur quand un garde-fou se déclenchait. Ce résultat est donc à nuancer, car il ne provient pas d'un modèle unique isolé.

Sur quels usages le gain de Fable 5.1 est-il le plus visible ?

Les progrès se concentrent sur les tâches longues, outillées et peu supervisées, comme le montrent les bonds sur Terminal-Bench-Science ou AutomationBench. Sur du code quotidien court, l'amélioration reste plus modeste, à un chiffre.

Comment évaluer si la mise à jour vaut le coup pour mon usage ?

Le plus fiable est de mesurer votre coût par tâche sur une semaine de charge réelle plutôt que de se fier au prix par million de tokens. C'est cette métrique qui reflète ce que vous paierez concrètement, notamment à cause de la verbosité accrue du modèle.

Faut-il basculer immédiatement son pipeline vers Fable 5.1 ?

Rien n'y oblige dans l'immédiat, d'autant que l'auteur lui-même n'a pas encore testé le modèle en production. Mieux vaut valider le gain sur votre propre charge de travail avant de migrer, surtout si vos tâches sont courtes et peu agentiques.


Poursuivre la lecture

Claude Opus 5, même prix ! News

Claude Opus 5, même prix !

Opus 5 d'Anthropic promet l'intelligence de Fable 5 à moitié prix, même grille tarifaire qu'Opus 4.8 à l'appui : les chiffres racontent-ils vraiment la même histoire ?

Alexandre P.
Sakana Fugu, le réveil du Japon News
#ia#japon#sakuna

Sakana Fugu, le réveil du Japon

Sakana AI lance Fugu, un modèle qui orchestre d'autres IA à votre place. Une promesse séduisante, mais les benchmarks auto-déclarés et la tarification méritent qu'on y regarde de plus près.

Alexandre P.