Ressources·Claude Fable 5.1 : faut-il changer quelque chose de votre côté ?
Claude Fable 5.1 : faut-il changer quelque chose de votre côté ?
Un nouveau modèle sort. Quelqu'un dans votre équipe demande s'il faut migrer, et personne ne sait répondre autrement que par une impression. C'est arrivé le 1er septembre 2026 avec Claude Fable 5.1.
La réponse courte tient en deux lignes. Si vos équipes utilisent Claude par l'application ou par Claude Code, vous l'avez déjà et vous n'avez rien à faire. Si vous appelez l'API, c'est un identifiant de modèle à changer, une ligne de configuration. Le travail réel est ailleurs, et il n'a pas bougé d'un centimètre.
Reste à savoir ce qui a changé, pour de vrai, et à quoi ça sert dans une entreprise qui a autre chose à faire que suivre les sorties de modèles.
Qu'est-ce qui change vraiment avec Claude Fable 5.1 ?
Trois choses, d'après l'annonce d'Anthropic.
Les tâches longues. C'est là que l'écart est le plus net. Sur Terminal-Bench-Science, qui mesure des tâches scientifiques exécutées en ligne de commande sur plusieurs étapes, Fable 5.1 obtient 52,6 % contre 24,7 % pour Fable 5. Sur CursorBench, un test de codage agentique, 73,4 % contre 70,5 %. Traduction : les progrès portent sur le travail qui dure une heure, pas sur la question posée en trois lignes.
Le prix. Fable 5.1 coûte 10 $ par million de tokens en entrée et 50 $ en sortie. Le changement réel est ailleurs : la lecture en cache passe de 1,00 $ à 0,25 $ par million.
Lecture en cache, par million de tokens
| Claude Fable 5 | 1 $ |
|---|---|
| Claude Fable 5.1 | 0,25 $ |
Anthropic annonce environ 25 % de moins sur une charge de travail courante, et jusqu'à environ 45 % sur du travail agentique. L'écart entre les deux chiffres s'explique entièrement par le graphique ci-dessus : plus votre usage relit le même contexte, plus la baisse est forte. Un assistant qui répond à des questions ponctuelles en profite peu. Un process automatisé qui repasse sur le même dossier vingt fois en profite beaucoup.
Moins de refus injustifiés. Anthropic annonce 60 % de faux positifs en moins sur les sujets de cybersécurité, et un refus 85 % moins fréquent sur des demandes bénignes de biologie ou de médecine. Si votre équipe a déjà vu le modèle refuser une question de laboratoire parfaitement ordinaire, c'est ce point qui vous concerne.
Les benchmarks parlent-ils de votre travail ?
Presque jamais. Ils mesurent les tâches les plus dures qu'on sache mesurer, ce qui n'est pas la même chose que vos relances de factures.
Un seul chiffre de l'annonce mérite d'être affiché en réunion, et ce n'est pas un record.
Workflows métier menés au bout sans intervention (AutomationBench)
| Claude Fable 5.1 | 31,4 % |
|---|---|
| Claude Opus 5 | 26,9 % |
| GPT-5.6 Sol | 19,6 % |
| Claude Fable 5 | 17,1 % |
Le score a presque doublé en une version. Il reste sous les 32 %. Les deux lectures sont vraies en même temps, et c'est la seconde qui doit guider un budget : sur un workflow métier complet, du début à la fin, sans personne pour rattraper, l'état de l'art échoue deux fois sur trois.
C'est exactement pour cette raison que nous cadrons les ateliers autour de tâches découpées, avec un humain au point de contrôle, plutôt qu'autour de process autonomes de bout en bout.
Faut-il changer quelque chose de votre côté ?
Dans la plupart des cas, non. Voici le seul déroulé qui vaut la peine.
Ce qu'il y a réellement à faire
- 1Vérifier par où vous passezApplication ou Claude Code : c'est déjà en place.
- 2Changer l'identifiantSeulement si vous appelez l'API directement.
- 3Régler le niveau d'effortLe réglage qui pèse le plus sur le coût et la latence.
- 4Rejouer vos cas de testLes mêmes cinq dossiers réels qu'avant la mise à jour.
Le troisième point est le seul qui demande un peu de jugement. Fable 5.1 se règle sur plusieurs niveaux d'effort, et Anthropic indique que le modèle fait aussi bien ou mieux que Fable 5 dès les niveaux bas et moyen, l'écart se creusant surtout aux niveaux élevés. Par défaut, Claude Code démarre en effort élevé, l'application et Claude Cowork en effort moyen. Autrement dit : monter l'effort coûte du temps et de l'argent, et ne se justifie que sur les tâches où vous avez constaté que le résultat le méritait.
Le quatrième point est celui que tout le monde saute. Si vous n'avez pas cinq dossiers réels sur lesquels rejouer vos prompts après une mise à jour, vous ne saurez pas si le changement vous a fait du bien ou du mal. Vous aurez une opinion.
Quand la mise à jour ne changera rien pour vous
Il faut le dire clairement, parce que c'est le cas le plus fréquent : dans une entreprise qui n'a pas encore de process écrit, un modèle plus performant ne produit aucun gain mesurable.
Trois situations où changer de version est une perte de temps :
- Personne n'a mesuré l'avant. Sans durée de référence sur le process, aucun modèle ne pourra démontrer quoi que ce soit. Le sujet n'est pas le modèle, c'est la mesure. C'est aussi vrai ici que pour les cinq process que toute PME peut automatiser.
- Les données d'entrée sont sales. Un devis à moitié rempli, un CRM où le même client existe trois fois : le meilleur modèle du monde produira une réponse propre à partir d'une entrée fausse. Plus vite qu'avant, c'est tout.
- Le process n'a pas de référent. Une automatisation sans personne qui la maintient tient un mois. Une version de modèle n'y change rien.
Dans ces trois cas, notre réponse est la même : l'IA n'est pas le problème à traiter en premier. C'est une phrase qui nous coûte régulièrement des missions, et nous la maintenons.
Par où commencer
Si votre équipe utilise déjà Claude au quotidien, la mise à jour est faite. La question utile est celle d'après : quelles tâches valent la peine d'être confiées à un modèle, et lesquelles vous coûteront plus cher à surveiller qu'à faire.
C'est le contenu d'une formation IA : on part de vos dossiers réels, on mesure le temps passé avant, on écrit les prompts sur place, et on repart avec ce qui fonctionne chez vous. Si la question porte sur plusieurs équipes à la fois et que vous voulez un chiffrage avant de décider, c'est le rôle de l'audit IA : cinq jours, vos process, un ordre de priorité.
Dans les deux cas, la version du modèle est la variable la moins importante de l'équation.