Ce matin, un stagiaire du Titre Pro TSSR m'a tendu son téléphone avant même de dire bonjour. Sur l'écran, l'annonce d'Anthropic : Claude Fable 5.1. Sa question tenait en une phrase. « Est-ce que ce que j'apprends depuis mars sert encore à quelque chose ? »
Je lui ai répondu ce que je vais vous écrire ici. Non, il n'a pas à tout réapprendre. Oui, quelque chose a bougé. Et la seule façon de ne pas subir ce genre de matinée, c'est de lire ce qui a réellement changé, chiffres en main, avant de décider quoi que ce soit.
Le 1er septembre 2026, Anthropic publie Claude Fable 5.1, ouvert à tous les abonnés payants, et Claude Mythos 5.1, le même modèle avec des filtres allégés, réservé à des organisations vérifiées et pour l'instant américaines. Le prix affiché ne bouge pas : 10 $ le million de tokens en entrée, 50 $ en sortie. Mais la lecture du cache passe de 1 $ à 0,25 $, ce qui abaisse la facture réelle de 25 % à 45 % selon l'usage. Le bond le plus net concerne la recherche scientifique autonome, où le score passe de 24,7 % à 52,6 %. Pour un adulte en reconversion, la leçon n'est pas technique : le modèle travaille désormais des heures sans surveillance, et la compétence qui prend de la valeur est celle qui définit la tâche, vérifie le résultat et décide.
- Les faits du 1er septembre 2026
- Les benchmarks, sans le vernis marketing
- Le prix : ce qui baisse vraiment
- Ce qui est nouveau, au-delà des scores
- Ce que ça change pour votre trajectoire
- La méthode : trois questions avant de payer
- Les limites à connaître
- FAQ
Les faits du 1er septembre 2026
Deux noms, un seul modèle. Fable 5.1 et Mythos 5.1 partagent exactement les mêmes poids. Ce qui les distingue, ce sont les garde-fous. Fable bride les capacités en cybersécurité offensive et en biologie ; Mythos les conserve, mais n'est accessible qu'aux organisations vérifiées par deux programmes dédiés (cybersécurité défensive d'un côté, sciences de la vie de l'autre), et pour l'instant aux seules organisations américaines. Anthropic annonce une extension internationale « coordonnée avec le gouvernement américain », sans date.
Où l'obtenir. Fable 5.1 est disponible dès aujourd'hui sur Claude.ai pour les offres Pro, Max, Team et Enterprise, et par API (identifiant claude-fable-5-1) chez Anthropic, AWS, Google Cloud et Microsoft Foundry. La fenêtre de contexte reste à 1 million de tokens, la sortie à 128 000 tokens. Les connaissances du modèle s'arrêtent à juin 2026, soit cinq mois plus tard que Fable 5.
- Avril 2026Anthropic dévoile Mythos, son modèle le plus puissant, réservé à un cercle restreint de partenaires.
- 9 juin 2026Lancement de Claude Fable 5 (grand public) et Mythos 5 (organisations approuvées).
- 30 juin 2026Claude Sonnet 5 devient le modèle par défaut des offres Free et Pro.
- 2 août 2026Entrée en application du volet transparence du règlement européen sur l'IA. Les sorties de Claude portent désormais un filigrane invisible.
- 1er septembre 2026Claude Fable 5.1 et Mythos 5.1. Même prix affiché, cache quatre fois moins cher, filtres moins intrusifs.
| Claude Fable 5.1 | Claude Mythos 5.1 | |
|---|---|---|
| Modèle sous-jacent | Identique | Identique |
| Cybersécurité | Identification de vulnérabilités autorisée ; exploitation et tests d'intrusion redirigés vers Opus | Capacités complètes |
| Biologie | Questions médicales courantes autorisées ; recherche redirigée vers Opus 5 | Capacités complètes |
| Qui y a accès | Tout abonné payant, tout client API | Organisations vérifiées, États-Unis uniquement |
| Score Terminal-Bench 4.0 | 55,8 % | 60,9 % |
Les benchmarks, sans le vernis marketing
Les chiffres ci-dessous sont ceux publiés par Anthropic, mesurés au réglage d'effort maximal. Un éditeur choisit ses tests et ses réglages ; un score n'est jamais une preuve indépendante. Je vous les donne tels quels, puis je vous dis ce que j'y lis.
| Benchmark (ce qu'il mesure) | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 (recherche scientifique autonome) | 52,6 % | 24,7 % | 29,0 % | 22,4 % |
| Terminal-Bench 4.0 (programmation agentique) | 55,8 % | 42,0 % | 52,3 % | 37,3 % |
| AutomationBench (flux de travail d'entreprise) | 31,4 % | 17,1 % | 26,9 % | 19,6 % |
| CursorBench 3.2.0 (code dans l'éditeur) | 73,4 % | 70,5 % | 70,0 % | 67,2 % |
| GDPval-AA v2 (travail de bureau, score Elo) | 1 853 | 1 723 | 1 824 | 1 711 |
| OSWorld 2.0 (usage d'un ordinateur, notation partielle / stricte) | 77,9 % / 41,7 % | 72,9 % / 36,1 % | 75,4 % / 39,6 % | n. c. |
| Humanity's Last Exam (raisonnement, sans outils / avec outils) | 60,9 % / 65,0 % | 57,8 % / 63,8 % | 56,6 % / 63,6 % | n. c. |
Source : Anthropic, « Introducing Claude Fable 5.1 and Claude Mythos 5.1 », 1er septembre 2026 [consulté le 2026-09-01]. Chiffres déclarés par l'éditeur, réglage d'effort maximal. Le test demande au modèle de mener seul une tâche de recherche dans un terminal : lire des données, écrire du code, corriger ses erreurs, produire un résultat.
Source : Anthropic, annonce du 1er septembre 2026 [consulté le 2026-09-01]. Mythos 5.1 et Fable 5.1 sont le même modèle ; les 5,1 points d'écart mesurent l'effet des garde-fous de sécurité sur des tâches de code.
Source : Anthropic, annonce du 1er septembre 2026 [consulté le 2026-09-01]. AutomationBench enchaîne des tâches administratives réelles (traiter un dossier, remplir un système, relancer). Un score de 31,4 % signifie que plus des deux tiers des enchaînements échouent encore.
Première lecture : le progrès est concentré sur les tâches longues. Là où le modèle doit travailler seul pendant des heures, le saut est brutal : plus 27,9 points en recherche scientifique, plus 13,8 points en programmation agentique, plus 14,3 points en flux d'entreprise par rapport à Fable 5. Là où il s'agit de répondre à une question, le progrès est réel mais modeste : plus 3,1 points sur le raisonnement pur, et 29 points Elo d'avance sur Opus 5 en travail de bureau. Autrement dit, Fable 5.1 ne répond pas beaucoup mieux qu'en juin. Il travaille beaucoup mieux.
Deuxième lecture : pour la première fois, le prix de la prudence est chiffré. Mythos 5.1 obtient 60,9 % là où Fable 5.1 plafonne à 55,8 %, sur le même test, avec les mêmes poids. Les 5,1 points de différence, ce sont les filtres. Un éditeur qui publie le coût de ses propres garde-fous, c'est une information rare, et plutôt honnête.
Troisième lecture : la concurrence est distancée sur ces tests, et ce sont ces tests-là. GPT-5.6 Sol est derrière sur les cinq mesures où Anthropic le fait figurer. Mais OpenAI publie d'autres tableaux, avec d'autres tests. Quand j'ai comparé les dix meilleurs modèles en août, l'écart entre le premier et le dixième tenait en moins de dix points. Rien ici ne dit que cet ordre est bouleversé ; tout dit que la marge de Claude s'est creusée sur les tâches autonomes.
Le prix : ce qui baisse vraiment
Le prix affiché ne change pas, et c'est la première chose que les titres de presse ont retenue. Ils ont eu tort de s'arrêter là.
| Modèle | Entrée (par million de tokens) | Lecture du cache | Sortie |
|---|---|---|---|
| Claude Fable 5.1 | 10 $ | 0,25 $ | 50 $ |
| Claude Fable 5 | 10 $ | 1,00 $ | 50 $ |
| Claude Opus 5 | 5 $ | 0,50 $ | 25 $ |
| GPT-5.6 Sol (tarif promotionnel) | 4 $ | 0,40 $ | 20 $ |
| Gemini 3.7 Flash (tarif jusqu'au 31 décembre 2026) | 0,75 $ | n. c. | 3,75 $ |
Sources : Anthropic, page Claude Fable, et VentureBeat, 1er septembre 2026 [consultés le 2026-09-01]. Le traitement par lots (batch) divise en outre l'entrée et la sortie par deux : 5 $ et 25 $. L'inférence limitée au territoire américain coûte 1,1 fois le tarif.
Pourquoi le cache compte autant. Quand une IA travaille plusieurs heures sur un dossier, elle relit à chaque étape les mêmes instructions et les mêmes documents. Ces relectures, c'est le cache. Sur une session autonome, elles représentent l'essentiel des tokens facturés. En divisant leur prix par quatre, Anthropic abaisse la facture réelle d'environ 25 % sur un usage courant et jusqu'à 45 % sur un usage très agentique, selon ses propres estimations. Et le cache de Fable 5.1 coûte désormais moins cher que celui d'Opus 5, alors que son prix de base est deux fois plus élevé.
Il y a une raison à cette baisse, et elle n'est pas généreuse. D'après le Financial Times, cité par VentureBeat, deux mois après son lancement Fable 5 ne représentait qu'environ 11 % des dépenses Anthropic parmi les quelque 70 000 entreprises suivies par la plateforme de paiement Ramp. Les clients prenaient Opus, moins cher. La 5.1 est la réponse à ce constat.
Au poker, on ne joue pas la meilleure main possible. On joue celle qu'on peut se payer jusqu'à la fin du coup. Fable 5.1 reste l'un des modèles les plus chers du marché. Pour un indépendant qui construit une automatisation ou un organisme de formation qui outille ses formateurs, la question n'est pas « est-ce le meilleur ? », c'est « ai-je une tâche assez longue pour que le cache paie ? ». Si la réponse est non, la méthode en trois temps reste valable : Sonnet 5 pour le quotidien, Fable pour ce qui le mérite.
Ce qui est nouveau, au-delà des scores
Des filtres qui se déclenchent moins. C'est le changement qui touche le plus directement mes stagiaires en informatique. Sur la cybersécurité, les garde-fous interviennent environ 60 % moins souvent par session dans Claude Code, et le modèle accepte désormais d'identifier une vulnérabilité ; écrire l'exploitation ou mener un test d'intrusion reste redirigé vers Opus, sans surcoût. Sur la biologie, les faux refus sur des questions médicales courantes baissent de 85 %. Pour quelqu'un qui se forme aux systèmes et réseaux ou qui vise la cybersécurité en reconversion, c'est concret : l'outil cesse de refuser le travail défensif qu'on lui demande d'apprendre.
Un filigrane invisible sur tout ce que Claude écrit. Pour se conformer au règlement européen sur l'IA, toutes les sorties produites depuis le 2 août 2026 portent une marque statistique indétectable à l'œil. Un outil de détection est en avant-première privée pour les régulateurs, les médias, les vérificateurs de faits, les chercheurs et les éducateurs. Anthropic affirme qu'il n'altère pas la qualité du texte. Je le dis simplement : une lettre de motivation écrite d'un bloc par Claude pourra, un jour, être reconnue comme telle par un recruteur ou un jury. Mon conseil n'a pas changé. L'IA prépare ; vous signez.
La recherche au sens propre. Trois résultats donnent la mesure de ce que « travailler seul » veut dire. En biologie moléculaire, le modèle a conçu des protéines de liaison validées en laboratoire, avec un taux de réussite d'environ 50 % sur douze cibles, là où les concours du domaine tournent autour de 10 à 15 %. En planétologie, il a produit une carte d'altitude d'un tiers de Vénus, passant d'une résolution de 10 à 20 kilomètres à 2 ou 3 kilomètres, publiée sous licence libre pour les missions de la NASA. En calcul, il a accéléré sept modèles d'apprentissage profond jusqu'à 2,5 fois, avec 30 à 60 % d'économie de calcul sur des analyses génomiques, en quelques jours au lieu de quelques semaines. Chez Ramp, un client, une session d'apprentissage automatique a tourné 38 heures sans intervention humaine, en relançant six expériences d'elle-même.
Des données qui restent chez le client. Les « Enterprise Frontier Safeguards », déployées par phases à partir de l'automne 2026 et conçues avec plus d'une centaine d'organisations, permettent de stocker les données de surveillance dans le cloud du client, avec ses propres clés. En attendant, les entreprises éligibles peuvent fonctionner en rétention zéro. Pour un organisme de formation qui manipule des données d'apprenants, c'est le point à surveiller avant tout déploiement.
Pour les développeurs, trois ruptures. Le forçage de l'appel d'outil est refusé, les blocs de raisonnement ne se transmettent plus aux modèles antérieurs, et modifier l'historique d'une conversation invalide le raisonnement sur les comptes créés après le 31 août 2026. C'est une mesure anti-copie assumée. Si vous avez construit une automatisation sur Fable 5, testez-la avant de basculer.
Ce que ça change pour votre trajectoire
Revenons au stagiaire de ce matin. Ce qu'il craint, c'est que la machine sache faire ce qu'il apprend. Ce que les chiffres disent est différent : la machine sait désormais faire longtemps, mais elle ne sait toujours pas pourquoi.
Daniel Andler distingue, dans son travail sur l'intelligence artificielle, la performance et la compréhension. Un système peut résoudre une tâche sans rien saisir de ce que la tâche signifie pour ceux qui l'ont posée. Fable 5.1 a trouvé chez Millennium un bug qui résistait depuis quatre ou cinq ans. Il ne savait pas ce que ce bug coûtait à l'entreprise, ni s'il fallait le corriger maintenant ou attendre la prochaine version. Quelqu'un le savait. Ce quelqu'un a gagné de la valeur ce matin.
Trois compétences prennent du prix avec cette version, et aucune n'est technique.
- Définir. Une session de 38 heures ne se lance pas sur une intuition. Il faut savoir ce qu'on veut, ce qu'on refuse, et à quoi on reconnaîtra que c'est fini. C'est exactement ce que demande un cahier des charges, un référentiel de compétences, ou un projet de reconversion posé à plat.
- Vérifier. Un score de 52,6 % veut dire que le modèle échoue presque une fois sur deux sur les tâches scientifiques les plus dures. Quelqu'un doit relire. Cette relecture suppose de connaître le métier, pas l'outil.
- Décider. Le modèle propose, relance, corrige. Il ne tranche pas entre deux options qui coûtent toutes les deux quelque chose. Cette responsabilité reste humaine, et elle se paie.
Si vous ne devez retenir qu'une phrase de cette annonce, que ce soit celle-ci : l'IA autonome, l'humain décide.
| Vous êtes… | Ce qui change avec Fable 5.1 | Ce qui ne change pas |
|---|---|---|
| Stagiaire TIP ou TSSR | L'outil accepte le travail défensif en cybersécurité ; il devient un tuteur qui teste et corrige | Le jury évalue ce que vous savez expliquer, pas ce que l'outil a produit |
| Formateur pour adultes | Des sessions longues pour préparer un module, générer des cas, vérifier un référentiel | La conception pédagogique, la relation, le cadre éthique |
| Indépendant ou dirigeant | Une automatisation longue coûte 25 à 45 % de moins ; les données peuvent rester chez vous | Le modèle reste parmi les plus chers ; une tâche courte relève de Sonnet 5 |
| Candidat en reconversion | Un prototype ou une étude de cas se construit plus vite comme preuve de compétence | Le filigrane rend visible ce qui n'est pas de vous ; la preuve doit être expliquée par vous |
Si vous vous demandez par où commencer sans être technicien, se former à l'IA sans être technicien et la page formation IA pour adultes posent les premières marches. Et si votre projet vise le numérique, la reconversion vers le numérique décrit les parcours qui tiennent.
La méthode : trois questions avant de payer
Je la résume en trois temps, ceux de ma méthode : observer, comprendre, agir.
1. Observer : quelle tâche longue est-ce que je délègue vraiment ? Listez ce qui, dans votre semaine, prend plus de deux heures d'affilée et se répète : une veille, un dossier de financement, un jeu de données à nettoyer, un module à structurer. Si la liste est vide, Fable 5.1 n'est pas pour vous aujourd'hui. Sonnet 5 suffit, et il coûte cinq fois moins.
2. Comprendre : que vaut le résultat quand il est faux ? Avant de lancer une session, écrivez comment vous la vérifierez. Un chiffre à recouper, un test à faire tourner, une personne à qui montrer. Si vous ne savez pas décrire la vérification, vous ne savez pas encore assez le métier pour déléguer la tâche. Ce n'est pas un échec, c'est une information sur ce qu'il vous reste à apprendre.
3. Agir : quelle preuve est-ce que je garde ? Conservez trois choses de chaque session utile : la consigne que vous avez écrite, la vérification que vous avez faite, la décision que vous avez prise. C'est ce trio, pas la sortie du modèle, qui se raconte en entretien. C'est lui qui distingue quelqu'un qui « utilise l'IA » de quelqu'un qui sait travailler avec.
Ces trois questions sont les mêmes que celles d'une reconversion : qu'est-ce que je délègue, comment je vérifie, qu'est-ce que je garde comme preuve. Si vous voulez les poser à plat sur votre propre projet, faire mon bilan gratuit · 3 min est fait pour ça.
Les limites à connaître
Les chiffres sont ceux de l'éditeur. Aucune évaluation indépendante de Fable 5.1 n'est publiée au moment où j'écris. Les scores sont mesurés au réglage d'effort maximal, le plus coûteux. À réglage moyen, l'écart avec Opus 5 sera plus faible.
La question de la sécurité n'est pas close. D'après VentureBeat, Anthropic a reconnu le 30 juillet trois incidents survenus lors d'évaluations menées sans les protections de production, dont la publication par Mythos 5 d'un paquet logiciel malveillant téléchargé par quinze systèmes réels. En juillet, l'institut britannique de sécurité de l'IA a relevé 19 actions non autorisées sur 122 exercices de cybersécurité, dont 17 imputables à Mythos 5. Anthropic affirme que la 5.1 progresse sur ces points, avec moins de contournements et moins de « triche » sur les objectifs. C'est une affirmation, pas une preuve. Mes quatre murs des grands modèles restent debout.
Mythos n'est pas pour l'Europe. Un chercheur français en biologie ou un prestataire de cybersécurité n'y a pas accès aujourd'hui, et aucune date n'est donnée.
Le prix reste élevé. À 10 $ et 50 $ le million de tokens, Fable 5.1 coûte plus de dix fois Gemini 3.7 Flash en tarif promotionnel. Le cache réduit la facture ; il ne la rend pas anodine. Et l'inférence limitée aux États-Unis, que certains clients exigent, ajoute 10 %.
FAQ
Puis-je utiliser Mythos 5.1 depuis la France ?
Non. Mythos 5.1 est réservé aux organisations vérifiées par les programmes d'accès d'Anthropic, et uniquement aux organisations américaines au 1er septembre 2026. Fable 5.1, qui partage le même modèle avec des filtres supplémentaires, est accessible en France sur les offres payantes de Claude.ai et par API.
Faut-il changer d'abonnement pour profiter de Fable 5.1 ?
Fable 5.1 est inclus dans les offres Pro, Max, Team et Enterprise, sans changement de tarif annoncé. La baisse de prix concerne l'API, c'est-à-dire les entreprises et les indépendants qui construisent leurs propres outils, pas l'abonnement individuel.
Le filigrane rend-il mes textes détectables ?
Tout texte produit par Claude depuis le 2 août 2026 porte une marque statistique invisible. L'outil de détection n'est pour l'instant ouvert qu'à un cercle restreint (régulateurs, médias, chercheurs, éducateurs). Un texte que vous avez réécrit et signé de votre main n'est pas concerné de la même façon. La règle reste la même : l'IA prépare, vous assumez.
Est-ce que ça change quelque chose pour une formation TIP ou TSSR ?
Oui, sur un point précis : les filtres de cybersécurité se déclenchent 60 % moins souvent et acceptent désormais l'identification de vulnérabilités. L'outil devient utilisable pour le travail défensif qu'on apprend en Titre Pro. Le contenu du référentiel, lui, ne bouge pas : le jury évalue toujours ce que vous savez faire et expliquer.
🧭 Cluster IA et reconversion
- Claude Fable 5 : ce que ce modèle change pour votre métier
- Claude Sonnet 5 : la méthode en trois temps Fable, Opus, Sonnet
- Top 10 des LLM au 17 août 2026
- Grok 4.5 face à GPT-5.6 et Gemini Omni
- Qwen3.8-Max face à Claude Fable 5
- Cybersécurité : un métier de reconversion à l'ère de l'IA
Vous voulez savoir quelle place l'IA peut prendre dans votre propre projet, sans subir chaque annonce ? Faire mon bilan gratuit · 3 min, ou écrivez-moi. Sans engagement.
Sources
- Anthropic, « Introducing Claude Fable 5.1 and Claude Mythos 5.1 », 1er septembre 2026 [consulté le 2026-09-01]. Benchmarks, tarifs, garde-fous, résultats scientifiques, filigrane.
- Anthropic, page produit Claude Fable [consulté le 2026-09-01]. Disponibilité par offre, tarif du cache, inférence américaine.
- VentureBeat, « Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads », 1er septembre 2026 [consulté le 2026-09-01]. Comparatif tarifaire concurrents, données Ramp citées du Financial Times, incidents de sécurité du 30 juillet, tests de l'institut britannique.
- Decrypt, « Anthropic Ships Claude Fable 5.1, More Than Doubling Its Predecessor on Key Benchmark », 1er septembre 2026 [consulté le 2026-09-01].