Actualité · Modèles IA
Claude Fable 5.1 et Mythos 5.1 : Anthropic sort son modèle le plus puissant, avec des garde-fous précis et un prix en baisse
1 septembre 2026 · 6 min de lecture

Anthropic a sorti Claude Fable 5.1 et Claude Mythos 5.1 le 1er septembre 2026. C'est le même modèle, avec deux niveaux de garde-fous différents. Fable 5.1 est en accès général pour les utilisateurs Pro, Max, Team et Enterprise, ainsi que via l'API. Mythos 5.1 est réservé à un petit ensemble d'organisations vérifiées en cybersécurité et en biologie, via les programmes d'accès de confiance d'Anthropic.
La mise à jour apporte trois choses : des performances en hausse sur le code, les tâches agentiques et le raisonnement ; des garde-fous plus précis qui laissent passer plus de requêtes légitimes ; et une baisse de prix via le cache. Anthropic a aussi publié une system card qui documente les tests de sécurité.
Deux modèles, un seul moteur
Fable 5.1 et Mythos 5.1 partagent le même modèle sous-jacent. La différence : les garde-fous. Fable 5.1 bloque ou limite les réponses dans deux domaines, la cybersécurité et la biologie. Mythos 5.1 a des garde-fous réduits, conçus pour des organisations qui ont un usage légitime dans ces domaines.
Pour la cybersécurité, Fable 5.1 peut identifier des vulnérabilités dans du code source, ce que Fable 5 ne pouvait pas faire. Il ne peut pas développer des exploits, faire du penetration testing ni scanner des binaires. Les garde-fous cyber de Fable 5.1 génèrent 60% de faux positifs en moins que ceux de Fable 5.
Pour la biologie, les garde-fous de Fable 5.1 interviennent 85% moins souvent que ceux de Fable 5. Les requêtes en biologie et chimie sont routées vers les modèles Opus quand Fable 5.1 ne peut pas y répondre.
Mythos 5.1 est accessible via deux programmes : le Life Sciences Verification Program (beta sur invitation) et le Cyber Verification Program, qui incluera l'accès aux modèles Mythos dans le futur proche. Claude Security, le produit de cybersécurité d'Anthropic, tourne maintenant sur Mythos 5.1.
Ce que ça coûte
Le prix de base ne change pas : 10 dollars par million de tokens en entrée, 50 dollars en sortie. La baisse de coût vient du cache.
Les lectures de cache passent de 1 dollar (Fable 5) à 0,25 dollar par million de tokens, soit 75% moins cher. Anthropic estime que ça réduit le coût des workloads typiques de 25%, et des workloads agentiques (qui réutilisent beaucoup de contexte) de 45%.
Pour les workloads qui doivent tourner aux États-Unis, l'inference US-only est disponible à 1.1x le prix de base.
Un nouveau système appelé Enterprise Frontier Safeguards (EFS) permet aux clients enterprise de stocker les données dans leur propre infrastructure cloud, sans rétention côté Anthropic. EFS sera déployé par phases à partir de l'automne 2026. En attendant, les clients éligibles peuvent utiliser Fable 5.1 avec zéro rétention de données.
Les benchmarks
Anthropic publie les résultats de Fable 5.1 avec ses garde-fous de production activés. Sur les tâches où les garde-fous interviennent, Fable 5.1 et Fable 5 scorzéro sur OSWorld 2.0, et Fable 5 scorzéro sur AutomationBench. Les tâches cyber sont traitées par Opus 4.8, les tâches bio par Opus 5, en fallback.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| Terminal-Bench 4.0 | 55,8% | 60,9% (Mythos 5.1) | 42,0% | 52,3% |
| OSWorld 2.0 (partial) | 77,9% | 72,9% | 75,4% | n/a |
| Humanity's Last Exam (sans tools) | 60,9% | 57,8% | 56,6% | n/a |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
Le saut le plus visible est sur Terminal-Bench-Science 0.1 : Fable 5.1 passe de 24,7% (Fable 5) à 52,6%. C'est un benchmark de recherche scientifique agentique, où le modèle doit enchaîner des étapes, utiliser des outils et raisonner sur des résultats. Fable 5.1 fait plus que doubler le score de Fable 5.
Sur Terminal-Bench 4.0 (le benchmark de code agentique), Mythos 5.1 sans garde-fous score 60,9%, contre 55,8% pour Fable 5.1 avec garde-fous. L'écart mesure le coût des garde-fous sur les tâches de code : 5 points.
AutomationBench, qui mesure les workflows business, passe de 17,1% à 31,4%. Près du double.
Anthropic précise que Fable 5.1 peut être réglé sur Low, Medium ou High effort. Sur Low ou Medium, Fable 5.1 atteint des performances similaires ou supérieures à Fable 5, pour un coût bien inférieur. Par défaut, Fable 5.1 tourne sur High effort dans Claude Code et sur Medium dans Claude Cowork et sur Claude.ai.
Ce que les clients en disent
Millennium, le fonds d'investissement, a utilisé Fable 5.1 en accès anticipé pour investiguer un crash dans ses systèmes internes. Le crash se produisait environ une fois sur un million d'exécutions. Aucun ingénieur ni aucun modèle (dont Fable 5) n'avait réussi à l'expliquer après plusieurs années. Fable 5.1 a désassemblé une librairie externe d'un vendor, a matché le résultat avec le core dump, et a tracé le crash jusqu'à un bug dans cette librairie.
Jane Street Capital rapporte que Fable 5.1 résout plus de problèmes de code que Fable 5 ou Opus 5 dans leurs benchmarks internes, et atteint l'état de l'art sur la "trading intuition". Ils notent aussi que les sorties de Fable 5.1 restent lisibles sur les longues tâches multi-étapes, là où les modèles précédents devenaient difficiles à suivre.
Les découvertes scientifiques
Anthropic a testé les capacités de recherche scientifique de Fable 5.1 et Mythos 5.1 sur plusieurs domaines. Deux résultats sortent du lot.
Conception de molécules. Mythos 5.1 a conçu des binders protéiques pour trois cibles. Son affinité de liaison était 10 fois supérieure aux meilleurs designs soumis aux compétitions de design protéique d'Adaptyv Bio. Son taux de réussite (le nombre de designs qui sont des binders viables) a atteint près de 50% sur 12 cibles. Les taux habituels en design protéique aujourd'hui se situent entre 10 et 15%.
Cartographie de Vénus. Fable 5.1 a entraîné un réseau de neurones pour créer une carte d'élévation d'un tiers de la planète Vénus, à partir des images radar de la mission Magellan de la NASA (il y a plus de 30 ans) et d'une carte existante pour un cinquième de la planète. La nouvelle carte révèle des détails jusqu'à 2-3 km, au lieu de 10-20 km, et montre des hauteurs jusqu'à 25% plus précises. Anthropic a publié la carte sur Zenodo sous licence Creative Commons.
Comment la sortie a fuité
Le 31 août, un développeur connu sous le pseudo Leo (@synthwavedd) a testé le slug claude-fable-5-1 sur l'API Amazon Bedrock. Il a reçu une erreur 404 ("Model not found") au lieu de l'erreur 400 ("The provided model identifier is invalid") renvoyée par les slugs inexistants. La différence était subtile mais technique : une 404 peut indiquer que le service reconnaît le format du modèle mais ne le rend pas encore disponible, tandis qu'une 400 signifie que l'identifiant n'est pas valide du tout. Anthropic a confirmé la sortie le lendemain, 1er septembre.
Un exemple chez Maisons&Mobilia
Pierre, dev chez Maisons&Mobilia (M&M, enseigne de meubles fictive), fait tourner un agent IA qui génère des tests unitaires et fait de la revue de code sur le codebase de l'équipe. L'agent tourne toute la journée, avec un contexte de 50 000 tokens en entrée et 5 000 tokens en sortie par appel, 100 appels par jour.
Sur Fable 5, le coût en cache reads était de 5 dollars par million de tokens. Pierre paie 100 x 50 000 = 5 millions de tokens d'entrée par jour, dont la majorité est en cache après le premier appel. Le cache coûtait 5 dollars par million, soit environ 25 dollars par jour. Plus 100 x 5 000 = 500 000 tokens de sortie à 50 dollars le million, soit 25 dollars. Total : 50 dollars par jour, 1 500 dollars par mois.
Sur Fable 5.1, le cache passe à 0,25 dollar par million. Le coût de cache tombe à 1,25 dollar par jour. Les tokens de sortie restent à 25 dollars par jour. Total : 26,25 dollars par jour, 787 dollars par mois. L'économie est de 45%, parce que le workload est agentique et réutilise beaucoup de contexte en cache.
La limite : les garde-fous cyber de Fable 5.1 permettent d'identifier des vulnérabilités dans le code source, ce qui est utile pour Pierre. Mais ils bloquent le penetration testing et la génération d'exploits. Si l'équipe de M&M veut faire de l'offensif, il faut passer par Opus 4.8 en fallback ou demander l'accès à Mythos 5.1 via le Cyber Verification Program.
Ce que ça change si tu apprends l'IA
Trois notions à retenir de cette sortie.
-
Garde-fous et capacités : un modèle peut être plus puissant et plus sûr en même temps. Fable 5.1 a des capacités supérieures à Fable 5, et ses garde-fous interviennent moins souvent. C'est possible parce qu'Anthropic a affiné les garde-fous pour qu'ils distinguent mieux les usages légitimes des usages risqués. Comprendre ce compromis, c'est comprendre pourquoi les labos parlent de "safety" comme un travail d'ingénierie, pas comme une limite arbitraire.
-
Cache et coût : le cache est ce qui rend l'agentique abordable. Un agent qui réutilise le même contexte sur des centaines d'appels paie le traitement de ce contexte une fois, puis paie la lecture du cache pour les suivants. Le cache à 0,25 dollar par million (au lieu de 1 dollar sur Fable 5) est ce qui réduit le coût des workloads agentiques de 45%. C'est un levier que tu dois connaître si tu calcule le coût d'un agent.
-
Fable vs Mythos : le même modèle peut servir des usages très différents selon les garde-fous. Fable 5.1 est un modèle grand public qui peut coder, raisonner et faire de la recherche. Mythos 5.1 est le même modèle avec moins de restrictions, pour des organisations qui ont un usage légitime en cybersécurité ou en biologie. La distinction n'est pas technique, elle est politique et réglementaire. Comprendre pourquoi Anthropic sépare les deux, c'est comprendre comment les labos gèrent le risque de dual-use.
La compétence pratique : savoir lire un tableau de benchmarks et identifier lequel est pertinent pour ton usage. Si tu fais du code, regarde Terminal-Bench et CursorBench. Si tu fais de l'automatisation business, regarde AutomationBench. Si tu fais de la recherche scientifique, regarde Terminal-Bench-Science. Le score global ne dit rien sur ta tâche spécifique.
Aller plus loin
Pour comprendre comment un agent IA utilise des outils et enchaîne des étapes, notre article sur comment fonctionne un agent IA pose les bases du tool use et de l'orchestration. Pour voir les garde-fous à mettre en place quand un agent accède à tes données, le guide sur les garde-fous des agents IA détaille le moindre privilège et le human in the loop. Et pour t'entraîner à ces notions en 5 minutes par jour, l'app saisir.ai propose des modules interactifs sur les agents, les garde-fous et le tool use, en français, sans coder.
Sources
- Anthropic, "Introducing Claude Fable 5.1 and Claude Mythos 5.1", 1er septembre 2026
- Anthropic, "Claude Fable 5.1 model page", septembre 2026
- Anthropic, "Claude Mythos 5.1 model page", septembre 2026
- Anthropic, "Claude Fable 5.1 and Mythos 5.1 System Card", septembre 2026
- Anthropic, "Improving Fable 5's biology safeguards", 6 août 2026
- RuntimeWire, "Anthropic launches Claude Fable 5.1 after Bedrock exposed its model slug", 1er septembre 2026
Questions fréquentes
- C'est quoi la différence entre Claude Fable 5.1 et Claude Mythos 5.1 ?
- Fable 5.1 et Mythos 5.1 sont le même modèle sous-jacent. La différence est dans les garde-fous. Fable 5.1 est en accès général (Pro, Max, Team, Enterprise, API) avec des garde-fous pour la cybersécurité et la biologie. Mythos 5.1 a des garde-fous réduits et est réservé à des organisations vérifiées dans la cybersécurité et les sciences du vivant, via les programmes d'accès confiance d'Anthropic.
- Combien coûte Claude Fable 5.1 ?
- Le prix est de 10 dollars par million de tokens en entrée et 50 dollars en sortie, identique à Fable 5. La baisse de coût vient du cache : les lectures de cache passent à 0,25 dollar par million de tokens, soit 75% moins cher que Fable 5. Anthropic estime une économie de 25% sur les workloads typiques et jusqu'à 45% sur les workloads agentiques.
- Est-ce que Fable 5.1 est meilleur que Fable 5 ?
- Oui, sur tous les benchmarks publiés par Anthropic. Terminal-Bench-Science 0.1 passe de 24,7% à 52,6%. AutomationBench de 17,1% à 31,4%. CursorBench 3.2.0 de 70,5% à 73,4%. Humanity's Last Exam de 57,8% à 60,9% sans tools. Fable 5.1 peut aussi être réglé sur Low ou Medium effort pour atteindre des performances similaires à Fable 5 à un coût bien inférieur.
- Qu'est-ce que le système Enterprise Frontier Safeguards (EFS) ?
- EFS est un nouveau système d'Anthropic qui permet aux clients enterprise de garder leurs données dans leur propre infrastructure cloud, sans rétention côté Anthropic, tout en maintenant des garde-fous de sécurité. Il sera déployé par phases à partir de l'automne 2026. En attendant, les clients éligibles peuvent utiliser Fable 5.1 avec zéro rétention de données.
- Quelles sont les découvertes scientifiques faites avec Mythos 5.1 ?
- Mythos 5.1 a conçu des binders protéiques avec une affinité 10 fois supérieure aux meilleurs designs soumis aux compétitions Adaptyv Bio, et un taux de réussite de près de 50% sur 12 cibles (la norme est de 10-15%). Fable 5.1 a aussi entraîné un réseau de neurones pour créer une carte d'élévation de Vénis à partir des données radar de la mission Magellan, passant d'une résolution de 10-20 km à 2-3 km. La carte est publiée sur Zenodo en licence Creative Commons.