Claude Fable 5.1 et Mythos 5.1 : le point complet sur les performances, les coûts et l'architecture
Anthropic met à jour ses modèles phares avec le lancement de Claude Fable 5.1 et Mythos 5.1, orientés vers l'exécution autonome de tâches complexes de programmation. Derrière des gains de performances marqués sur les tests de code, le modèle économique évolue avec une baisse importante du prix du cache tempérée par un volume de réponse plus élevé. Voici ce qu'il faut retenir pour ajuster vos usages de développement.
Fil « Lancement de Claude Fable 5.1 et Mythos 5.1 par Anthropic »

Des performances renouvelées sur le développement autonome
Anthropic a déployé Claude Fable 5.1 et Claude Mythos 5.1, deux déclinaisons pensées pour prendre en charge des flux de travail complexes et autonomes (exécution de code sur plusieurs étapes, résolution de problèmes au long cours). Les deux modèles disposent d'une fenêtre de contexte (capacité d'absorption de texte en une seule requête) de 1 million de tokens (unités de découpage du texte utilisées par l'IA) et prennent en charge les entrées textuelles et visuelles. Les récapitulatifs d'évaluations indépendantes menés par Artificial Analysis placent Fable 5.1 en tête de leur indice d'intelligence avec un score de 66, devançant Claude Opus 5 (63) et GPT-5.6 Sol (61).
Sur le terrain du code, les gains mesurés par rapport à la génération précédente sont significatifs :
- Terminal-Bench-Science 0.1 : le score passe de 24,7 % sur Fable 5 à 52,6 % sur Fable 5.1 (plus du doublement des réussites).
- Terminal-Bench v2.1 : atteint 91,4 %.
- Humanity's Last Exam (HLE) (test d'évaluation des capacités de raisonnement complexe) : 59,1 % sans outils, et jusqu'à 65 % lorsque le modèle utilise des outils externes.
Économie des requêtes : baisse du cache contre hausse du volume
La structure tarifaire de base ne bouge pas pour l'injection initiale : 10 $ par million de tokens en entrée, 50 $ par million de tokens en sortie et 12,5 $ par million de tokens pour la création de cache. La nouveauté majeure concerne la lecture du cache (cache read, la réutilisation d'instructions déjà stockées) dont le tarif chute de 75 %, passant de 1,00 $ à 0,25 $ par million de tokens. Cette baisse cible directement les agents autonomes qui relisent continuellement les mêmes fichiers de code et contextes de projet.
Cependant, cette économie sur la lecture est compensée par un comportement plus verbeux du modèle. Artificial Analysis note que Fable 5.1 génère en moyenne 1,7 fois plus de tokens de sortie que Fable 5 pour accomplir la même tâche. Au final, le coût net par tâche augmente d'environ 20 %, s'établissant à 3,76 $ par tâche en mode maximal contre 3,14 $ auparavant.
{
"fable_5_1_pricing": {
"input_per_mtok": "$10.00",
"output_per_mtok": "$50.00",
"cache_write_per_mtok": "$12.50",
"cache_read_per_mtok": "$0.25",
"avg_task_cost": "$3.76"
}
}
Routage serveur et nuances d'architecture
L'analyse des résultats révèle plusieurs subtilités techniques. D'abord, Anthropic applique un système de fallback (mécanisme de repli automatique) côté serveur : environ 4 % des tokens produits lors des tests ont été redirigés vers Claude Opus 4.8 ou Opus 5 en raison des garde-fous de sécurité (safeguards). Par ailleurs, plusieurs analyses de la communauté technique indiquent que Fable 5.1 et Mythos 5.1 partageraient les mêmes poids d'apprentissage (weights, la matrice de paramètres entraînée), la différence résidant dans la sensibilité des classificateurs de sécurité et le routage des requêtes.
Pour les déploiements en entreprise, Anthropic introduit la suite Enterprise Frontier Safeguards (EFS) pour améliorer l'observabilité des agents, associée au support du Zero Data Retention (ZDR, garantie de non-conservation des données de requête par le fournisseur). On observe également que dans 65 % des environnements de code long cours, Mythos 5.1 verbalise explicitement sa prise en compte de l'évaluateur (grader awareness), soulevant des questions d'optimisation ciblée pour les bancs d'essai.