Anthropic a annoncé la mise à disposition des modèles Claude Fable 5.1 et Claude Mythos 5.1, en mettant l’accent sur la programmation, les tâches riches en informations et la résolution de problèmes de longue durée. Les deux modèles utilisent la même architecture de base, mais Mythos 5.1 est assorti de restrictions de sécurité plus souples et n’est accessible qu’aux utilisateurs et aux organisations vérifiés dans les domaines de la cybersécurité et des sciences de la vie.
Fable 5.1 vise l’usage général, tandis que Mythos 5.1 représente la version destinée aux activités spécialisées qui peuvent nécessiter un éventail plus large de tests ou d’opérations techniques. Anthropic affirme que le nouveau modèle conserve les mêmes tarifs pour les jetons d’entrée et de sortie que Fable 5, soit 10 dollars par million de jetons d’entrée et 50 dollars par million de jetons de sortie via l’API. En revanche, l’entreprise a réduit de 75 % le prix de lecture des jetons depuis le cache, à 0,25 dollar par million de jetons.
Réduction du coût des tâches agentiques
Selon Anthropic, ces changements permettent aux utilisateurs d’économiser environ 25 % sur les charges de travail habituelles par rapport à Fable 5, et les économies peuvent atteindre près de 45 % pour les tâches agentiques impliquant de nombreux appels d’outils et de longs contextes. L’entreprise affirme que Fable 5.1 peut, avec des niveaux faibles ou moyens de puissance de calcul, obtenir des performances comparables ou supérieures à celles de Fable 5. Par défaut, le modèle fonctionne à un niveau élevé dans Claude Code et à un niveau moyen dans Claude Cowork et Claude.ai.
De meilleurs résultats en programmation et en recherche
Les tests présentés par Anthropic ont montré une nette amélioration dans certains domaines. Fable 5.1 a obtenu un score de 52,6 % au test Terminal-Bench-Science 0.1, contre 24,7 % pour Fable 5. Au test de programmation Terminal-Bench 4.0, Fable 5.1 a obtenu 55,8 %, tandis que Mythos 5.1 a atteint 60,9 %, contre environ 42 % pour Fable 5.
L’entreprise fournit des exemples de tâches de longue durée, notamment la détection par Fable 5.1 d’une erreur logicielle rare dans les systèmes de la société d’investissement Millennium, qui survenait environ une fois par million d’exécutions. Le modèle a également utilisé des images radar recueillies par la mission Magellan de la NASA pour créer une carte altimétrique haute résolution couvrant environ un tiers de la planète Vénus. Dans le domaine de la biologie computationnelle, Mythos 5.1 a contribué à optimiser les unités de traitement graphique de sept modèles open source d’apprentissage profond, en accélérant certains modèles jusqu’à 2,5 fois.
De nouvelles restrictions pour lutter contre la distillation des modèles
Fable 5.1 intègre des mécanismes de lutte contre la distillation des modèles, un processus consistant à collecter à grande échelle les sorties d’un modèle avancé afin d’entraîner un autre modèle. Anthropic affirme que ces opérations peuvent s’appuyer sur des milliers de faux comptes pour transférer les capacités de modèles avancés vers des systèmes qui n’appliquent pas les mêmes contrôles de sécurité.
Dans le cadre de ce changement, les nouveaux comptes Claude API ne permettront plus à l’utilisateur de modifier manuellement le contexte de conversation précédent tout en conservant les traces de raisonnement antérieures du modèle dans une conversation à plusieurs tours. Anthropic affirme que cette mesure ferme l’une des méthodes de distillation de modèles documentées publiquement. L’entreprise avait précédemment annoncé avoir découvert des opérations impliquant environ 24 000 faux comptes et plus de 1,6 million d’interactions avec Claude, qu’elle avait associées à DeepSeek, Moonshot AI et MiniMax. La nouvelle restriction s’applique actuellement uniquement aux nouveaux comptes, avec la possibilité de l’étendre à tous les comptes dans de futures versions.
Qu’est-ce qui change en pratique ?
La principale valeur de l’annonce ne réside pas uniquement dans les noms des deux modèles, mais dans la combinaison d’une baisse du coût d’utilisation agentique et d’un contrôle accru de la manière d’accéder au contexte précédent. Cela pourrait profiter aux développeurs qui gèrent de nombreuses tâches longues nécessitant de multiples appels, mais ajoute en même temps une restriction à certaines méthodes de test ou de gestion des conversations via l’API. En outre, les résultats de performance fournis sont des chiffres présentés par Anthropic elle-même ; le texte ne précise donc pas dans quelle mesure ils sont comparables en dehors des tests mentionnés.
Fable 5.1 est disponible via la plateforme Claude ainsi que les services d’Amazon Web Services, de Google Cloud et de Microsoft Azure, et par l’intermédiaire de Claude API sous l’identifiant claude-fable-5-1. Mythos 5.1 est quant à lui réservé aux utilisateurs de la cybersécurité et des sciences de la vie qui réussissent le Cyber Verification Program ou le Life Sciences Verification Program. Le programme consacré aux sciences de la vie a été développé en collaboration avec le gouvernement américain, tandis que le produit Claude Security, destiné à examiner les dépôts de code à la recherche de vulnérabilités, est désormais pris en charge par Mythos 5.1.