Modèles d’IA

Anthropic présente Claude Fable 5.1 et Mythos 5.1 en accès restreint

Anthropic lance Claude Fable 5.1 et Claude Mythos 5.1 pour le code, le travail de connaissance et la recherche scientifique, avec nouveaux prix et garde-fous.

Publié Mis à jour
AnthropicClaudeModèles d’IA

Anthropic a présenté le 1er septembre Claude Fable 5.1 et Claude Mythos 5.1, en les décrivant comme une mise à niveau majeure pour le code, le travail de connaissance, les tâches agentiques longues et la recherche scientifique. Les deux versions reposent sur le même modèle sous-jacent, mais elles sont distribuées avec des niveaux de garde-fous différents. Fable 5.1 est disponible de manière générale, tandis que Mythos 5.1 est limité à des programmes d’accès de confiance, avec des protections conçues pour la cybersécurité avancée et les sciences de la vie.

L’annonce combine performance, prix et sécurité. Anthropic indique que Fable 5.1 coûtera environ 25% de moins que Fable 5 pour les charges typiques facturées au token, grâce à la baisse du prix des lectures en cache. Pour les travaux très agentiques, les économies peuvent souvent atteindre environ 45%. Cette évolution compte parce que les modèles de frontière sont de plus en plus utilisés pour des tâches longues qui lisent de grands dépôts de code, documents et sorties d’outils sur de nombreux tours. Des coûts de cache plus bas peuvent faire passer un modèle de frontière du rôle de relecteur final à celui de système principal qui mène le travail de la recherche à l’implémentation.

Anthropic présente aussi Fable 5.1 comme un progrès de performance. L’entreprise rapporte de meilleurs résultats que Fable 5 sur des benchmarks comme Terminal-Bench-Science, Terminal-Bench, Humanity’s Last Exam, OSWorld, AutomationBench et CursorBench. Elle cite également des retours de partenaires en accès anticipé tels que Jane Street, Cognition, Millennium, MongoDB, Red Hat, Rakuten, Block, Ramp, Canva, Hebbia et Plaid. Les exemples mettent l’accent sur le comportement pratique des agents: trouver la cause de pannes logicielles rares, construire des prototypes sur plusieurs jours, relire des changements de code complexes et identifier de nouvelles pistes de recherche. Le message n’est pas seulement que le modèle obtient de meilleurs scores, mais qu’il soutient mieux les travaux longs avec raisonnement, communication et suivi.

La dimension scientifique de la sortie est particulièrement notable. Anthropic indique que le modèle a contribué à des tâches de conception de liants protéiques, d’analyse computationnelle et d’optimisation de modèles biologiques. Dans un exemple, Claude Fable 5.1 a entraîné un réseau neuronal pour créer une carte d’altitude plus haute résolution d’environ un tiers de Vénus à partir d’images radar de la mission Magellan de la NASA et de cartes existantes. Selon Anthropic, la nouvelle carte améliore le détail de 10 à 20 kilomètres à deux ou trois kilomètres et estime les hauteurs jusqu’à 25% plus précisément. En biologie computationnelle, Mythos 5.1 aurait accéléré sept modèles open source de deep learning jusqu’à 2,5 fois grâce à des kernels GPU personnalisés et à la mise en cache de résultats intermédiaires, réduisant les coûts GPU estimés de certaines analyses génomiques de 30 à 60%.

Ces capacités s’accompagnent de contrôles plus stricts. Anthropic affirme que Mythos 5.1 possède les capacités cyber les plus fortes parmi les modèles qu’elle a publiés, tout en restant dans une catégorie de risque inférieure de son Frontier Compliance Framework. L’entreprise décrit aussi des tests sur les risques chimiques et biologiques, la résistance aux injections de prompt et le comportement d’alignement. Mythos 5.1 conservera des garde-fous limitant l’accès aux capacités de biologie de recherche, et Anthropic dit avoir développé avec le gouvernement américain un programme d’accès pour les travaux biologiques avancés. Pour Fable 5.1, les garde-fous cyber deviennent plus précis: ils permettent l’identification défensive de vulnérabilités, tout en redirigeant vers Opus les tâches duales plus risquées comme la génération d’exploits et les tests d’intrusion.

Le lancement est également lié à Enterprise Frontier Safeguards, la nouvelle approche d’Anthropic pour offrir aux entreprises une surveillance renforcée et une confidentialité proche du zéro stockage de données. Les clients éligibles pourront utiliser Fable 5.1 et Fable 5 avec zéro rétention jusqu’au déploiement progressif d’EFS cet automne. Au total, cette sortie montre que les entreprises de modèles de frontière associent désormais capacité, coût et gouvernance dans une même décision produit. Fable 5.1 vise à rendre le travail agentique avancé moins coûteux et plus utile; Mythos 5.1 montre que les capacités les plus sensibles seront de plus en plus distribuées par accès contrôlé plutôt que par publication large.