Anthropic présente Claude Fable et Mythos 5.1, mais fait face à des défis techniques.

Claude Fable et Mythos 5.1 : Anthropic dévoile ses modèles les plus puissants, mais marche sur des œufs

Avec ses nouveaux modèles Fable 5.1 et Mythos 5.1, Anthropic revendique un nouveau palier de performance, mais déploie en parallèle tout un arsenal de contrôles.

Juin 2026 : Fable 5 et Mythos 5 connaissaient une sortie grand public chaotique, après avoir été suspendus sous ordre de Washington.

Moins de trois mois plus tard, Anthropic relance sa gamme « frontière » (comprenez ses modèles les plus avancés) avec une version 5.1.

Sur le papier, l’entreprise vante des gains de performance en codage agentique et en recherche scientifique, ainsi que des coûts plus réduits comparés à ses prédécesseurs.

Mais dans le communiqué d’annonce publié le 1er septembre 2026, l’architecture de sécurité prend une place majeure : garde-fous cyber recalibrés, mécanismes anti-distillation renforcés, programmes d’accès filtrés par le gouvernement américain et nouvelle solution de conservation des données pour les entreprises.

Des garde-fous cyber recalibrés

Sur le volet cybersécurité, Anthropic assume un changement de curseur avec Fable 5.1.

Le modèle peut désormais être utilisé pour identifier des vulnérabilités logicielles, une capacité auparavant bloquée. L’entreprise as également avoir réduit de 60 % les blocages de ses systèmes de protection sur Claude Code, grâce à une meilleure précision dans la détection des faux positifs.

Dans le même temps, Anthropic tente de tracer plus explicitement la ligne entre défense et attaque : le pentest, la génération d’exploits et le scan de vulnérabilités binaires continuent d’être redirigés vers des modèles Opus, jugés moins performants et donc moins risqués. Autrement dit, Fable 5.1 peut chercher des failles, mais ne peut pas les exploiter.

Anthropic a également fait tester la robustesse de ces garde-fous par deux organisations externes, en plus de tests automatisés. Aucune preuve d’un jailbreak critique n’aurait été trouvée.

La guerre anti-distillation

Dans son communiqué, Anthropic aborde le renforcement de ses mécanismes anti-distillation, une technique consistant à extraire les capacités d’un modèle avancé pour les reproduire ailleurs sans les garde-fous d’origine.

En juin 2026, l’entreprise avait accusé le géant chinois Alibaba d’avoir mené « la plus grande campagne » de distillation de Claude jamais recensée, via près de 29 millions d’échanges.

Avec Fable 5.1, les nouveaux comptes API perdent une possibilité technique facilitant ce type d’entraînement. Jusqu’ici, il était possible de modifier manuellement les messages précédents d’une conversation tout en conservant intact le raisonnement interne généré par Claude.

Ce changement sera déployé progressivement. Les comptes existants ne seront pas concernés dans l’immédiat, mais ils le seront avec les futurs modèles.

Mythos 5.1, sous surveillance rapprochée de Washington

Pour Mythos 5.1, l’implication du gouvernement américain est particulièrement visible, mentionnée à trois reprises dans le communiqué.

Son accès est réservé aux organisations et individus préalablement vérifiés, dans le cadre de deux programmes : le Cyber Verification Program et le Life Sciences Verification Program (LSVP).

Anthropic précise que le LSVP a été « développé en partenariat avec le gouvernement américain » et que ses premiers participants ont été inscrits « en coordination avec les autorités ».

Mythos 5.1 reste pour l’instant réservé à un ensemble d’organisations américaines, mais Anthropic souhaite l’ouvrir « aussi vite que possible » à des partenaires nationaux et internationaux, en coordination avec le gouvernement américain.

Côté gouvernance, Anthropic a annoncé Enterprise Frontier Safeguards (EFS), un dispositif qui stocke les données de trafic sur l’infrastructure cloud du client pour concilier détection des abus et exigences de confidentialité. Ce dispositif sera disponible à la fin de l’automne.

Source : Anthropic.

Source

Comments

No comments yet. Why don’t you start the discussion?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *