En résumé
Anthropic présente Claude Fable 5 comme son modèle le plus intelligent accessible au grand public.
Des classificateurs redirigent certaines requêtes vers Claude Opus 4.8 et informent les utilisateurs.
Les demandes liées au développement de modèles concurrents peuvent subir des modifications silencieuses.
Le signal : Claude Fable 5 coûte deux fois plus que les modèles Opus actuels, tandis que plus de 95 % des sessions évitent le repli vers Opus 4.8.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
Anthropic lance Claude Fable 5 auprès des publics grand public et professionnels. Le modèle constitue la variante accessible de la classe Mythos. Nathan Lambert le présente comme le modèle le plus intelligent disponible pour le grand public. Son prix atteint deux fois celui des modèles Opus actuels. Il reste inférieur à celui de la variante GPT 5.5 Pro. Anthropic a publié le modèle après un délai de plus de deux mois suivant la fin de son entraînement. Cette sortie associe un bond de capacités à plusieurs mesures de sécurité. Certaines mesures sont signalées aux utilisateurs. D’autres modifient le comportement du modèle sans notification explicite.
Les performances progressent fortement sur les principaux tests comparatifs mentionnés par Lambert. L’auteur ne relie pas ce résultat à une avancée technique unique. Il l’attribue plutôt à des progrès répartis dans l’ensemble de la chaîne de développement. Anthropic n’a pas documenté publiquement cette explication dans le texte cité. Les scores annoncés ne correspondent pas nécessairement à toutes les réponses obtenues par le public. Certains prompts peuvent être rétrogradés vers Claude Opus 4.8 par les filtres actuels. Lambert estime que cette progression confirme l’importance de nouveaux flux de travail autour des agents. Il écrit aussi que le modèle ne rencontre pas encore de mur immédiat pendant l’entraînement des grands modèles de langage.
Les garde-fous visibles couvrent la cybersécurité, la biologie et la chimie, ainsi que la distillation ciblée de modèles. Des systèmes séparés détectent les demandes potentiellement abusives et empêchent Claude Fable 5 d’y répondre directement. Lorsque ces classificateurs se déclenchent, la réponse est automatiquement traitée par Claude Opus 4.8. Anthropic informe alors l’utilisateur du changement de modèle. L’entreprise indique que plus de 95 % des sessions de Fable n’entraînent aucun repli. Dans ces sessions, elle considère les performances de Fable 5 comme équivalentes à celles de Mythos 5. Lambert décrit toutefois certains filtres de cybersécurité et de biologie comme sensibles et potentiellement frustrants.
Les requêtes concurrentes font l’objet d’un traitement différent. Anthropic vise notamment la conception de pipelines de préentraînement, d’infrastructures d’entraînement distribué et d’accélérateurs d’apprentissage automatique. L’entreprise explique que l’utilisation de Claude pour développer des modèles concurrents enfreint déjà ses conditions d’utilisation. Elle ajoute des interventions destinées à limiter l’efficacité de ces demandes. Contrairement aux domaines précédents, ces interventions ne sont pas visibles pour l’utilisateur. Fable 5 ne bascule pas vers un autre modèle. Anthropic peut modifier le prompt, appliquer des vecteurs de guidage ou utiliser un réglage fin à faible coût. Lambert juge cette différence difficile à concilier avec les autres politiques de sécurité.
La confiance se déplace vers la manière dont Anthropic applique ses règles. Lambert estime que des protections transparentes et des modifications silencieuses produisent une politique incohérente. Il associe cette seconde catégorie à une volonté de préserver la position concurrentielle de l’entreprise. Le texte rappelle aussi les préoccupations d’Anthropic concernant la distillation par des acteurs chinois. L’entreprise a publiquement exprimé ces inquiétudes et a signalé des sociétés chinoises plus petites. Lambert demande davantage de transparence sur les mécanismes concernés. Il avance que les traces de raisonnement peuvent faciliter l’apprentissage de modèles en aval. Cette analyse est présentée comme son hypothèse, et non comme une conclusion établie par Anthropic.
Lire l’analyse de Nathan Lambert, la présentation d’Anthropic et la mise à jour sur les classificateurs constitutionnels.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés