Anthropic filigrane Claude pour détecter ses textes
E-commerce #claude #gemini 3 min · 2 septembre 2026

Anthropic filigrane Claude pour détecter ses textes

Par Arthur Dekeyser

En résumé

1

Anthropic prévoit des filigranes textuels identifiables dans les prochaines versions de Claude.

2

SynthID-Text influence statistiquement le choix des jetons pendant la génération du texte.

3

Les plateformes pourraient filtrer ou réduire la diffusion des contenus détectés comme générés par IA.

💡

Le signal : Anthropic adopte SynthID-Text, une méthode de Google qui encode un filigrane statistique pendant la génération de chaque jeton.

NEWSLETTER BUSINESS & IA

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés

Anthropic prévoit d’ajouter des filigranes textuels identifiables à toutes les prochaines versions de Claude. L’annonce répond au règlement européen 2024/1689, adopté par le Parlement européen. Ce texte impose que les contenus synthétiques puissent être détectés par des machines. L’objectif affiché est la transparence sur l’origine des contenus. La méthode retenue par Anthropic s’appuie sur SynthID-Text, une technologie développée par Google. Ce dispositif pourrait fournir aux plateformes un signal technique sur la manière dont un texte a été produit. Le débat dépasse donc la simple identification. Il concerne aussi l’usage futur de ce signal par les moteurs de recherche, les réseaux sociaux, les modèles de langage et les clients de messagerie.

Le règlement européen vise à rendre les contenus générés par IA identifiables. L’identification par le style ou la ponctuation reste toutefois incertaine. Un tiret cadratin ou un deux-points ne prouvent pas qu’un texte vient d’un modèle. Les systèmes génératifs produisent aussi des textes plus proches de l’écriture humaine. SynthID-Text adopte une autre approche. Le filigrane est intégré pendant la génération, sans consultation ultérieure du modèle. La détection ne nécessite ni base de données, ni puissance informatique importante. D’autres entreprises spécialisées dans l’IA pourraient suivre Anthropic. Cette standardisation potentielle créerait un mécanisme commun pour examiner l’origine statistique de nombreux textes publiés.

SynthID influence chaque jeton

Le mécanisme repose sur le choix successif des jetons. Un jeton peut être une partie de mot, un mot entier, un nombre ou un signe de ponctuation. Pour chaque position, le modèle estime plusieurs suites possibles et leur probabilité. Dans l’exemple de Google Gemini, « mango » reçoit 50 %, « lychee » 30 %, « papaya » 15 % et « durian » 5 %. SynthID organise ces candidats comme un tournoi. Un algorithme combine le texte récent avec une clé secrète pour produire une valeur appelée graine. Cette graine détermine le score des candidats. Le jeton obtenant le meilleur score gagne, puis le processus recommence pour la position suivante.

Le signal statistique ne dépend pas de mots précis. « Mango » peut gagner dans une phrase et perdre dans une autre. Un seul tournoi ne suffit donc pas à établir la présence du filigrane. Après des centaines de sélections, le texte peut contenir davantage de jetons influencés par la graine que le hasard ne devrait en produire. Le détecteur utilise la clé secrète pour reconstruire les scores des tournois. Il vérifie ensuite si les choix franchissent un seuil de détection. Les textes longs fournissent davantage d’indices. Les passages factuels ou fortement remaniés par l’utilisateur offrent moins de choix acceptables, ce qui réduit les éléments statistiques observables.

Les plateformes pourraient filtrer

Le risque commercial concerne la circulation du contenu marketing généré ou assisté par IA. Les moteurs de recherche pourraient minorer des pages identifiées comme assistées par IA. Les modèles de langage pourraient éviter ces pages comme sources. Les réseaux sociaux pourraient réduire leur distribution. Pinterest applique déjà une telle pratique selon l’article. Les clients de messagerie pourraient aussi diriger ces textes vers les courriers indésirables ou un dossier signalant une forte probabilité de génération automatisée. Pour les équipes de commerce électronique, une séparation fondée sur le filigrane pourrait limiter la réutilisation peu coûteuse de descriptions, d’articles et de courriels. Le filigrane deviendrait alors un indicateur de qualité supposée.

La détection reste statistique et peut produire des faux positifs si le seuil est trop bas. Un texte dépassant ce seuil serait considéré comme généré par IA, ou au moins assisté par IA. Cette distinction pourrait influencer son traitement par les plateformes. L’analyse de SynthID-Text est présentée dans une publication de Nature. Le règlement européen est consultable sur le site officiel de l’Union européenne. Anthropic détaille son annonce sur la page consacrée au filigrane textuel de Claude. Les prochaines versions de Claude permettront d’observer la mise en pratique de ce dispositif.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs abonnés

À lire aussi