# Anthropic face à l'essor des outils anti-filigrane IA

> Des outils promettent de retirer les filigranes invisibles de Claude, mais Anthropic n'a pas publié son détecteur et plusieurs tests révèlent des limites.

Type : Actualité IA · Catégorie : Tendances · Publié le 2026-08-14 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/anthropic-voit-les-outils-anti-filigrane-claude-fleurir
Tags : anthropic, claude, filigrane ia, provenance, cybersécurité, gemini, legislation-ia, ia-code

---

## En résumé

- Le projet watermarks-remover a plus de 4 500 étoiles et annonce une compatibilité avec Claude et Gemini.
- La suppression des métadonnées est vérifiable, contrairement au filigrane textuel, intégré dans le choix des mots et nécessitant une réécriture lourde.
- Anthropic marque les sorties des modèles lancés depuis le 2 août 2026 pour répondre à l'AI Act européen, sans affirmer qu'un contenu marqué a été écrit par Claude.

**Le signal :** Le projet watermarks-remover a dépassé 4 500 étoiles.

## Les outils Claude se multiplient

Un marché de la suppression des filigranes IA s'est constitué quelques jours après l'annonce par [Anthropic de marques invisibles dans les textes produits par Claude](/signal-ia/actu/anthropic-etiquette-les-textes-ia-les-contournements-se-multiplient). Il rassemble un projet GitHub sous licence MIT comptant plus de 4 500 étoiles, mais aucune promesse de suppression du filigrane textuel ne peut encore être vérifiée: Anthropic n'a pas publié son fonctionnement ni le détecteur permettant de contrôler si un document nettoyé porte toujours la marque.

Le projet le plus visible est **watermarks-remover**, développé par Guillaume Meyer, fondateur de Memo. D'abord conçu comme une compétence d'agent dédiée à Claude, il annonce désormais une prise en charge de Claude et [Gemini](/signal-ia/actu/gemini-3-un-modele-dia-de-google). D'autres dépôts, comme **claude-watermark-cleaner**, **remove-ai-watermarks** et **noai-watermark**, côtoient les sites claudewatermark.com, claudewatermark.rip, gptcleanup.com et claudewatermarkremover.app.

StealthGPT, spécialisé dans l'évasion des détecteurs IA, a ajouté un outil de suppression du filigrane Claude. Human Writes affirme aussi contourner Turnitin et GPTZero et retirer la marque de Claude, tout en rappelant que son service doit respecter les règles d'intégrité académique. StealthGPT précise de son côté qu'aucun outil ne garantit un contournement à 100 % et que les détecteurs évoluent régulièrement. Des tests indépendants ont toutefois relevé des failles: Pasquale Pillitteri a cloné plusieurs projets et constaté qu'un nettoyeur populaire laissait intacte une technique courante de charge cachée, récupérable après le traitement.

## Métadonnées et réécriture complexe

Ces services regroupent en réalité trois opérations. La suppression des caractères invisibles, comme les caractères sans largeur, les contrôles bidirectionnels, les caractères de balise Unicode et certains espaces ressemblants, est vérifiable. Il en va de même pour les métadonnées C2PA, EXIF et XMP dans les fichiers PNG, JPEG, SVG, PDF, DOCX, ODT, HTML et Markdown. Ces informations disparaissent déjà lors d'une nouvelle sauvegarde, d'une conversion de format ou d'une capture d'écran.

Le filigrane textuel est différent: il repose sur les mots choisis par le modèle, et non sur des caractères cachés. La méthode connue consiste donc à réécrire lourdement le texte avec un second modèle. Guillaume Meyer indique que son outil ne retire pour l'instant que les métadonnées. Il souligne aussi qu'une réécriture remplace les choix du modèle premium par ceux d'un modèle moins coûteux. Les sites commerciaux promettent parfois un résultat propre et indétectable, mais les scores affichés sont souvent comparés à des détecteurs IA classiques, pas au filigrane Anthropic, dont le détecteur reste privé.

Anthropic indique que les modèles lancés depuis le 2 août 2026 intègrent un filigrane imperceptible dans leur formulation et que les formats pris en charge reçoivent des métadonnées C2PA signées. Le marquage s'applique au niveau du modèle, via l'API, claude.ai, Claude Code, Claude Cowork, Claude Tag, AWS, Google Cloud et Microsoft Foundry. Il répond à l'article 50 de l'AI Act européen, applicable depuis cette date, avec des sanctions pouvant atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial. Anthropic précise toutefois qu'une marque indique seulement qu'un contenu a été traité par Claude, pas nécessairement qu'il a été écrit par Claude. L'entreprise prévoit une documentation technique et la prise en charge de la détection par des tiers.

Cette catégorie pose enfin un risque de chaîne d'approvisionnement. **watermarks-remover** s'installe comme une compétence d'agent par lien symbolique et peut télécharger un artefact d'environ 220 Mo depuis un dépôt tiers. BleepingComputer n'a audité ni testé les outils cités. Les projets actuels sont généralement ouverts et lisibles, mais l'essor d'un marché comptant déjà plus de 4 000 étoiles.
