

Temps de lecture : 6 min
Points clés à retenir
- Filigrane invisible : basé sur des choix aléatoires entre formulations équivalentes, sans altérer le sens ni la qualité.
- Limites techniques : le code, les textes courts et les relectures légères sont peu ou pas marqués, faute de variations suffisantes.
- Aucun contournement durable : VPN, anciens modèles ou concurrents n’offrent qu’un répit temporaire, la majorité des fournisseurs s’étant engagés dans la même démarche.
Comment Claude marque-t-il un texte sans y ajouter quoi que ce soit ?
Le filigrane d’Anthropic n’insère ni caractère caché, ni mot supplémentaire. Quand Claude rédige, plusieurs formulations équivalentes se présentent souvent. Par exemple, après « Le temps était froid et », choisir entre « couvert » et « gris » ne change pas le sens de la phrase ; c’est un tirage aléatoire. Le filigrane ne modifie pas ces choix, mais leur source : une clé secrète combinée aux mots précédents remplace le hasard. En pratique, le modèle n’est pas poussé vers certains termes et ne retient jamais un mot qu’il n’aurait pas envisagé, mais la séquence obtenue devient vérifiable pour qui possède la clé.
Anthropic s’appuie sur SynthID-Text, une méthode publiée par Google DeepMind dans Nature en 2024, héritée d’une proposition du chercheur Scott Aaronson en 2022.
Le filigrane dégrade-t-il la qualité ou augmente-t-il les coûts ?
D’après Anthropic, aucun effet mesurable sur le contenu, la créativité ou la lisibilité. L’étude fondatrice de la méthode aboutit aux mêmes conclusions. Google DeepMind a déployé un modèle marqué sur une partie du trafic Gemini, sans écart significatif dans les votes des utilisateurs, et des évaluateurs humains n’ont relevé aucune différence de qualité. De plus, le marquage ne génère aucun jeton supplémentaire, donc aucun surcoût ni ralentissement. Passons au concret : si vous utilisez Claude, vous ne verrez aucune différence, ni en termes de fluidité, ni de facture.
Le code généré par Claude est-il marqué ?
Très peu. Le filigrane repose sur des choix arbitraires entre formulations équivalentes. Or, le code impose une sortie exacte : une variante le casserait. Le même raisonnement vaut pour les passages factuels, où une seule suite est possible. Le marquage peut toutefois se nicher dans les commentaires, avec un impact négligeable sur le code lui-même. Sur le terrain, les développeurs qui utilisent Claude pour générer du code verront donc rarement leur production marquée.
Et quand Claude corrige ou traduit un texte existant ?
Les deux cas sont radicalement opposés. Lors d’une relecture, les mots proviennent principalement de l’auteur ; le filigrane ne peut donc pas s’insérer facilement. Selon l’ampleur des corrections, l’intervention du modèle peut rester indétectable. En revanche, une traduction est marquée intégralement, puisque Claude choisit chaque mot. Elle sera donc facilement identifiable comme étant générée par IA.
Les images et les fichiers sont-ils concernés de la même manière ?
Ils sont concernés, mais différemment. Les fichiers PNG, JPG ou SVG produits par Claude reçoivent une signature cryptographique dans leurs métadonnées, selon le standard ouvert C2PA, déjà utilisé par les fabricants d’appareils photo. Ce n’est pas un filigrane, car rien n’est dissimulé dans le fichier, mais tout outil compatible peut lire cette mention. Anthropic prévoit de proposer son propre outil de vérification.
Le filigrane peut-il remonter jusqu’à un utilisateur ?
Non. Ni le filigrane ni la clé ne contiennent d’information permettant d’identifier un utilisateur ou une organisation. Le marquage porte uniquement sur les sorties du modèle, et la clé ne répond qu’à une seule question : « Est-il probable que Claude soit intervenu ? » Aucune identification personnelle n’est donc possible.
Peut-on effacer le filigrane ?
Partiellement. Une retouche légère ne suffit pas à le supprimer. Une réécriture complète peut l’effacer, mais à ce stade, on peut se demander si le texte relève encore de la génération par IA. La longueur joue aussi un rôle crucial : la détection devient moins fiable sur des échantillons courts, faute de suffisamment de choix de mots. En clair, si vous tentez de maquiller un texte généré, le jeu n’en vaut pas la chandelle.
Comment vérifier si un texte a été généré par Claude ?
Anthropic annonce une API de détection, dont les modalités restent à préciser. Contrairement aux détecteurs de texte IA classiques, qui se baseront uniquement sur les tics d’écriture des modèles (comme la construction « ce n’est pas X, c’est Y »), cette API utilisera la clé secrète pour identifier les sorties de Claude. Le résultat restera une probabilité, sans pouvoir distinguer un texte entièrement rédigé par Claude d’un texte seulement retravaillé. La détection des textes générés par l’IA reste donc une bataille complexe.
Peut-on passer sur une autre IA ou un ancien modèle pour y échapper ?
Pas durablement. Le code de bonnes pratiques européen sur la transparence des contenus générés par IA, signé en juillet 2026, réunit environ 190 signataires, dont la plupart des grands fournisseurs de modèles. Chacun déploiera son propre marquage, avec sa clé et peut-être des méthodes différentes. Les modèles de Claude antérieurs au 2 août 2026 échappent encore au filigrane, mais Anthropic travaille à les couvrir dans les mois à venir. Donc oui, vous pouvez y échapper temporairement, mais cela ne durera pas.
Et peut-on échapper au filigrane avec un VPN ?
Non. Le marquage opère au niveau du modèle et s’applique partout dès le lancement, sans distinction de pays. Anthropic explique qu’il n’existe pas de moyen durable pour le restreindre à une région, et qu’ils évaluent d’autres approches. Se connecter depuis l’extérieur de l’Union européenne ne change rien au texte produit.
Le point de vue de ZoneMentale
Décortiquons la structure de cette initiative. D’un côté, la transparence est une avancée louable pour lutter contre la désinformation. De l’autre, cette technologie impose des contraintes aux entreprises qui utilisent l’IA pour leurs opérations commerciales. Mon conseil : intégrez cette variable dans votre stratégie. Si vous dépendez de contenu généré par IA pour votre acquisition, envisagez des systèmes de révision systématique, ne serait-ce que pour garder la main sur votre production. Ce qui compte vraiment, c’est que votre trafic reste de qualité, indépendamment de la méthode de génération.