Actualité — Le 14 août 2026, Anthropic a publié le fonctionnement technique du filigrane invisible que Claude applique à son texte : quand le modèle hésite entre plusieurs mots de sens équivalent, le choix n'est plus tiré au hasard mais déterminé par une clé, ce qui rend la réponse identifiable après coup sans rien changer à sa lecture (Anthropic, « How Claude's text watermarking works », 14 août 2026).

Détail d'un écran affichant un texte dont certains mots sont discrètement mis en évidence

La question « ce texte a-t-il été écrit par une IA ? » n'avait jusqu'ici pas de réponse fiable. Les détecteurs du marché se trompent dans les deux sens, accusent des humains et blanchissent des machines. Anthropic vient de changer ça pour son propre modèle : à partir de maintenant, ce que Claude écrit porte une signature, et cette signature voyage avec le texte quand on le copie ailleurs.

Ce qu'Anthropic a publié

Le principe est plus simple qu'il n'y paraît. Un modèle de langage produit son texte mot après mot, et à chaque étape il départage plusieurs candidats acceptables. Le filigrane intervient exactement là : au lieu d'un tirage aléatoire entre ces candidats équivalents, Anthropic utilise une clé et les mots précédents pour décider lequel sortira. Le texte reste naturel, mais il porte un motif statistique reconnaissable. L'entreprise précise s'appuyer sur l'approche SynthID-Text publiée par Google DeepMind dans Nature en 2024, et affirme que « le filigrane n'affecte pas la qualité des réponses de Claude ».

14 août publication du détail technique par Anthropic
2 août les modèles antérieurs relèvent d'une période de transition européenne
Mondial déploiement sans restriction géographique au lancement
API un outil de détection est annoncé, pas encore disponible

Le calendrier n'est pas un hasard : Anthropic inscrit la mesure dans ses engagements au titre de l'AI Act européen, dont les obligations de transparence s'appliquent depuis début août. Nous avions détaillé ce texte au printemps, quand l'article 50 a imposé l'étiquetage des contenus générés par IA. Le filigrane est la réponse d'ingénierie à cette obligation juridique. Anthropic indique aussi déployer la mesure partout, faute de moyen fiable de la restreindre à l'Europe.

Côté fichiers, la logique est la même que celle observée chez son concurrent : les images et documents produits reçoivent des métadonnées signées, dans la lignée de ce que nous avions vu quand OpenAI a adopté SynthID et le standard C2PA pour ses images. La nouveauté ici, c'est le texte.

Ce qui efface le filigrane, ce qui le laisse intact

C'est la partie que la plupart des reprises ont survolée, et c'est la seule qui compte pour quiconque produit du contenu. Anthropic est explicite sur les cas où son filigrane tient et ceux où il lâche.

Ce que vous faites du texteLe filigrane subsiste-t-il ?
Copier-coller tel quelOui, il voyage avec le texte
Relecture légère, quelques mots retouchésOui, le plus souvent
Traduction faite par ClaudeOui, le modèle choisit chaque mot
Passage très factuel, formulation contrainteAffaibli : peu de choix disponibles
Texte courtAffaibli : trop peu de décisions pour porter un motif
Code sourceQuasi nul, sauf parfois dans les commentaires
Réécriture complète, chaque mot remplacéNon

La frontière est involontairement révélatrice : le filigrane survit à la relecture de complaisance et meurt sur la réécriture réelle. Autrement dit, il sépare assez exactement le contenu produit par une IA puis relu en diagonale du contenu produit par une IA puis véritablement réécrit par un humain. Anthropic ne cherchait pas à construire un indicateur d'effort éditorial. C'est pourtant ce qu'il a fabriqué.

Non, Google ne va pas vous pénaliser pour ça

Il faut couper court à la lecture paniquée qui circule déjà. Rien dans cette annonce ne concerne le classement Google. La position publique du moteur n'a pas bougé : Google ne pénalise pas le contenu généré par IA, il pénalise le mauvais contenu. Un filigrane Anthropic n'est pas un signal de classement, et aucune déclaration ne laisse entendre qu'il le deviendra.

Le vrai déplacement est ailleurs, et il est contractuel. Jusqu'à présent, la clause « contenu original rédigé par un humain » dans un devis d'agence était invérifiable. Elle devient vérifiable : par votre client, par un concurrent, par un journaliste, par une place de marché qui filtre ses vendeurs. Ce n'est pas un risque SEO, c'est un risque de réputation et de contrat. Il rejoint ce que montrait déjà l'étude sur 220 sites publiant du contenu IA à l'échelle : le problème n'a jamais été l'outil, il a toujours été l'absence de travail éditorial derrière.

Ce qu'il faut faire cette semaine

Premièrement, relisez vos engagements écrits. Si un contrat client, une page « à propos » ou une mention légale promet du contenu « 100 % humain » alors que votre chaîne de production utilise un modèle, corrigez la formulation maintenant. Une promesse imprécise coûte plus cher qu'un aveu d'assistance par IA.

Deuxièmement, arrêtez de payer pour de la relecture cosmétique. Le tableau ci-dessus dit exactement ce que vaut une passe de correction légère : elle ne transforme rien, et désormais elle ne masque plus rien non plus. Si vous achetez de la rédaction, l'unité de valeur n'est pas la correction, c'est la réécriture avec un apport propre : données, expérience terrain, point de vue.

Troisièmement, misez sur ce qu'aucun modèle ne peut produire seul. C'est le même levier que celui qui fait tenir un site dans les réponses des IA : de l'expérience vécue, des chiffres que vous seul possédez, une position assumée. Nous l'avions développé à propos du score de confiance E-E-A-T appliqué au contenu IA.

Votre contenu tient-il la route face aux IA ?

On analyse gratuitement votre visibilité réelle dans les réponses de ChatGPT, Perplexity et Google, et la solidité éditoriale de vos pages.

Les limites de cette lecture

L'outil de détection n'existe pas encore publiquement. Anthropic annonce une API de détection dont les modalités ne sont pas arrêtées. Tant qu'elle n'est pas ouverte, personne à l'extérieur ne peut vérifier quoi que ce soit. Nous décrivons une capacité annoncée, pas une capacité disponible.

Le filigrane ne couvre que Claude. Un texte produit par ChatGPT, Gemini ou un modèle ouvert exécuté en local ne porte pas cette signature. L'absence de filigrane ne prouve donc rien du tout. Le dispositif peut incriminer, il ne peut pas innocenter. C'est une asymétrie qu'il faudra rappeler chaque fois que quelqu'un brandira un résultat de détection.

Aucun taux de fiabilité n'est public. Anthropic décrit des situations où le signal s'affaiblit, sans publier de seuil de longueur minimale ni de taux de faux positifs. Toute affirmation chiffrée sur la précision de cette détection, à ce stade, est une invention.

Cet article ne traite pas du contournement. Savoir qu'une réécriture intégrale supprime le motif est un fait technique documenté par Anthropic, pas une méthode que nous recommandons ni ne détaillons.

Questions fréquentes

Comment fonctionne le filigrane de texte de Claude ?

Quand Claude hésite entre plusieurs mots de sens équivalent, le choix n'est plus tiré au hasard : il est déterminé par une clé et par les mots qui précèdent. Le motif obtenu reste invisible à la lecture mais peut être retrouvé après coup. Anthropic indique s'appuyer sur l'approche SynthID-Text publiée par Google DeepMind dans Nature en 2024.

Le filigrane survit-il à une réécriture ?

Anthropic indique qu'une relecture légère préserve généralement le filigrane, et qu'une réécriture complète où chaque mot est remplacé le supprime. Le signal est également plus faible sur les textes courts, sur les passages très factuels où le choix des mots est contraint, et quasi absent dans le code.

Google pénalise-t-il un contenu porteur d'un filigrane IA ?

Rien ne l'indique. La position publique de Google reste que le contenu généré par IA n'est pas pénalisé en tant que tel, seul le mauvais contenu l'est. Le filigrane d'Anthropic est une mesure de transparence liée à l'AI Act européen, pas un signal de classement annoncé par Google.

L'analyse Cicéro

Ce filigrane sera présenté comme une menace pour ceux qui produisent du contenu avec de l'IA. C'est l'inverse. Il ne distingue pas l'IA de l'humain : il distingue le texte qu'on a laissé sortir tel quel de celui qu'on a vraiment retravaillé. Cette frontière-là, nous la défendons depuis le début.

Le seul contenu qui devient inconfortable cette semaine est celui que personne n'a jamais réécrit. Il était déjà mauvais avant d'être détectable ; il sera simplement plus embarrassant à défendre.

Sources

  • Anthropic (annonce officielle) : « How Claude's text watermarking works », mécanisme de sélection par clé, périmètre de déploiement, limites documentées et annonce d'une API de détection, 14 août 2026.
  • TechCrunch : reprise détaillée de l'annonce, conditions de survie du filigrane à l'édition et absence de filigrane significatif dans le code, 15 août 2026.
  • TechCrunch : annonce initiale de la mesure et rattachement aux obligations de transparence de l'AI Act européen, 11 août 2026.
Alexis Dollé, fondateur de Cicéro
Alexis Dollé
CEO & Fondateur

Spécialiste du growth et de la stratégie de contenu SEO & GEO, j'ai lancé Cicéro pour aider les entreprises à capter une visibilité organique durable — sur Google comme dans les réponses des IA. Chaque contenu qu'on produit est pensé pour convertir, pas juste pour exister.

LinkedIn