Filigrane invisible dans les textes de Claude : ce qui est vrai, et ce qui ne l'est pas encore
Anthropic va marquer les textes générés par Claude d'un filigrane invisible. Ce qui est documenté, ce qui ne l'est pas, et si vos textes sont traçables.

Le premier modèle concerné existe désormais : Fable 5.1, lancé le 1ᵉʳ septembre, est le premier Claude dont tous les textes portent le filigrane, et l'API de détection entre en aperçu privé réservé aux organisations autorisées par la loi européenne. Le détail chiffré dans notre article du jour.
Le 14 août, Anthropic a mis fin au silence : un billet de la newsroom nomme la technique, une version de SynthID-Text venue de Google DeepMind, annonce une API de détection « bientôt » et répond aux craintes de la fronde, relecture et code en tête. Le détail dans la dernière section de l'article, après le récit de la fronde du 13 août.
Depuis le 10 août au soir, une information tourne en boucle : Claude glisserait désormais un filigrane invisible dans chaque texte qu'il produit, un marqueur indétectable à l'œil nu qui survivrait au copier-coller. Business Insider, Business Standard, Notebookcheck et une dizaine d'autres titres l'ont reprise le 11.
L'information est exacte sur le fond. Elle est fausse sur le calendrier, et la plupart des reprises se trompent sur la technique employée.
La source primaire du 10 août est un article d'aide, pas une annonce
Contrairement à ce que laissaient entendre plusieurs titres, Anthropic n'avait rien « annoncé » au 11 août. La newsroom `anthropic.com/news` n'en disait rien, le dernier billet remontant alors au 7. Le compte X @AnthropicAI n'avait rien publié. Le Transparency Hub, mis à jour le 23 juillet, n'évoquait pas le sujet. Ce silence a pris fin le 14 août, avec un billet dédié : voir la mise à jour du 17 août, en fin d'article.
Au 11 août, la seule source officielle était une page du centre d'aide intitulée « How Claude marks AI-generated content », classée dans la rubrique « Privacy and legal », dont l'horodatage interne indique une mise à jour le 10 août 2026 à 19 h 03 UTC. Anthropic y décrit comment l'entreprise « prévoit de mettre ces engagements en pratique ». Tout le document est au futur.

Quand un modèle Claude pris en charge génère du texte, il tisse un filigrane imperceptible directement dans le texte lui-même. Vous ne le verrez pas, et il ne change ni le sens, ni la qualité, ni la lisibilité de la réponse de Claude.Centre d'aide Claude, 10 août 2026 (traduit de l'anglais)
Le post qui a fait circuler l'information est celui d'un compte de veille, pas celui de l'éditeur.
Anthropic indique que les nouveaux modèles Claude intégreront des filigranes invisibles dans tout le texte généré, partout où Claude est proposé. Le filigrane fait partie du texte, ce ne sont pas des métadonnées : « il voyagera avec le texte quand celui-ci sera copié et collé ailleurs, et pourra survivre à certaines modifications ». Cela commence avec les modèles lancés le 2 août 2026 ou après, dans le cadre d'un code de l'AI Act européen qu'Anthropic a signé. Anthropic travaille encore à l'ajouter aux modèles actuels. Le déploiement est mondial.Voir le post sur X
Aucun texte produit par Claude aujourd'hui n'est filigrané
C'est le point que pas une reprise anglophone ne relève. Le document est explicite : les modèles Claude « lancés le 2 août 2026 ou après » prennent en charge le marquage dès leur lancement. Or, au 11 août, la page des modèles de la documentation Anthropic ne liste aucun modèle sorti après cette date.
| Modèle | Date de mise à disposition | Filigrane au lancement |
|---|---|---|
| Claude Fable 5 | 9 juin 2026 | Non |
| Claude Sonnet 5 | juin 2026 | Non |
| Claude Opus 5 | 24 juillet 2026 | Non |
| Claude Haiku 4.5 | octobre 2025 | Non |
Opus 5, le modèle généraliste que la plupart des utilisateurs ont sous la main, est sorti neuf jours avant la date de bascule. Pour les modèles antérieurs, Anthropic écrit que la loi prévoit une période de transition et que l'entreprise « travaille à ajouter la prise en charge du marquage » pour eux aussi. Sans date précise.
Un texte produit avec Claude aujourd'hui ne porte aucun filigrane Anthropic. Le marquage concernera le prochain modèle, quel qu'il soit. Toute affirmation contraire, y compris venant d'un détecteur commercial, n'est pas fondée sur la documentation officielle.
Filigrane statistique, caractères invisibles, C2PA : trois choses différentes
La confusion est massive, et elle a des conséquences concrètes. Le premier résultat Google en français sur « filigrane Claude » est un site qui promet de « supprimer les caractères invisibles de ChatGPT, Claude et Gemini », ces espaces de largeur nulle qu'on trouve parfois dans du texte collé. Il ne s'agit pas de cela.
| Technique | Ce que c'est | Survit au copier-coller | Survit à la paraphrase |
|---|---|---|---|
| Caractères Unicode invisibles | Des espaces de largeur nulle insérés après coup | Souvent | Non |
| Filigrane dans la génération | Un biais imperceptible dans le choix des mots | Oui | Non |
| Métadonnées C2PA | Une signature attachée au fichier | Non, elle reste dans le fichier | Sans objet |
Au 11 août, Anthropic ne nommait pas sa technique, et c'était une limite à assumer. Le billet du 14 août l'a depuis levée : c'est une version de SynthID-Text, comme le détaille la mise à jour du 17 août. Mais trois propriétés décrites dans le document excluaient déjà les caractères invisibles. Le marquage est appliqué au niveau du modèle, pas en sortie de produit. Un passage « très court » ne laisse pas assez de texte « pour un signal fiable », ce qui n'aurait aucun sens pour des caractères insérés. Et le filigrane disparaît si le texte est « lourdement édité, paraphrasé, traduit ou mélangé à d'autres écrits ». Ce faisceau correspond à un filigrane statistique posé pendant la génération, la famille du SynthID-Text de Google.
La nuance a échappé à beaucoup de monde, y compris à des spécialistes.
Ça m'a tout l'air d'être du pipeau. Il n'y a rien d'invisible dans du texte brut. N'importe quel éditeur de texte brut vous montrera n'importe quel filigrane « caché ».Voir le post sur X
L'objection serait juste si le filigrane était un caractère caché : un éditeur de texte brut le révélerait. Mais un filigrane statistique n'ajoute rien. Il oriente très légèrement le choix des mots pendant la génération, de sorte que le texte suit une distribution reconnaissable par qui détient la clé. Ouvrir le fichier dans un éditeur ne montre rien, faute de quoi que ce soit à montrer.
Pour les fichiers, Anthropic est en revanche parfaitement clair : les `.svg`, `.png` et `.jpg` générés recevront des métadonnées de provenance signées au standard C2PA. Une conversion, un réenregistrement ou une capture d'écran suffisent à les effacer. C'est le compromis du filigrane audio de Suno, robuste sur le fichier d'origine, fragile dès qu'on le retraite.
Votre texte est-il traçable, et par qui ?
Aujourd'hui : non, toujours. Aucun modèle disponible ne marque, et aucune API de détection n'est encore en service. Le billet du 14 août en annonce une « bientôt », sans date : voir la mise à jour du 17 août. Tant qu'elle n'est pas disponible, personne, ni un enseignant, ni un éditeur, ni un client, ne peut vérifier quoi que ce soit.
Demain : partiellement. Le marquage couvrira toutes les surfaces produit, l'API, claude.ai, Claude Code, Claude Cowork et Claude Tag, ainsi que les accès via AWS, Google Cloud et Microsoft Foundry. Sur la géographie, le document consacre une rubrique entière, intitulée « Regions », à trancher la question : le marquage s'appliquera « partout où Claude est proposé, dans le monde entier ». L'obligation qui le déclenche est européenne, sa mise en œuvre ne l'est pas. Le billet du 14 août en donne la raison : Anthropic n'a pas encore de « moyen durable » de limiter le marquage par région. Mais l'éditeur liste lui-même ce qui efface le signal : la réécriture profonde, la paraphrase, la traduction, l'intégration dans un texte plus large, et les passages trop courts.
Anthropic le dit noir sur blanc : détecter une marque indique que le contenu « a pu être traité par Claude », sans confirmer sa provenance. Le billet du 14 août ajoute qu'une marque ne peut pas distinguer « Claude a écrit ceci » de « Claude a lourdement édité ceci ». Faire relire, traduire ou résumer par Claude un texte que vous avez écrit vous-même suffit à le faire marquer. À l'inverse, l'absence de marque ne prouve pas qu'un texte est humain.
Le calendrier réglementaire, sans confusion
Le déclencheur est explicite dès la première ligne du document : Anthropic a signé le code de bonnes pratiques sur la transparence des contenus générés par IA, adossé à l'article 50(2) du règlement européen sur l'IA. Jugé adéquat par la Commission en juillet 2026, ce code a rassemblé environ 190 signataires avant l'échéance.
Ces obligations ne pèsent pas que sur Anthropic. Si vous publiez du contenu généré par IA, vous êtes déployeur au sens du règlement, avec vos propres devoirs d'étiquetage visible, détaillés dans notre article sur l'étiquetage des contenus IA. Anthropic le rappelle : ceux qui intègrent Claude dans leur produit doivent évaluer eux-mêmes ce que l'article 50 exige d'eux.
Ne cherchez pas à contourner le filigrane. Documentez plutôt votre chaîne de production : qui rédige, qui relit, quel outil intervient et à quelle étape. C'est cette traçabilité que la réglementation vous demandera, pas l'absence de marqueur.
Mise à jour du 13 août : la fronde des utilisateurs, racontée et vérifiée
Deux jours après la publication de la page d'aide, la contestation a pris assez d'ampleur pour que TechCrunch lui consacre un article, le 12 août : « Certains utilisateurs de Claude sont furieux que les nouveaux filigranes d'Anthropic les fassent repérer au travail ou en cours ». Détail savoureux : l'adresse de l'article a gardé le mot « cheating » (tricher) que le titre publié a remplacé par une formule plus neutre.
Le foyer de la fronde est Reddit. Nous avons relu les threads cités, et d'autres, à la source. Le plus gros, publié le 11 août sur r/artificial, dépasse les 800 points. Son commentaire le plus voté défend pourtant le marquage : « Il n'existe littéralement aucun bon argument contre cette idée. La seule raison de ne pas en vouloir, c'est de mentir aux gens » (Tasty-Ad-3753, 11 août, plus de 300 points). Mais la réponse qui arrive juste derrière, celle de l'auteur du thread lui-même, résume la crainte dominante.
À la lecture de la nouvelle politique de filigrane d'Anthropic, Claude marquera apparemment comme IA mon propre texte si je l'utilise juste pour de la relecture. Un texte écrit par un humain peut donc devenir « généré par IA » simplement parce qu'une IA a aidé à le corriger. Cela me semble ridicule.Left-Hotel904, sur r/artificial, 11 août 2026 (traduit de l'anglais)
Le registre monte vite d'un cran ailleurs. Un post de r/Anthropic du 11 août, titré « Le filigranage de notre travail par Claude est contraire à l'éthique et répugnant », proteste : « J'ai fourni les instructions, le contexte, les décisions et d'innombrables raffinements, Claude était l'outil. Si Claude se met à filigraner le code ou quoi que ce soit d'autre qu'il génère, de quoi s'attribue-t-il exactement le mérite ? ». Et un long réquisitoire publié le 12 août sur r/artificial par l'utilisateur visionode prédit : « Qui va se faire prendre ? Vous. L'étudiant qui a utilisé Claude pour réorganiser un paragraphe. Le journaliste qui a demandé à l'IA de résumer une transcription de deux cents pages. L'écrivain en panne d'inspiration qui a demandé des synonymes. »
La communauté n'a pas vraiment suivi : le post de visionode plafonne à 22 % d'avis positifs, et les réponses les plus votées se limitent à « Non mais écoutez-le, celui-là » et « Respirez un grand coup ». Sur le post de r/Anthropic, la réplique la plus appuyée remet le débat d'aplomb : « Il ne s'attribue aucun mérite. Il s'agit de pouvoir détecter les contenus générés par IA, à cause des risques qu'ils posent dans certaines situations » (nesh34, 11 août, près de 100 points).
Car c'est le point clé, et il est passé au-dessus de la mêlée : la fronde proteste contre un filigrane qui, à ce jour, ne marque rien. Le thread le plus partagé affirme que « chaque phrase que Claude écrit porte désormais une signature », visionode écrit « à partir de maintenant ». La documentation dit l'inverse : le marquage vise les modèles lancés le 2 août 2026 ou après, et la gamme actuelle (Fable 5, Opus 5, Sonnet 5, Haiku 4.5) est intégralement antérieure. Quant à la peur d'être « repéré » par un employeur ou un enseignant, elle supposait alors un détecteur qui n'existait pas, et dont Anthropic précise qu'il indiquera seulement qu'un texte « a pu être traité par Claude ». Nous avions revérifié le 13 août : la page d'aide n'avait pas bougé d'une virgule depuis le 10 août à 19 h 03 UTC, la newsroom était muette depuis le 7, et le compte X d'Anthropic n'avait rien publié. Au 13 août, l'entreprise laissait donc la polémique sans réponse. Ce silence a pris fin le lendemain : voir la mise à jour du 17 août.
Toutes les critiques ne relèvent pas du malentendu. L'exemple de la relecture cité plus haut pose une vraie question, qu'Anthropic reconnaît d'ailleurs à demi-mot dans sa rubrique sur les limites. Un commentateur du thread visionode formule l'objection la plus solide du lot : la détection devrait être « ouverte et auditable de façon indépendante, pas détenue par l'entreprise qui vend les verrous ». Et le blogueur John Gruber, plutôt une voix pro-Apple qu'un habitué des polémiques IA, a jugé le 11 août sur Daring Fireball la page d'aide « d'une opacité exaspérante », estimant qu'un filigrane qui biaise le choix des mots serait « un poison pour la marque Claude ». Le billet du 14 août répond en partie à ce procès : la méthode est désormais nommée et expliquée pas à pas (voir la mise à jour du 17 août). Restent dans le flou les détails de l'API de détection annoncée, et son calendrier.
Le 13 août, pendant que la fronde occupait l'attention, l'équipe Frontier Red Team d'Anthropic publiait de son côté une étude sur les systèmes multiagents, dans laquelle trois Claude lancés sur la même tâche ont fini par se saboter : à lire dans notre article sur la guerre de territoire entre agents IA.
Mise à jour du 17 août : la technique dévoilée, question par question
Le 14 août, le silence a pris fin. Anthropic a publié sur sa newsroom un billet intitulé « How Claude's text watermark works », le premier document officiel sur le sujet depuis la page d'aide du 10 août, qui, elle, n'a pas bougé d'une virgule. TechCrunch l'a raconté le lendemain, en relevant au passage que Business Insider a compté des « dizaines » d'utilisateurs de X affirmant avoir résilié leur abonnement Claude. Le billet répond point par point aux questions qui circulent depuis une semaine, fronde Reddit comprise.

La première réponse porte sur la technique, et elle confirme la déduction de notre article du 11 août. Le filigrane de Claude est « une version de l'approche SynthID-Text publiée par Google DeepMind dans un article de Nature en 2024 », elle-même héritière d'une proposition de Scott Aaronson en 2022. Le principe, expliqué en clair : un grand modèle écrit mot à mot, et à chaque mot il tranche parmi des candidats plausibles. Entre « overcast » et « grey » pour décrire un temps couvert, le sens est le même, et d'ordinaire un nombre aléatoire départage. Le filigrane change seulement la source de ce hasard : c'est la clé, combinée aux mots précédents, qui décide. Le texte suit alors un motif indétectable à la lecture, mais reconnaissable par qui détient la clé. Rien n'est ajouté au texte, aucun caractère caché. Anthropic file une analogie parlante : remplacer les dés du Monopoly par les décimales du nombre pi ne change rien pour les joueurs, mais permet à qui connaît pi de reconnaître la partie après coup.
Le filigrane n'a aucun impact sur la qualité de la sortie de Claude. Pour un lecteur, une réponse filigranée est indiscernable d'une réponse qui ne l'est pas.Billet Anthropic, 14 août 2026 (traduit de l'anglais)
L'éditeur s'appuie sur le papier SynthID-Text : Google DeepMind y avait servi un modèle filigrané à une partie du trafic de Gemini et comparé les évaluations pouce levé, pouce baissé, sans différence statistiquement significative. Une étude contrôlée avec des évaluateurs humains n'a pas trouvé de différence de qualité non plus, et les tests internes d'Anthropic n'ont montré aucun impact sur le contenu, la créativité ou la lisibilité.
Le reste du billet précise ce que la page d'aide laissait dans le flou.
| Question | Ce qu'on savait au 11 août | Ce que le billet du 14 août ajoute |
|---|---|---|
| Quelle technique ? | Non nommée, déduite des indices | SynthID-Text, la version de Google DeepMind, famille Aaronson |
| Le détecteur | « Documentation technique à venir » | Une API de détection « bientôt », détails en cours |
| La relecture | Un texte relu peut être marqué | Le filigrane ne s'attache qu'aux mots choisis par Claude, une relecture légère laisse presque rien à marquer |
| Le code | Non précisé | Moins filigrané : pas de choix là où le code doit être exact, le marquage peut se loger dans les commentaires |
| La traduction | Efface le signal d'un texte filigrané | Une traduction produite par Claude porte elle-même un filigrane, chaque mot étant choisi par Claude |
| Coût et vitesse | Non précisés | Impact négligeable, aucun token en plus, même prix |
| Les modèles actuels | « Travaille à ajouter la prise en charge » | Déploiement « au cours des prochains mois » |
Sur la relecture, précisément l'angoisse née du thread Reddit, la réponse est technique. Le filigrane « ne s'applique qu'aux mots que Claude choisit ». Quand Claude relit un texte humain et le rend légèrement édité, « presque tous les mots sont ceux de la personne », et il ne reste « que très peu de chose, voire rien, à quoi le filigrane puisse s'attacher ». La détection dépend de la longueur du texte et de l'intensité de l'édition. Anthropic assume la limite : une marque ne peut pas distinguer « Claude a écrit ceci » de « Claude a lourdement édité ceci ».
Sur l'effacement, le billet précise la gradation. Une édition légère « ne supprimera probablement pas complètement » le filigrane. Une réécriture complète, où chaque mot est remplacé, l'effacera, « auquel cas on peut d'ailleurs se demander si le texte peut encore être décrit comme généré par IA ». Le code, lui, sera moins marqué que la prose : quand une seule sortie est correcte, « 2 + 2 = 4 » par exemple, il n'y a pas de choix à orienter. Le filigrane peut en revanche se nicher dans les choix arbitraires, les commentaires de code en tête, « avec un effet négligeable sur le code réellement produit ».
Deux garanties complètent le tableau. Côté coût : pas de token supplémentaire, un impact négligeable sur la vitesse, le même prix à servir et à utiliser. Côté vie privée : rien dans le filigrane ni dans sa clé ne permet de retrouver une information sur l'utilisateur, son organisation ou ses conversations. Pour les fichiers, Anthropic précise que la note C2PA est « très différente d'un filigrane » : rien n'est modifié ni caché dans le fichier, n'importe quel outil compatible C2PA peut la lire, et Anthropic fournira son propre outil de vérification.
Le billet ferme enfin deux débats. Sur les détecteurs commerciaux, qui « n'ont pas notre clé » : ils cherchent des tics de style, par exemple la construction « this isn't [X], it's [Y] » ou le mot « quietly », et « repérer ces motifs est fondamentalement différent de vérifier un filigrane ». Sur la géographie, la raison du déploiement mondial est assumée : pas encore de « moyen durable » de limiter le marquage par région. Anthropic rappelle aussi que d'autres grands développeurs signataires du même code mettront en œuvre leurs propres filigranes, et que les modèles lancés avant le 2 août finiront par être couverts, « au cours des prochains mois », grâce à la période de transition prévue par la loi européenne.
Il reste des trous, et l'entreprise ne s'en cache pas : l'API de détection est annoncée sans date, sa clé restera bien sûr secrète, et aucune documentation technique ne détaille encore l'implémentation. Mais le procès en opacité, qui tenait la semaine dernière, a perdu sa pièce maîtresse : la méthode a désormais un nom, et un mode d'emploi.
Questions fréquentes
Claude ajoute-t-il un filigrane à ses textes ?
Désormais oui pour Fable 5.1 : lancé le 1ᵉʳ septembre 2026, il est le premier modèle Claude sorti après le 2 août et ses textes portent le filigrane (détail dans notre article). Les modèles lancés avant cette date, Opus 5 ou Sonnet 5 par exemple, restent hors périmètre.
Peut-on être repéré au travail ou en cours si on utilise Claude ?
Le filigrane est actif sur Fable 5.1 depuis le 1ᵉʳ septembre, mais l'API de détection reste en aperçu privé, fermée au public. Et une marque détectée indiquera seulement qu'un contenu « a pu être traité par Claude », pas qu'il a été écrit par une IA.
Comment savoir si un texte est écrit par une IA ?
Aucune méthode fiable à ce jour. Les détecteurs commerciaux produisent beaucoup de faux positifs, et le filigrane d'Anthropic n'est ni actif ni lisible par des tiers.
Le filigrane survit-il au copier-coller ?
Oui selon Anthropic, puisqu'il fait partie du texte. Il ne survit en revanche ni à une paraphrase, ni à une réécriture complète. Une édition légère ne le supprime probablement pas complètement, précise le billet du 14 août. Attention à la nuance : si la traduction est produite par Claude, elle porte elle-même un filigrane, chaque mot étant choisi par Claude.
Peut-on supprimer le filigrane de Claude ?
Les outils qui promettent d'enlever les « caractères invisibles » ne s'appliquent pas ici : le marquage décrit n'insère aucun caractère. Une réécriture complète où chaque mot est remplacé l'efface, selon le billet du 14 août.
Le filigrane ralentit-il Claude ou augmente-t-il les prix ?
Non. Le billet du 14 août parle d'un impact négligeable sur la vitesse, d'aucun token supplémentaire, et du même prix à servir et à utiliser.
Le filigrane peut-il identifier l'utilisateur ?
Non. Rien dans le filigrane ni dans sa clé ne permet de retrouver une information sur l'utilisateur, son organisation ou ses conversations.
Le filigrane concerne-t-il aussi les images ?
Les fichiers `.svg`, `.png` et `.jpg` recevront une note C2PA signée dans leurs métadonnées, une technique différente qui disparaît à la moindre conversion. N'importe quel outil compatible C2PA peut la lire, et Anthropic fournira son propre outil de vérification.
Est-ce que cela touche la France ?
Oui, mais pas seulement : la rubrique « Regions » du document précise que le marquage s'appliquera partout où Claude est proposé, dans le monde entier. Voir notre dossier sur l'AI Act en 2026.


