NewsIA
En direct
Société & IA

Anthropic filigrane chaque texte généré par Claude

Depuis le 2 août, Anthropic marque chaque sortie de Claude d'un filigrane invisible pour l'AI Act. Des développeurs tentent déjà de le retirer.


PartagerXLinkedInEmail
Anthropic filigrane chaque texte généré par Claude
L'essentiel en 30 secondes
  • Depuis le 2 août 2026, Anthropic marque chaque texte généré par Claude d'un filigrane invisible.
  • Objectif : se conformer à l'article 50 de l'AI ActLe règlement européen de 2024 qui encadre le développement et l'usage de l'IA selon des niveaux de risque. européen sur la transparence.
  • Le filigrane ne prouve pas que Claude a rédigé le texte, seulement qu'il l'a traité.
  • Des développeurs publient déjà des outils pour le retirer, et la paraphrase l'efface.

La traçabilité de l'IA passe un cap. Le 2 août 2026, jour d'entrée en vigueur d'un pan clé de l'AI Act européen, Anthropic a commencé à glisser un filigrane imperceptible dans chaque réponse de Claude. Une réponse réglementaire assumée, que des développeurs cherchent déjà à contourner.

01 · Le mécanisme

Un filigrane dans les mots

La technique s'appelle le filigranage statistique. Au moment où Claude choisit ses mots, il biaise très légèrement ses probabilités pour introduire un motif invisible à l'œil, mais détectable par une machine. Ce motif « voyage » avec le texte quand on le copie-colle et survit à des retouches légères. Pour les images, Anthropic ajoute des métadonnées C2PA. Le déploiement est mondial, pas seulement européen : Claude, l'APIApplication Programming Interface, le canal d'accès programmatique à un service ou à un modèle., Claude Code et les autres interfaces sont concernés.

02 · La règle

L'AI Act comme déclencheur

Conformité européenne, livrée mondialement : Anthropic marque les sorties de Claude partout.D'après Euronews

Pourquoi maintenant ? Parce que l'article 50 de l'AI Act oblige à rendre le contenu généré par IA identifiable par d'autres systèmes, sous peine d'amendes salées : jusqu'à 15 millions d'euros ou 3 % du chiffre d'affaires mondial. Plutôt que de gérer deux versions de Claude, Anthropic applique la règle partout. Un contraste net avec OpenAI, qui avait construit un détecteur de texte en 2024 avant de le remiser, craignant de faire fuir ses utilisateurs.

03 · Les limites

Ce que le filigrane ne fait pas

Attention au malentendu. Un filigrane détecté signifie que Claude a produit ou traité le texte, pas qu'il l'a entièrement rédigé : il peut avoir juste corrigé l'orthographe ou traduit un brouillon humain. Surtout, le marquage est fragile. Il survit au copier-coller, mais s'efface avec la paraphrase lourde, la traduction, ou sur les passages trop courts. Autrement dit, les techniques de contournement les plus basiques suffisent à le faire disparaître.

2 aoûtdéploiement, jour de l'AI Act
15 M€d'amende max (ou 3 % du CA)
4,6 kétoiles pour un outil de retrait sur GitHub
04 · La riposte

Les développeurs cassent déjà

La réaction n'a pas tardé. Des projets open-source de retrait ont surgi en quelques heures : nettoyage de caractères invisibles, réécriture par un modèle non-Claude pour brouiller la signature, suppression combinée des marqueurs C2PA et SynthID. Leur argument : un filigrane textuel n'est pas une preuve fiable d'origine. Anthropic promet de son côté une API de détection, sans date, et n'a pas publié ses seuils, ce qui rend l'efficacité réelle impossible à valider pour l'instant.

05 · L'enjeu français

France : l'école et la détection en ligne de mire

Pour la France, l'enjeu est concret. Un tel filigrane pourrait aider les examinateurs à repérer les copies massivement générées par IA, dans un contexteLa fenêtre de contexte : le nombre maximum de tokens qu'un modèle peut traiter en une seule requête (ex : 200k, 1M). où la fraude au bac progresse. Mais l'Éducation nationale recommande justement d'éviter les détecteurs d'IA, jugés peu fiables et générateurs de faux positifs. Et comme le marquage ne survit ni à la paraphrase ni à la traduction, son efficacité contre la triche reste incertaine. Le sujet rejoint directement notre enquête sur le contenu IA sur LinkedIn et notre article sur la désinformation par IA. Les termes techniques sont expliqués dans notre glossaire de l'IA.

Sources

  • TechCrunch, « Anthropic says it will watermark text generated by its AI models » (11 août 2026)
  • Euronews, « EU compliance, delivered globally: Anthropic to watermark Claude's output worldwide »
  • Decrypt, « Anthropic Is Quietly Watermarking Every Claude AI Output »
  • The Register, « Anthropic pledges to embed watermarks to help discern AI slop »
  • Support Anthropic, « How Claude marks AI-generated content »

Questions fréquentes

Comment fonctionne le filigrane de Claude ?
C'est un filigranage statistique : au moment de choisir ses mots, Claude biaise très légèrement ses probabilités pour introduire un motif invisible à l'œil mais lisible par une machine. Le motif suit le texte au copier-coller et survit à des retouches légères. Pour les images, Anthropic ajoute des métadonnées C2PA.
Depuis quand et sur quels produits ?
Depuis le 2 août 2026, jour d'entrée en vigueur d'un pan clé de l'AI Act. Le déploiement est mondial et couvre Claude, l'API, Claude Code et les autres interfaces. Les versions de Claude antérieures à cette date ne sont pas marquées.
Pourquoi Anthropic fait-il cela maintenant ?
Pour se conformer à l'article 50 de l'AI Act européen, qui oblige à rendre le contenu généré par IA identifiable par d'autres systèmes. Les amendes peuvent atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial. Anthropic applique la règle partout plutôt que de gérer deux versions.
Le filigrane prouve-t-il qu'un texte a été écrit par Claude ?
Non. Il indique que Claude a produit ou traité le texte, pas qu'il l'a entièrement rédigé : Claude a pu simplement corriger l'orthographe ou traduire un brouillon humain. C'est une nuance importante pour éviter les fausses accusations de contenu généré.
Peut-on retirer le filigrane ?
Oui, assez facilement. Le marquage survit au copier-coller mais s'efface avec la paraphrase lourde, la traduction ou sur les passages courts. Des outils open-source de retrait sont déjà apparus, dont un dépassant 4 600 étoiles sur GitHub. Son efficacité réelle contre les usages malveillants reste donc incertaine.
Quelle différence avec SynthID de Google ?
SynthID de Google marque le texte, les images et l'audio depuis 2024, avec une technique statistique proche. OpenAI, à l'inverse, a renoncé au filigrane texte par crainte de perdre des utilisateurs. Dans tous les cas, le filigrane textuel reste moins robuste que le marquage d'image.

Source : techcrunch.com

À lire aussi