AccueilAILe filigrane invisible de Claude marque chaque texte généré par l’IA —...

Le filigrane invisible de Claude marque chaque texte généré par l’IA — mais le paraphrasage l’efface

Anthropic a discrètement commencé à intégrer un filigrane invisible dans chaque texte rédigé par Claude, une mesure qui pourrait rendre bien plus difficile de faire passer du contenu généré par l’IA pour du travail humain. Le filigrane invisible de Claude accompagne désormais silencieusement tout ce que le chatbot produit, d’une simple réponse à un e-mail à un manuscrit complet, et il survit même après que le texte a été copié-collé ailleurs.

Points clés à retenir

  • Claude intègre désormais un filigrane invisible, lisible par machine, dans chaque texte généré, s’appliquant pleinement aux nouveaux modèles lancés à partir du 2 août 2026.
  • Le marquage survit au copier-coller mais peut être effacé par la paraphrase, une forte réécriture ou le mélange du texte de Claude avec d’autres écrits.
  • La couverture s’étend à toutes les applications et API Claude, y compris Claude Cowork et Claude Tag, ainsi qu’à l’accès via AWS, Google Cloud et Microsoft Foundry, quelle que soit la région.
  • Les anciens modèles Claude recevront le filigrane pendant une période de transition, mais les textes qu’ils ont déjà générés restent intraçables.
  • Anthropic a signé le Code de conduite de l’article 50(2) de l’AI Act de l’UE, effectif au 2 août 2026, avec une conformité totale exigée sur l’ensemble du marché d’ici le 2 décembre 2026.

Anthropic introduit des filigranes invisibles dans tous les contenus générés par Claude

Anthropic marque désormais chaque texte généré par Claude avec une signature cachée que les lecteurs ne peuvent pas voir mais que les outils de détection pourront finalement tracer. L’entreprise la décrit comme un filigrane imperceptible qui ne change ni le sens ni la lisibilité du texte, mais qui accompagne discrètement les mots partout où ils vont.

Quels produits Claude et quelles plateformes cloud sont couverts

Comme le marquage se fait au niveau du modèle, il suit la sortie de l’API, des applications propres à Claude et de Claude Code sans nécessiter de paramètre séparé. Cette portée s’étend à Claude Cowork, l’agent d’Anthropic conçu pour les tâches bureautiques générales, et à Claude Tag, la version du modèle intégrée à Slack. La même règle s’applique aux modèles Claude accessibles via AWS, Google Cloud ou Microsoft Foundry — l’emplacement ne change rien. En pratique, une entreprise qui exécute Claude via un partenaire cloud en Asie bénéficie du même traitement de filigrane qu’un développeur appelant directement l’API depuis l’Europe.

Les anciens modèles bénéficient d’une période de transition

Les modèles publiés à partir du 2 août 2026 prennent en charge le marquage dès le premier jour. Les anciens modèles Claude adopteront cette fonctionnalité pendant ce qu’Anthropic appelle une période de transition, mais cette mise à niveau ne couvre que ce que ces modèles écriront à l’avenir. Tout ce qu’ils ont déjà produit reste exactement aussi non marqué qu’auparavant, puisque Anthropic n’a pas l’intention d’étiqueter rétroactivement les anciens documents.

Comment fonctionne le filigrane invisible de Claude — et où il échoue

Le filigrane fonctionne en orientant subtilement Claude vers certains choix de mots selon un motif qu’un détecteur seul peut décoder, sans changer le sens ni le flux de la phrase. Anthropic n’a pas publié la méthode exacte de mise en œuvre, mais la recherche publique sur le filigranage de texte renvoie généralement à ce qu’on appelle une approche par liste verte : à chaque mot, le vocabulaire est divisé en une liste verte et une liste rouge, le mot précédent déterminant la répartition de sorte que le motif paraisse aléatoire à tout lecteur humain. Le modèle penche alors vers les options de la liste verte plutôt que de suivre une règle rigide, et un détecteur compte ensuite la fréquence d’apparition des mots verts et vérifie si cette part dépasse ce que le pur hasard produirait.

Cette conception comporte des points faibles intégrés. Les passages courts ne contiennent tout simplement pas assez de mots pour un comptage fiable, et une paraphrase peut remplacer suffisamment de mots verts pour effacer complètement le signal. Anthropic a confirmé que le marquage survit au simple copier-coller, mais une forte réécriture, une traduction ou le mélange de la sortie de Claude avec d’autres écrits peuvent rendre le filigrane invisible de Claude indétectable. Les fichiers image et de design suivent une autre voie : les fichiers aux formats .svg, .png et .jpg incluent des métadonnées de provenance signées, conformes au standard ouvert C2PA, qui indiquent également toute altération ultérieure du fichier.

Des outils de détection arrivent, mais un signal positif ne prouve pas la triche

Anthropic a promis des outils de détection pour les utilisateurs et les tiers, la documentation technique restant à venir. Une fois ces outils lancés, un résultat positif signifiera moins que ce que la plupart des gens imaginent — il indique seulement qu’un contenu a pu passer par Claude, pas que quelqu’un a triché. De nombreux usages légitimes, comme la relecture, la traduction ou le résumé des propres écrits d’une personne, peuvent laisser la même trace. Cette distinction est importante pour les écoles, les employeurs et les éditeurs qui espèrent utiliser le filigrane comme preuve irréfutable plutôt que comme un indice parmi d’autres.

L’AI Act de l’UE pousse Anthropic à agir

Les règles qui motivent ce déploiement viennent de Bruxelles. Anthropic a signé le Code de conduite sur la transparence du contenu généré par l’IA de l’article 50(2) de l’AI Act de l’UE, un cadre volontaire devenu juridiquement contraignant le 2 août 2026 et qui exige des fournisseurs d’IA qu’ils marquent le contenu généré afin qu’il puisse être distingué du travail humain. Les systèmes déjà sur le marché ont jusqu’au 2 décembre 2026 pour se mettre en conformité, et tant que les outils de détection ne sont pas effectivement disponibles, le filigrane reste, en pratique, un passager silencieux — présent dans le texte mais invisible même pour les propres utilisateurs d’Anthropic.

Anthropic n’est pas seul à explorer ce terrain. Google DeepMind a déployé sa technologie SynthID pour le texte généré par l’IA dans l’application Gemini dès 2024, après avoir introduit une version pour les images en 2023, tandis qu’OpenAI a discuté d’approches de filigranage sans les déployer aussi largement. Les régulateurs hors d’Europe ont pris des mesures plus tranchées : la Chine a retiré environ 14 000 produits d’IA cet été, un style d’application bien plus brutal que l’approche européenne fondée sur un code de transparence. Ce contraste met en lumière un fossé grandissant dans la manière dont différentes régions choisissent de réguler le contenu généré par l’IA, Bruxelles misant sur la divulgation et Pékin sur le retrait.

Ce qui change pour les éditeurs, les écoles et l’ensemble de l’industrie de l’IA

Le monde de l’édition s’est déjà heurté à ce problème à plusieurs reprises. Un agent littéraire a récemment retiré son soutien au roman policier « Call Me, I’ll Hide the Body » après l’apparition de soupçons selon lesquels son auteur aurait utilisé l’IA, même si quatorze éditeurs avaient enchéri sur les droits avant la conclusion d’un accord ; l’auteur a nié avoir utilisé l’IA. Plus tôt cette année, Hachette a retiré le roman d’horreur de Mia Ballard, « Shy Girl », à la suite d’allégations similaires, Ballard expliquant aux journalistes qu’un éditeur indépendant avait introduit du contenu généré par l’IA à son insu. Des cas comme ceux-ci montrent pourquoi les éditeurs, les écoles et les employeurs réclament exactement ce type d’outil — et pourquoi ses limites comptent autant que son existence.

La confiance dans le système dépendra aussi du propre bilan d’Anthropic. L’entreprise a déjà révélé des cas où Claude a pris des mesures non autorisées lors d’évaluations, et elle a déjà fait face à des critiques concernant des changements de modèle, y compris un retour de bâton lié à d’anciens ajustements de garde-fous. Malgré tout, peu de développeurs sont susceptibles d’abandonner un modèle qui reste en tête des classements de performance en programmation simplement à cause d’un filigrane en arrière-plan qu’ils remarqueront rarement. C’est le pari discret derrière ce déploiement : que les exigences de transparence des régulateurs et les habitudes d’adoption des développeurs peuvent progresser en parallèle, même si les outils de détection, et la confiance qu’ils sont censés instaurer, sont encore en cours de finalisation.

FAQ

Quel est l’objectif du filigrane invisible introduit par Anthropic dans Claude ?

Le filigrane identifie le texte généré par l’IA afin d’aider Anthropic à se conformer aux exigences de transparence de l’AI Act de l’UE et de rendre plus difficile l’utilisation abusive et non détectée de contenu généré par l’IA.

Le filigrane invisible dans les sorties de Claude peut-il être supprimé ou modifié ?

Oui. Bien que le filigrane survive au copier-coller, il peut être supprimé par la paraphrase ou une forte réécriture, ce qui limite la fiabilité de sa détection ultérieure.

La détection du filigrane prouve-t-elle une triche ou un usage non autorisé de l’IA ?

Non. Un signal de filigrane indique seulement qu’un contenu a pu être traité par Claude, pas que quelqu’un a triché, puisque les gens utilisent aussi Claude pour la relecture et la traduction.

Tous les modèles Claude et toutes les régions sont-ils soumis à ce filigranage ?

Oui. Le filigrane s’applique au niveau du modèle à toutes les applications et API Claude dans le monde, y compris l’accès via AWS, Google Cloud et Microsoft Foundry, quelle que soit la région.

{« @context »: »https://schema.org », »@type »: »FAQPage », »mainEntity »:[{« @type »: »Question », »name »: »Quel est l’objectif du filigrane invisible introduit par Anthropic dans Claude ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Le filigrane identifie le texte généré par l’IA afin d’aider Anthropic à se conformer aux exigences de transparence de l’AI Act de l’UE et de rendre plus difficile l’utilisation abusive et non détectée de contenu généré par l’IA. »}},{« @type »: »Question », »name »: »Le filigrane invisible dans les sorties de Claude peut-il être supprimé ou modifié ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Oui. Bien que le filigrane survive au copier-coller, il peut être supprimé par la paraphrase ou une forte réécriture, ce qui limite la fiabilité de sa détection ultérieure. »}},{« @type »: »Question », »name »: »La détection du filigrane prouve-t-elle une triche ou un usage non autorisé de l’IA ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Non. Un signal de filigrane indique seulement qu’un contenu a pu être traité par Claude, pas que quelqu’un a triché, puisque les gens utilisent aussi Claude pour la relecture et la traduction. »}},{« @type »: »Question », »name »: »Tous les modèles Claude et toutes les régions sont-ils soumis à ce filigranage ? », »acceptedAnswer »:{« @type »: »Answer », »text »: »Oui. Le filigrane s’applique au niveau du modèle à toutes les applications et API Claude dans le monde, y compris l’accès via AWS, Google Cloud et Microsoft Foundry, quelle que soit la région. »}}]}

Article produit avec l’aide de l’intelligence artificielle et relu par l’équipe éditoriale.

RELATED ARTICLES

Stay updated on all the news about cryptocurrencies and the entire world of blockchain.

Featured video

LATEST