Claude va signer ses contenus : ce que dit l'annonce d'Anthropic

Anthropic a publié la manière dont elle marquera les contenus générés par Claude. Les textes porteront un filigrane invisible et les fichiers générés recevront des métadonnées de provenance signées. La société a signé le code de bonnes pratiques européen sur la transparence des contenus générés par IA, prévu par l'article 50, paragraphe 2, de l'AI Act, et cet article détaille ses engagements, le fonctionnement du marquage et ses limites.

Ce qu'Anthropic s'engage à faire

Anthropic a signé le code de bonnes pratiques sur la transparence des contenus générés par IA, à la fois comme fournisseur de modèles d'IA générative et comme fournisseur de systèmes d'IA générative. Elle annonce quatre engagements.

Les nouveaux modèles marqueront les contenus dès le premier jour. Les modèles Claude lancés dans l'Union européenne à partir du 2 août 2026 prennent en charge un marquage lisible par machine dès leur lancement : les textes générés portent un filigrane intégré et les fichiers générés reçoivent des métadonnées de provenance signées lorsque le format le permet.

Le marquage s'applique partout où tu utilises Claude. Il concerne les contenus produits par les modèles pris en charge sur Claude Platform, c'est-à-dire l'API, sur Claude, Claude Code, Claude Cowork et Claude Tag, et partout où Claude est proposé dans le monde. Anthropic précise que certaines plateformes ou fonctionnalités peuvent ne pas prendre en charge tous les types de marquage.

Anthropic aidera à détecter ses marques. La société indique qu'elle permettra aux utilisateurs et aux tiers de détecter les marques de Claude, comme le code l'exige, et qu'elle publiera des précisions dans une documentation à venir.

Les modèles existants sont en cours de traitement. La loi prévoit une période transitoire pour les modèles lancés avant le 2 août 2026, et Anthropic travaille à leur ajouter le marquage.

Comment fonctionne le marquage

Deux techniques complémentaires sont utilisées : un filigrane intégré dans le texte et des métadonnées de provenance signées attachées aux fichiers.

Le filigrane est tissé directement dans le texte produit par le modèle. Tu ne le vois pas et il ne change ni le sens, ni la qualité, ni la lisibilité de la réponse. Comme il fait partie du texte, il voyage avec lui lorsque tu le copies ailleurs et peut survivre à certaines modifications. Le marquage étant appliqué au niveau du modèle, il est présent quel que soit le produit Claude d'où provient le texte.

Les métadonnées de provenance signées, elles, sont attachées aux fichiers générés dans les formats pris en charge, par exemple un fichier SVG, PNG ou JPG. Elles suivent le standard ouvert C2PA, utilisé dans l'ensemble du secteur pour enregistrer des informations de provenance. Lorsqu'une étiquette signée est présente, elle indique que le fichier a été traité par Claude et permet de détecter s'il a été altéré.

Détecter les marques de Claude

Anthropic travaille à permettre aux utilisateurs et aux tiers de détecter ses filigranes et ses métadonnées de provenance. La détection consiste à vérifier si un texte ou un fichier porte une marque prise en charge. Si une marque est trouvée, cela indique que le contenu a pu être traité par Claude. Les mécanismes de détection seront précisés dans une documentation technique à venir.

Ce que le marquage ne prouve pas

Anthropic consacre une section entière aux limites de ces marques, et elle mérite d'être lue attentivement avant d'en tirer des conclusions.

Une marque détectée constitue un signal, pas une preuve définitive. Elle indique que le contenu a pu être traité par Claude, sans établir sa provenance complète. Claude peut ne pas être l'auteur original, puisque les utilisateurs s'en servent souvent pour relire, traduire, résumer ou convertir des documents : le résultat peut porter la marque alors que les idées, le texte ou les données viennent d'ailleurs. Le contenu peut aussi avoir été modifié, tronqué ou combiné avec d'autres éléments après son passage par Claude.

À l'inverse, l'absence de marque détectée ne signifie pas que le contenu n'a pas été généré ou traité par une IA. Anthropic cite plusieurs cas : le contenu a été généré par un modèle antérieur à la prise en charge du marquage, le texte a été fortement modifié, paraphrasé, traduit ou mêlé à d'autres écrits, le passage est trop court pour offrir un signal fiable, les métadonnées d'un fichier ont été supprimées par une conversion de format, un ré-enregistrement ou une capture d'écran, ou encore le contenu provient d'une plateforme, d'une fonctionnalité ou d'un type de fichier où ce type de marquage n'était pas pris en charge.

Si tu développes avec Claude

Anthropic est explicite sur ce point : si tu déploies Claude dans ton propre produit, il t'appartient d'apprécier de façon indépendante ce que l'article 50 exige de tes produits et de tes services. La société indique vouloir t'aider à respecter tes propres obligations de transparence et annonce des orientations techniques sur son approche du marquage et de la détection.

Autrement dit, le marquage réalisé par le fournisseur ne règle pas tes obligations à toi. Il te permet seulement de savoir ce que fait l'outil que tu utilises, ce qui est le point de départ de ton analyse, pas son aboutissement.

Questions fréquentes

Le filigrane survit-il à un copier-coller ?

Oui. Comme il fait partie du texte lui-même, il voyage avec lui lorsque le texte est copié ailleurs, et il peut survivre à certaines modifications. Anthropic précise toutefois qu'un texte fortement modifié, paraphrasé ou traduit peut ne plus porter de marque détectable.

Mes fichiers générés sont-ils marqués eux aussi ?

Lorsque Claude génère un type de fichier pris en charge, par exemple SVG, PNG ou JPG, des métadonnées de provenance signées au standard C2PA y sont attachées. Anthropic précise que ces métadonnées ne sont pas nécessairement prises en charge sur toutes les plateformes, notamment lorsque Claude est utilisé via un partenaire cloud.

Pourrai-je vérifier moi-même si un texte vient de Claude ?

Anthropic annonce qu'elle permettra aux utilisateurs et aux tiers de détecter ses marques, et renvoie les modalités à une documentation technique à venir. Il faut garder à l'esprit qu'un résultat positif indique seulement que le contenu a pu être traité par Claude.

Les modèles que j'utilise déjà marquent-ils leurs contenus ?

Pas encore nécessairement. Le marquage dès le lancement concerne les modèles mis à disposition dans l'Union européenne à partir du 2 août 2026. La loi prévoit une période transitoire pour les modèles antérieurs, auxquels Anthropic travaille à ajouter le marquage.

Une question sur ta conformité à l'AI Act ?

Tu veux savoir ce que l'article 50 exige de ton activité, ce que cela change dans tes contrats de prestation et quelles mentions prévoir sur tes publications? Contacte Mutatis Legal pour en parler.

Prendre rendez-vous : https://calendly.com/sophie-mutatis/call-decouverte

Email : sophie@mutatis.legal

Sophie Everarts de Velp

Sophie Everarts de Velp est juriste (LL.M.), spécialisée en propriété intellectuelle, droit des nouvelles technologies, vie privée et e-commerce.

https://www.sedv-legal.com
Suivant
Suivant

DMA : la Commission européenne inflige 890 millions d'euros à Google