Anthropic prévoit d’intégrer des filigranes invisibles aux textes générés par les modèles Claude pris en charge et d’ajouter des balises numériques de provenance aux fichiers pris en charge dans le monde entier, en application des nouvelles règles de transparence de la législation européenne sur l’IA.
Cette entreprise d’IA basée à San Francisco appliquera ces marques lisibles par machine aux contenus produits par les modèles Claude pris en charge dans le monde entier, et pas seulement au sein des frontières européennes. « Les modèles Claude lancés dans l’UE le 2 août 2026 ou après cette date prendront en charge le marquage lisible par machine dès leur lancement », a déclaré l’entreprise dans un article d’assistance. Anthropic travaille à ajouter la prise en charge du marquage aux anciens modèles pendant une période de transition.
Les marques couvriront les contenus produits par les modèles pris en charge dans l’ensemble de l’écosystème Claude, notamment l’application grand public, l’API destinée aux développeurs, Claude Code, Claude Cowork, et Claude Tag. Les textes générés par les modèles pris en charge via des partenaires cloud tels qu’AWS, Google Cloud et Microsoft Foundry comporteront également des filigranes intégrés, même si les métadonnées signées des fichiers peuvent ne pas être prises en charge sur toutes les plateformes.
Le fonctionnement du système de marquage à deux niveaux de Claude
Anthropic prévoit d’utiliser des techniques complémentaires selon les types de contenus. Pour les textes, les modèles Claude pris en charge intégreront un « filigrane imperceptible » directement dans les réponses, sans en modifier le sens ni la lisibilité. « Comme le filigrane fait partie du texte, il se déplacera avec lui lorsque celui-ci sera copié-collé ailleurs et pourra subsister après certaines modifications », a expliqué l’entreprise.
Pour les fichiers pris en charge, notamment les images SVG, PNG et JPG, Claude ajoutera des métadonnées de provenance signées au moyen de la norme ouverte C2PA. Ces métadonnées indiquent qu’un fichier a été traité par Claude et peuvent, selon Anthropic, signaler si le fichier a été altéré.
Les conséquences imprévues
La détection d’un filigrane Claude ne prouve pas que Claude a rédigé le contenu original. L’entreprise reconnaît que les utilisateurs se servent fréquemment de Claude pour relire, traduire ou résumer des contenus écrits par des humains. Ainsi, la version finale d’un éditeur pourrait porter une marque Claude même si toutes les idées proviennent d’un auteur humain.
À l’inverse, un contenu véritablement produit par Claude peut passer inaperçu. Les modifications importantes, la traduction, les passages très courts ou l’utilisation d’anciens modèles dépourvus de prise en charge du marquage entraînent tous la disparition des filigranes invisibles.
Cela crée une situation singulière pour les éditeurs et les créateurs de contenus. Un auteur qui soumet son brouillon à Claude pour le peaufiner se retrouve avec un texte marqué qu’il devra peut-être signaler — ou risque de contrevenir aux attentes en matière de transparence. Le Code de bonnes pratiques de l’UE prévoit des exemptions pour les corrections classiques qui ne modifient pas substantiellement le sens, mais la frontière entre « peaufiner » et « modifier substantiellement » reste floue.
Détection et limites
Anthropic indique qu’il publiera prochainement des outils de détection et une documentation technique, afin de permettre aux utilisateurs et aux tiers de vérifier la présence de marques. Mais l’entreprise prend soin de tempérer les attentes : une marque détectée constitue un signal, et non une preuve concluante.
Le système présente des vulnérabilités connues. Les métadonnées C2PA peuvent être supprimées lors d’une conversion de format, d’un nouvel enregistrement, de la création de captures d’écran ou d’un transfert vers des plateformes sociales. Les filigranes textuels peuvent ne pas résister à une paraphrase poussée. Alex Cui, directeur technique de GPTZero, a souligné que des outils gratuits ont contourné le SynthID de Google DeepMind et qu’une réécriture intensive peut venir entièrement à bout des filigranes.
En savoir plus : découvrez comment les règles de transparence de l’UE en matière d’IA influent sur les déclarations des entreprises concernant les contenus générés par l’IA.


