
Anthropic ajoute des filigranes invisibles au texte de Claude dans le monde entier en vertu de l'article 50 de la loi européenne sur l'IA
Anthropic a commencé à intégrer des filigranes statistiques invisibles dans le texte généré par ses modèles Claude et à attacher des métadonnées C2PA aux fichiers image, en appliquant ces marquages à l'échelle mondiale afin de se conformer à l'article 50 de la loi européenne sur l'IA, entré en vigueur le 2 août 2026.
Engagement d'Anthropic en faveur du filigrane
Anthropic a commencé à attacher des marquages lisibles par machine aux textes et images générés par ses modèles Claude, en les appliquant aux utilisateurs du monde entier plutôt qu'en Europe uniquement. L'entreprise a confirmé dans un document d'assistance qu'elle a signé le code de conduite de l'article 50(2) de la loi européenne sur l'IA sur la transparence des contenus générés par l'IA, ce qui en fait l'un des premiers grands développeurs d'IA à définir de manière opérationnelle la façon dont il entend se conformer aux règles de transparence de l'UE entrées en vigueur le 2 août 2026. Le marquage couvre l'ensemble des produits de l'entreprise, y compris son API développeur, les applications Claude, Claude Code, Claude Cowork et Claude Tag, et est appliqué à l'échelle mondiale. Le système fonctionne également partout où Claude est proposé, y compris via les services cloud d'Amazon, Google et Microsoft.
Fonctionnement du filigrane
Pour le texte, Claude intègre un filigrane imperceptible directement dans le résultat généré via un motif statistique dans la façon dont le modèle sélectionne les mots ou les tokens. Anthropic précise que le filigrane ne modifie ni le sens, ni la qualité, ni la lisibilité d'une réponse, et reste en place lorsque le texte est copié-collé ou légèrement modifié. L'entreprise n'a pas divulgué la recette technique précise, mais l'approche fonctionne au niveau des tokens : le modèle est incité à préférer certains tokens, laissant une signature statistique qu'un détecteur, connaissant la clé et l'algorithme, peut reconstruire. La méthode fonctionne mieux sur les textes longs et discursifs, et moins bien sur le code, les formules, les citations, les chiffres et les réponses courtes, où le modèle a moins de liberté dans le choix des mots.
Pour les fichiers, Anthropic attache des métadonnées de provenance signées aux formats d'image pris en charge, y compris.png,.jpg et.svg, en suivant la norme ouverte C2PA maintenue par la Coalition for Content Provenance and Authenticity. Cette même norme a été adoptée par Adobe, la BBC et plusieurs fabricants d'appareils photo pour étiqueter l'origine des images.
- L'article 50 de la loi européenne sur l'IA entre en vigueur, imposant des marquages lisibles par machine sur les contenus générés par l'IA
- Anthropic annonce des filigranes textuels invisibles et des métadonnées de fichiers C2PA pour les modèles Claude, appliqués à l'échelle mondiale
- Date limite pour que les fournisseurs d'IA mettent les modèles hérités en conformité avec les règles de transparence de l'UE
Limitations et ambiguïtés
Anthropic a souligné deux limitations clés. Premièrement, un contenu peut déclencher une marque détectée même si Claude a été utilisé uniquement pour relire, formater ou traduire un texte rédigé par un humain. L'entreprise a déclaré que la détection d'un filigrane Claude signifie que le texte a pu être traité par Claude mais ne confirme pas la source.
Claude n'est peut-être pas l'auteur original. Les gens utilisent souvent Claude pour relire, traduire, résumer ou convertir des fichiers. Le résultat peut porter une marque Claude même si les idées, le texte ou les données sous-jacents proviennent d'une autre source.
Deuxièmement, si le texte est fortement réécrit, mélangé à d'autres copies, traduit ou tout simplement trop court, le filigrane peut ne pas être détectable. Anthropic développe également des outils qui permettront aux utilisateurs et aux entreprises tierces de rechercher la marque, avec des détails techniques plus précis promis ultérieurement.
Règles européennes et réponses du secteur
Ces modifications visent à satisfaire à l'article 50 de la loi européenne sur l'IA, qui, depuis le 2 août 2026, oblige les fournisseurs de systèmes d'IA à ajouter des marquages lisibles par machine aux contenus générés ou manipulés par l'IA. Les obligations répartissent la responsabilité entre les fournisseurs, qui construisent et fournissent les modèles d'IA, et les déployeurs, l'ensemble plus large des organisations qui utilisent ces systèmes pour créer et publier du contenu. Les violations risquent d'entraîner de lourdes amendes. Les fournisseurs d'IA ont jusqu'au 2 décembre 2026 pour mettre leurs modèles hérités en conformité.
Anthropic fait partie d'environ 190 organisations qui ont signé un code de bonne conduite volontaire de l'UE à la fin du mois dernier, dont Google, Meta, Microsoft, Mistral, OpenAI, Black Forest Labs et Synthesia. Google a développé SynthID, une technologie de filigrane et de détection comprenant SynthID-Text, et fait pression pour que les géants du secteur comme Apple, Nvidia et OpenAI adoptent cette norme. D'autres plateformes ont accéléré leurs propres mesures d'identification de l'IA : LinkedIn teste un bouton « semble être du contenu IA de mauvaise qualité », Substack s'est associé à Pangram pour la détection de contenu IA, et Snap a cessé de promouvoir les vidéos générées par l'IA dans son fil d'actualité principal. Anthropic n'a pas encore publié d'outil de détection de filigrane comme le demande le code de bonne conduite de l'UE.


