Actualité

Claude d’Anthropic : des filigranes invisibles pour une IA conforme aux régulations

Les textes générés par l’intelligence artificielle deviennent de plus en plus indiscernables de ceux écrits par des humains, soulevant des questions sur la crédibilité, les droits d’auteur et la détection des contenus créés par des modèles linguistiques. Pour répondre à ce défi, Anthropic intègre des filigranes invisibles dans les réponses générées par son modèle Claude.

Adaptation mondiale aux régulations européennes

Cette initiative ne se limite pas à une décision interne de l’entreprise, mais s’inscrit dans le cadre de l’adaptation aux nouvelles réglementations européennes sur la transparence des contenus créés par l’IA. Bien que ces mesures soient impulsées par les règles de l’Union européenne, elles seront appliquées mondialement.

Anthropic a signé un code de conduite lié à l’article 50 de l’AI Act européen. Ce document établit les principes de marquage des contenus générés par les modèles IA pour faciliter leur identification. Ainsi, tous les nouveaux modèles Claude introduits à partir du 2 août 2026 seront équipés dès le départ d’un mécanisme de filigrane invisible. Pendant la période transitoire prévue par l’AI Act, une fonction similaire sera également ajoutée aux anciens modèles Claude.

Fonctionnement du filigrane invisible

Le nouveau mécanisme sera intégré directement dans le texte généré. Selon Anthropic, il n’affectera ni le sens des réponses, ni la qualité du langage, ni la lisibilité du contenu. Le filigrane prendra la forme d’informations lisibles par des outils appropriés, tout en restant totalement invisible pour l’utilisateur. Les détails techniques de ce procédé n’ont pas encore été révélés, mais la société prévoit de les publier ultérieurement avec des outils de détection.

Ce système fonctionnera indépendamment de la manière dont Claude est utilisé, couvrant aussi bien le service officiel, l’API, Claude Code, Claude Cowork et Claude Tag, ainsi que les plateformes cloud comme Amazon Web Services, Google Cloud et Microsoft Foundry.

Durabilité et implications du filigrane

Anthropic affirme que le filigrane « voyagera » avec le texte. Cela signifie qu’il restera présent même après avoir été copié dans un document ou un e-mail. Dans certains cas, il pourrait même survivre à une édition partielle du texte.

Cependant, cela ne constituera pas une preuve irréfutable d’auteur. La détection d’un filigrane indiquera simplement que le contenu pourrait avoir été généré ou modifié par Claude. L’utilisateur pourrait avoir utilisé le modèle uniquement pour corriger, traduire, résumer ou reformater son propre texte – prouver ce qui a réellement été fait restera impossible.

Anthropic prévoit également d’ajouter des métadonnées signées à certains formats de fichiers comme PNG, JPG et SVG, basées sur la norme C2PA, permettant de déterminer l’origine et l’historique de traitement des matériaux numériques.

L’introduction de ces filigranes invisibles montre que les producteurs de modèles IA se préparent à une nouvelle réalité réglementaire. Des engagements similaires envers le code de transparence européen ont déjà été confirmés par Google et Meta. Il semble donc que le marquage des contenus générés par intelligence artificielle deviendra bientôt un standard industriel.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *