Claude ajoute un filigrane sur les textes générés pour pouvoir les identifier

Anthropic introduit un filigrane invisible pour ses contenus générés par IA

Anthropic a annoncé l’intégration d’un filigrane invisible dans les contenus générés par ses modèles Claude, incluant tant les textes que les fichiers. Ce marquage, qui sera lisible par les machines mais imperceptible pour les utilisateurs, entrera en vigueur pour les modèles lancés à partir du 2 août 2026, date à laquelle les obligations d’étiquetage des contenus IA, stipulées par l’IA Act dans l’Union européenne, prendront effet. L’entreprise prévoit également d’étendre cette fonctionnalité aux modèles déployés avant cette date. Anthropic précise : « La loi prévoit une période de transition pour les modèles d’Anthropic lancés avant le 2 août 2026, et nous travaillons à ajouter la prise en charge du marquage pour ces modèles également. »

Un marquage pour textes et fichiers

Pour identifier les contenus générés, Anthropic a mis en place deux méthodes distinctes. Pour les textes, un filigrane est intégré directement dans le contenu, garantissant qu’il reste invisible à la lecture et n’affecte ni le sens, ni la qualité, ni la lisibilité. Ce marquage est conservé lors du copier-coller et peut résister à certaines modifications. Concernant les fichiers, l’entreprise utilise le standard ouvert C2PA (Coalition for Content Provenance and Authenticity) pour intégrer des métadonnées de provenance lors de la création de fichiers SVG, PNG ou JPG, permettant ainsi d’attester de l’origine du contenu et de détecter d’éventuelles modifications.

Anthropic souligne que, face à la banalisation des contenus générés par IA, une transparence accrue et des indications sur l’origine des contenus sont essentielles pour fournir aux utilisateurs un contexte utile sur les informations qu’ils consomment.

Précédents en matière de détection

Ce lancement fait suite à l’entrée en vigueur, le 2 août 2026, de certaines obligations de transparence prévues par l’article 50 de l’AI Act, qui impose aux fournisseurs de systèmes d’IA de veiller à ce que les résultats générés soient marqués de manière détectable comme étant artificiellement générés ou manipulés.

Les tentatives précédentes de détection des contenus générés par l’IA ont rencontré des difficultés. En 2023, OpenAI avait développé un système de filigrane textuel affichant un taux d’efficacité de 99,9 %, mais cet outil n’a jamais été déployé à grande échelle. De son côté, Google développe SynthID, un filigrane invisible qui s’étend progressivement aux textes, à l’audio et à la vidéo, bien que son accès reste limité.

Source : Blog du Modérateur

Source
Leave a Comment

Comments

No comments yet. Why don’t you start the discussion?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *