Anthropic intègre des filigranes IA pour aider l’UE à identifier les contenus générés par l’IA
Anthropic a annoncé l’intégration de filigranes dans son modèle d’intelligence artificielle, Claude, afin d’aider l’Union européenne à mieux détecter les contenus générés par l’IA. Ce développement soulève des questions sur la fiabilité et l’efficacité de cette technologie.
La notice accompagnant cette fonctionnalité précise que la détection d’une marque indique seulement qu’un contenu « peut avoir été traité par Claude ». Cela signifie que si un utilisateur fait relire ou traduire un texte par l’IA, celui-ci sera marqué, mais l’absence de marque ne garantit pas qu’un contenu soit exempt d’intervention de l’IA. En effet, des passages trop courts ou des réécritures substantielles peuvent faire disparaître le signal. De plus, des études antérieures ont montré que des filigranes d’images pouvaient être effacés, laissant planer des doutes sur la résistance des filigranes textuels.
Pour des acteurs tels que les enseignants ou les recruteurs, un détecteur officiel pourrait s’avérer plus utile que les outils de détection actuels, souvent critiqués pour leur taux élevé de faux positifs. Par ailleurs, Anthropic, qui fait l’objet d’une attention accrue suite à des modifications récentes de sa politique de confidentialité, semble vouloir afficher sa volonté de se conformer aux réglementations en matière d’IA.
Les utilisateurs pourront bientôt tester leurs textes à l’aide du détecteur de Claude, mais
Source : Clubic.



