Anthropic Introduit un Filigrane Invisible sur les Textes Générés par Claude
Anthropic a annoncé l’intégration d’un filigrane invisible sur les textes générés par son modèle d’IA, Claude, ainsi que l’ajout de métadonnées C2PA sur les fichiers pour se conformer à l’AI Act. Cette fonctionnalité sera activée sur tous les modèles lancés après le 2 août 2026.
Le filigrane ne modifie pas le contenu des textes, mais utilise une clé secrète pour rendre chaque sortie vérifiable. Selon Anthropic, cette méthode, dérivée de SynthID-Text, ne dégrade pas la qualité des réponses et ne génère pas de coûts supplémentaires.
Le code généré par Claude est peu concerné par ce filigrane, car il nécessite des choix arbitraires qui ne s’appliquent pas aux sorties exactes du code. En revanche, les traductions sont entièrement marquées, facilitant leur identification comme textes générés.
Concernant les fichiers images, des métadonnées cryptographiquement signées seront ajoutées, mais sans altérer le fichier lui-même. Le filigrane ne permet pas d’identifier les utilisateurs, se concentrant uniquement sur la probabilité d’intervention de Claude.
Une API de détection sera mise à disposition, mais ne fonctionnera pas comme les outils existants, limités à des probabilités sans certitude. Les modèles de Claude lancés avant le 2 août 2026 ne seront pas concernés par ce filigrane, mais une période de transition est prévue.
Enfin, le marquage sera universel, sans possibilité de contournement par des VPN, les textes étant marqués indépendamment de la localisation de l’utilisateur.
Source : Blog du Modérateur



