Anthropic a annoncé l’ajout d’un filigrane invisible dans les textes générés par Claude pour se conformer à l’AI Act de l’Union européenne, mais des développeurs ont publié quasi aussitôt des méthodes de contournement. Selon Wired, un code de suppression est devenu viral sur GitHub, a été enregistré plus de 20 000 fois sur X et a attiré plus de 100 contributeurs. L’objectif d’Anthropic est de rendre un texte détectable “par une machine” comme synthétique, au risque d’amendes pouvant aller jusqu’à 3% du chiffre d’affaires annuel, tandis que des outils indépendants de contournement restent autorisés par le cadre décrit dans l’extrait.
Le filigrane s’appuie sur SynthID, une technique de Google qui laisse un motif statistique dans les choix de mots et de formulations, imperceptible à la lecture mais repérable par un détecteur. Plusieurs approches d’effacement circulent déjà : générer plusieurs réécritures via un autre grand modèle de langage, remplacer des mots par des synonymes, réorganiser des phrases, ou condenser puis traduire vers une langue très éloignée avant de retraduire. Anthropic a d’ailleurs reconnu que des contenus fortement édités, paraphrasés ou traduits peuvent ne plus porter le filigrane, ce qui limite mechanically la robustesse du marquage dès que le texte est retravaillé.
L’extrait met aussi en avant un angle opérationnel : le filigrane est invisible pour l’utilisateur et le futur outil de détection d’Anthropic ne fournirait qu’une probabilité qu’un texte ait été “touché” par Claude, ce qui ouvre la porte à des faux positifs et à des usages de preuve fragiles (recrutement, accusations d’usage d’IA, attribution). Reste une inconnue centrale : l’efficacité réelle des contournements ne pourra être confirmée qu’au moment où Anthropic publiera son logiciel ou son API de détection, promise “bientôt”, pendant que les laboratoires signataires du code de pratique de transparence de l’UE — 190 organisations, dont OpenAI, Microsoft et Meta — arbitrent encore sur l’implémentation de leurs propres filigranes.
L'essentiel Cybersécurité, IA & Tech
Rejoignez la communauté. 3 fois par semaine, recevez l'analyse des tendances par Marc Barbezat. Pas de spam, juste de l'info.
Pour approfondir le sujet
Des programmeurs affirment avoir déjà trouvé des solutions de contournement aux filigranes invisibles de Claude.
La semaine dernière, Anthropic a annoncé l'intégration de filigranes invisibles dans les contenus générés par IA afin de se conformer à la nouvelle réglementation européenne. Quelques heures plus tard, des solutions de contournement étaient déjà proposées en ligne. Lire la suite
EU AI Act : Anthropic généralise le marquage invisible C2PA de Claude
Pour se conformer au règlement européen sur l'IA, Anthropic intègre un marquage invisible et des métadonnées C2PA aux textes et fichiers générés par Claude. Lire la suite
Serveurs, API, temps de veille...
DCOD est indépendant et sans revenus. Soutenez le site pour l'aider à couvrir ses frais techniques.

