Language Selection

Retrouvez votre bien-être dans ces temps dure sur Terre , Essayez le MedBed Quantique!
Cliquez ici pour réserver votre séance

Famille et pour toute la Famille avec Le Medbed Quantique® Orgo-Life® une technologie du Canada

Advertising by Adpathway

         

 Advertising by Adpathway

La fronde contre le marquage des textes de Claude s’organise : ces outils traquent déjà les failles du filigrane

1 month_ago 76

         

NE LAISSER PAS LE 5G DETRUIRE VOTRE ADN Protéger toute votre famille avec les appareils Quantiques Orgo-Life®

  Publicité par Adpathway

Début août, Anthropic annonçait que les textes générés par Claude porteraient bientôt une marque invisible, censée permettre de repérer un contenu écrit généré par IA. Une annonce accueillie froidement et qui voit naître son lot d’outils pour contrecarrer la mesure.

La mesure a été prise pour se conformer à l’AI Act européen.

Le 11 août 2026, Anthropic annonçait que les textes produits par les modèles de Claude lancés après le 2 août porteraient un « watermark » invisible. Et ce, que le texte soit collé dans un mail, un document Word ou tout autre support de destination.

Au moment de l’annonce, la mesure interroge et l’entreprise américaine ne détaille pas le mécanisme employé pour appliquer cette marque indélébile. Une zone d’ombre comblée par Anthropic le 14 août 2026, dans une publication sur son site officiel. Mais les précisions apportées n’ont fait qu’accroître la grogne d’une partie des utilisateurs.

— Thariq (@trq212) August 15, 2026

Ce contenu est bloqué car vous n’avez pas accepté les cookies et autres traceurs. Ce contenu est fourni par Twitter.
Pour pouvoir le visualiser, vous devez accepter l’usage étant opéré par Twitter avec vos données qui pourront être utilisées pour les finalités suivantes : vous permettre de visualiser et de partager des contenus avec des médias sociaux, favoriser le développement et l’amélioration des produits d’Humanoid et de ses partenaires, vous afficher des publicités personnalisées par rapport à votre profil et activité, vous définir un profil publicitaire personnalisé, mesurer la performance des publicités et du contenu de ce site et mesurer l’audience de ce site (en savoir plus)

En cliquant sur « J’accepte tout », vous consentez aux finalités susmentionnées pour l’ensemble des cookies et autres traceurs déposés par Humanoid et .

Vous gardez la possibilité de retirer votre consentement à tout moment. Pour plus d’informations, nous vous invitons à prendre connaissance de notre Politique cookies.

Comment fonctionne la watermark d’Anthropic

Anthropic explique que le mécanisme repose sur une légère modification du principe aléatoire avec lequel les chatbots choisissent les mots qu’ils ajoutent à une phrase. Les grands modèles de langage génèrent le texte mot par mot (token). Chaque token se voit attribuer une probabilité d’apparaître ensuite.

surfshark

Surfshark One à partir de 2,49€ / Mois !

Jusqu’au 7 septembre, Surfshark surclasse tous ses nouveaux clients ! La suite de cybersécurité complète + VPN débarque au prix de la formule de base, soit 2,49€ par mois seulement. VPN, antivirus, bloqueur de pub à prix mini !

Prenant l’exemple d’un passage évoquant un ciel « couvert » ou « nuageux », l’entreprise explique que, dans une utilisation sans watermark, le ciel a autant de chances d’être décrit comme « couvert » que « nuageux ».

Désormais, le filigrane ajoute un pilotage déterminé par une clé cryptographique propre à Anthropic. Le mot choisi reste toujours plausible et naturel, mais la séquence de choix, une fois analysée avec la bonne clé, révèle une signature statistique.

En réalité, la technologie n’est pas nouvelle : il s’agit d’une version personnalisée de SynthID-Text, un tatouage numérique similaire dévoilé par Google DeepMind en 2024.

Mais si la technologie existe déjà, elle n’a pas pour autant évité la grogne d’une partie des utilisateurs, qui y voient une multitude de limites, parfois assumées par Anthropic. Parmi elles, le fait que la marque ne révèle rien sur la nature de l’intervention. Un texte simplement corrigé ou légèrement reformulé par Claude peut porter la même trace qu’un texte entièrement généré par IA. À l’inverse, un texte fortement réécrit ou trop court peut échapper à la détection.

Une défiance qui se traduit par des outils

Une défiance qui a rapidement pris la forme d’une course aux outils de contournement. Un dépôt GitHub baptisé watermarks-remover, compte déjà 12,4k étoiles sur la plateforme. Il propose de neutraliser les marques attribuées à l’IA, qu’elles proviennent de Claude, Gemini ou d’autres modèles. Sa méthode combine trois approches : supprimer les caractères Unicode invisibles déjà présents dans un texte, retirer les métadonnées C2PA des fichiers, et tenter d’affaiblir les filigranes statistiques en faisant réécrire le texte par un second modèle, sans garantie d’efficacité sur ce dernier point.

Une autre initiative prend le problème à l’envers. Plutôt que de proposer un outil de suppression, elle teste méthodiquement la robustesse de SynthID-Text pour en cartographier les limites.

Ainsi, selon l’étude, les retouches les plus intuitives comme remplacer des tirets ou convertir l’anglais américain en anglais britannique échouent presque toutes.

Une seule méthode s’avère réellement efficace : non pas supprimer des caractères, mais en ajouter. L’étude insère des sélecteurs de variation Unicode, des caractères invisibles normalement utilisés pour préciser l’affichage d’un emoji ou d’un caractère chinois, japonais ou coréen, dans environ 20 à 30 % du texte. Dans ces conditions expérimentales, cela a systématiquement suffi à faire échouer le détecteur.

Toute l'actu tech en un clien d'oeil

Toute l'actu tech en un clin d'œil

Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !

Logo PWA


read-entire-article

         

        

Une nouvelle Vibration dans le Monde entier avec les Franchise Medbed Quantique®!  

Protéger toute votre famille avec la technologie Orgo-Life®

  Advertising by Adpathway