Anthropic dévoile enfin comment son IA Claude signe secrètement les textes qu’elle écrit

Les textes produits par Claude intègrent maintenant une marque totalement invisible pour le lecteur. Anthropic vient d’expliquer précisément comment elle fonctionne. Le procédé utilisé repose sur une mécanique bien plus simple qu’il n’y paraît.

robot-laptop-ecriture
Crédit : 123rf

Depuis trois ans, les techniques servant à identifier les contenus générés par intelligence artificielle concernent presque exclusivement les images. Marques invisibles, métadonnées signées, mentions affichées en clair, les solutions se sont multipliées. Google prévoit de permettre à ses utilisateurs de supprimer les filigranes visibles de ses générateurs, tout en conservant SynthID au sein des fichiers. Pour le texte, aucun équivalent n’était disponible. Il n’existe ni pixel ni couleur capable de recevoir une signature.

Leur résistance reste pourtant limitée. Sur de simples images recadrées, le détecteur Content Seal de Meta a perdu plus de la moitié de son efficacité. Pour les textes, le problème est différent puisqu’aucun support matériel ne permet d’y cacher une marque. Anthropic, l’entreprise derrière Claude, a néanmoins signé en juillet 2026 le code européen de bonnes pratiques consacré à la transparence des contenus générés, avec environ 190 signataires. Depuis le 2 août, Bruxelles exige le marquage des textes créés par ces modèles.

Anthropic ajoute un filigrane aux textes de Claude en contrôlant le choix des mots

Anthropic détaille que Claude construit ses réponses mot par mot en sélectionnant chaque terme parmi plusieurs possibilités. Après une amorce comme « le temps était froid et… », différents adjectifs peuvent convenir de la même façon, puis le hasard décide normalement lequel sera utilisé. Le filigrane substitue à ce tirage une clé associée aux termes précédents. Le choix reste aléatoire, tandis que la succession obtenue peut être vérifiée par la personne disposant de cette clé. Aucun caractère invisible n’est inséré et aucun jeton supplémentaire n’est utilisé. Le système s’appuie sur SynthID-Text, présenté par Google DeepMind dans la revue Nature.

Anthropic admet que ce mécanisme présente plusieurs limites. La clé indique uniquement la probabilité que Claude ait contribué au contenu, sans déterminer si un humain l’a rédigé ni identifier celui d’un modèle rival. Le marquage devient nettement moins fiable avec les textes courts, les passages strictement factuels ou le code. Une réécriture intégrale suffit à le faire disparaître. L’entreprise prévoit une API de vérification, mais ne communique aucun calendrier précis. Pour les images générées, une signature C2PA est intégrée directement aux métadonnées.


Réagissez à cet article !

Demandez nos derniers articles !

Panne Google Home et Nest : de nombreux appareils ne fonctionnent plus dans le monde entier

Des centaines d’utilisateurs disent que leurs appareils Google Home ou Nest ne répondent plus depuis plusieurs heures. De nombreux pays du monde, dont la France, sont concernés. Les objets connectés…

Apple donne des yeux à ses AirPods : découvrez en vidéo ses premiers écouteurs dotés de caméras et dopés à l’IA

Apple prépare sa prochaine génération d’AirPods. Et comme les futures lunettes connectées de la marque à la pomme croquée, ils seront équipés de caméras et reposeront sur Visual Intelligence et…

Hubble a identifié la galaxie que la Voie lactée a dévorée il y a près de 12 milliards d’années

Pendant des milliards d’années, notre galaxie a grossi en avalant d’autres systèmes stellaires. Les astronomes cherchent depuis longtemps à reconstituer la chronologie de ces anciennes collisions. Une étude réalisée avec…

Un Tesla Roadster volant dès l’été 2026, Elon Musk relance le projet après 9 ans d’attente

Annoncé en 2017 et sans cesse reporté depuis, le projet du Tesla Roadster est relancé avec une échéance : l’été 2026. Elon Musk parle même d’une version capable de léviter….

Piratage de l’Éducation nationale : les données de plus de 6 millions de personnes dans la nature

Après la DGFiP, c’est au tour de l’Éducation nationale d’être piratée, supposément par le même hacker. Élèves, enseignants, personnels… Des millions de gens sont concernés. Voici ce qu’il faut savoir….

Samsung Galaxy : cette option de One UI 9 donne vie aux écrans de verrouillage et d’accueil de votre smartphone

La nouvelle gamme de smartphones pliants de Samsung, les Galaxy Z8, est livrée avec la dernière version de la surcouche : One UI 9. Cette dernière introduit une nouvelle option de…

Partir courir sans son smartphone devient moins risqué grâce à cette nouveauté des montres sous Wear OS

Google enrichit encore Find Hub pour les appareils au poignet équipés de Wear OS. Cette fonction inédite n’est cependant pas pensée afin de repérer directement un individu depuis sa montre….

Le clavier Gboard veut accélérer l’insertion de contenus dans vos messages

L’application Gboard de Google pourrait bientôt recevoir un nouveau raccourci « Insertion Rapide ». Comme son nom l’indique, son but de fluidifier l’insertion de contenus dans les messages. À moins…

-66% sur le Realme 14 Pro+ : un zoom périscopique pour moins de 180 €

Le Realme 14 Pro+ avec 256 Go de stockage passe à seulement 179 €. À ce prix, il dispose d’un téléobjectif périscopique 3x et d’un écran OLED 120 Hz. Cette…

Telegram vient de faire les frais d’une IA qui traque le piratage vidéo, des centaines de canaux sont tombés

Depuis longtemps, Telegram fait partie des principaux refuges utilisés pour partager clandestinement films et séries. Deux équipes universitaires américaines viennent enfin de chiffrer précisément cette activité. Leurs recherches ont aussi…