Après Claude, c’est au tour de ChatGPT de marquer en secret les textes qu’il écrit
OpenAI vient de détailler sa réponse aux nouvelles obligations européennes sur l’intelligence artificielle. La firme va glisser un signal invisible dans les textes produits par ChatGPT et Codex. Son efficacité, elle, s’effondre dès que le texte est retouché.

Les contenus générés par intelligence artificielle circulent partout, et rien ne les distingue vraiment de l’écriture humaine. Depuis le 2 août 2026, la réglementation européenne impose de rendre ces productions identifiables par une machine. Anthropic a ouvert la voie cet été, et le filigrane intégré aux textes de Claude repose entièrement sur le choix des mots du modèle. Sa mise en place avait déclenché une polémique nourrie chez les auteurs. Les autres éditeurs restaient attendus au tournant.
OpenAI a publié le 5 octobre sa feuille de route sur la provenance des contenus en Europe. La firme californienne travaille depuis plusieurs mois sur la façon dont ses modèles rédigent. Elle expérimente déjà une fonction de ChatGPT capable d’imiter le style d’écriture de chaque utilisateur. Le document dévoile cette fois un dispositif technique inédit, limité pour l’instant à une zone géographique précise.
OpenAI réserve son filigrane invisible aux utilisateurs européens de ChatGPT et Codex
ChatGPT et Codex marqueront leurs textes dans les semaines à venir, uniquement pour les utilisateurs situés dans l’Union européenne, quelle que soit leur formule d’abonnement. Selon l’annonce publiée par OpenAI, cette technologie s’appelle textGrain. Elle glisse un signal statistique invisible dans le choix des mots du modèle. Du côté de l’interface de programmation, les développeurs peuvent déjà l’activer partout dans le monde. L’option reste désactivée par défaut. Le détecteur maison n’ouvre ses portes qu’aux chercheurs et aux organisations expertes retenues sur candidature.
La fiabilité du filigrane de ChatGPT reste pourtant modeste. Sur un passage de 400 jetons, le détecteur repère environ 95 % des textes signés, contre 80 % sur des extraits deux fois plus courts. Ce taux s’effondre sur les contenus mathématiques, où le vocabulaire laisse peu de latitude. Remplacer un mot sur dix par un synonyme fait chuter la détection de 92 % à 66 %, et un quart de mots modifiés la ramène à 17 %. OpenAI énumère elle-même cinq limites. Son marquage ne mesure pas la part humaine, n’identifie pas l’auteur et ne garantit pas l’exactitude du propos. Un texte sans signal n’est pas pour autant écrit par un humain.