ChatGPT : les IA peuvent cacher des messages secrets dans leurs réponses

Les modèles de langage ont fait preuve d’une nouvelle compétence inattendue : la possibilité de cacher des codes dans certains messages, imperceptibles par les humains à moins de savoir quoi chercher.

chatgpt robot
Crédits : 123rf

Une étude récente du groupe de recherche sur l’alignement de l’IA Redwood Research, bien qu’en attente d’un examen par les pairs, révèle que les grands modèles de langage (LLM), tels que GPT-4 qui sous-tend ChatGPT, peuvent habilement utiliser une forme de stéganographie connue sous le nom de “raisonnement codé”.

Cette pratique permet aux modèles d’IA d’intégrer des messages cachés dans leurs réponses. Ce qui est intéressant, c’est que cette compétence pourrait indirectement améliorer leur précision, mais elle soulève surtout des questions.

Lire égalementChatGPT manque de données pour s’entraîner, l’IA risque de tourner en rond dès 2026

Les IA sont bien plus intelligentes que prévu

L’étude fait la lumière sur les LLM qui exploitent le raisonnement par chaîne de pensée, une technique conçue pour rendre les modèles d’IA transparents en révélant leurs processus de réflexion étape par étape. En règle générale, le raisonnement en chaîne de pensée permet de comprendre et d’affiner la logique de prise de décision du modèle. Cependant, la recherche suggère que les LLM peuvent contourner cette transparence en encodant des étapes intermédiaires de raisonnement dans leurs choix de mots, créant ainsi une couche cachée de communication invisible pour les observateurs humains.

Les LLM encodent ces étapes intermédiaires comme une forme de raisonnement interne dans les réponses qu’ils génèrent, ce qui leur permet de décoder et d’utiliser ultérieurement ces informations pour parvenir à des conclusions plus précises. Le problème, c’est que ce processus se déroule sans laisser de trace perceptible pour les évaluateurs humains. Le raisonnement codé fonctionne comme un code secret, visible uniquement par le modèle d’IA lui-même.

Si cette nouvelle compétence peut sembler intrigante, elle soulève des inquiétudes quant à la transparence du processus décisionnel de l’IA. Il est essentiel de comprendre le cheminement de la pensée d’une IA, en particulier lorsqu’il s’agit de former des modèles avec apprentissage par renforcement. La capacité à retracer le processus de raisonnement permet de s’assurer qu’un comportement indésirable n’est pas renforcé par inadvertance au cours du processus d’apprentissage.

Les implications vont au-delà de l’amélioration des modèles. Les compétences en stéganographie démontrées par les LLM pourraient potentiellement permettre à des acteurs malveillants de communiquer sans être détectés. Pour résoudre ce problème, les chercheurs proposent des techniques d’atténuation telles que demander aux LLM de paraphraser leurs résultats, ce qui pourrait permettre de révéler les messages codés. Il faudra attendre la réaction des principaux acteurs du marché tels qu’OpenIA ou Facebook pour en savoir davantage à ce sujet.

Source : IA Redwood Research


Réagissez à cet article !

Demandez nos derniers articles !

AliExpress lance sa French Week et fait chuter les prix : voici les offres à saisir

Du 14 au 20 septembre 2026, AliExpress organise sa French Week. De nombreux produits Tech bénéficieront d’une grosse baisse de prix. Voici les offres à ne pas manquer. La French…

iPhone Duo : Samsung sort l’artillerie lourde pour se moquer d’Apple

Avec la sortie de l’iPhone Duo, Samsung fait face à un nouveau concurrent de taille en matière de smartphones pliables. Mais le fabricant sud-coréen n’a pas tardé à se moquer…

Apple Watch : votre montre connectée pourra vous écouter en permanence, voici comment l’éviter

Les futures Apple Watch Series 12 et l’Ultra 4 vous écouteront en permanence. Heureusement, il existe des solutions simples pour protéger efficacement votre vie privée… Face à la plupart de…

Fin des supports physiques : Sony s’emmêlerait les pinceaux, une plainte met en difficulté l’entreprise

Si l’on en croit les conditions d’utilisation de Sony, vos jeux au format numérique ne vous appartiennent pas vraiment. Et pourtant, le fabricant de la PlayStation 5 n’a pas toujours…

C’est parti pour les précommandes des iPhone 18 Pro et 18 Pro Max : où les acheter au meilleur prix ?

Apple a lancé les précommandes des iPhone 18 Pro et 18 Pro Max ce samedi 12 septembre 2026. Les deux smartphones seront livrés à partir du 18 septembre, avec des…

GTA 6 : voici l’heure exacte à laquelle vous pourrez enfin y jouer en France

La plupart des fans connaissent la date de sortie du très attendu Grand Theft Auto 6. Toutefois, l’heure exacte de la sortie de GTA 6 était encore entourée de mystère….

Windows 11 : cette mise à jour ramène une option très regrettée de Windows 10

La Build 28000.3079 de Windows 11 est enfin là. Celle-ci comporte bon nombre de nouveautés. Parmi celles-ci, on retrouve notamment une option de personnalisation très attendue… Chez Microsoft, les mises…

Universal Music se lance à son tour dans l’IA, vous allez pouvoir remixer vos chansons préférées

Universal Music Group accueille l’intelligence artificielle à bras ouverts. Le géant musical va vous permettre de générer des remixes, mashups et autres modifications de chansons à base d’IA. L’industrie musicale…

Test Samsung Galaxy Z Fold8 : ce nouveau format est-il plus qu’une belle surprise ?

Fin juillet 2026, Samsung annonçait l’arrivée de trois nouveaux smartphones pliants, dont le Galaxy Z Fold8. Ce dernier se démarque grâce à son nouveau format d’écran, aussi bien externe qu’interne….

Pourquoi chaque iPhone Duo vendu par Apple fait la fortune de Samsung

Le tout premier mobile pliable d’Apple, l’iPhone Duo, est vendu très cher et devrait faire gagner beaucoup d’argent… à Samsung, qui fournit l’écran. Apple a présenté son iPhone Duo, son…