L’IA ChatGPT écrit si bien qu’elle peut tromper des scientifiques

ChatGPT serait en mesure de tromper des évaluateurs scientifiques. Un tel niveau de perfectionnement pourrait alimenter une crise de l’intégrité scientifique, avertissent les auteurs d’une nouvelle étude.

ChatGPT
Crédit : albund / 123RF

Le nouveau chatbot ChatGPT ne fait que gagner en popularité depuis son lancement il y a quelques mois, notamment grâce à ses performances assez exceptionnelles. Des chercheurs ont donc voulu savoir s’il était capable de produire de manière convaincante de faux résumés qui pourraient tromper les scientifiques en leur faisant croire que des études sont réelles.

Pour cela, les chercheurs de l’université Northwestern et de l’université de Chicago ont demandé à ChatGPT de générer de faux résumés de recherche à partir de 10 résumés réels publiés dans des revues médicales, et ont soumis les faux articles, ainsi que des vrais, à des scientifiques. Ceux-ci avaient pour but de faire la distinction entre les vrais et les faux, et le moins que l’on puisse dire, c’est que les résultats sont alarmants.

Lire égalementMicrosoft adore ChatGPT et propose 10 milliards $ pour devenir un actionnaire presque majoritaire

Les scientifiques ne font pas la différence entre les vrais rapports et ceux écrits par chatGPT

Les examinateurs humains à qui l’on a donné un mélange de résumés réels et faussement générés n’ont pu repérer les résumés générés par ChatGPT que dans 68 % des cas. Les examinateurs ont également identifié à tort 14 % des résumés réels comme étant générés par l’IA.

Les chercheurs ont également soumis les articles écrits par chatGPT à un logiciel de détection de plagiat. Si 100 % d’entre eux étaient bien uniques, puisque chatGPT génère des réponses sans copier une source, seuls 8 % d’entre eux respectaient les exigences de formatage requises par les revues scientifiques.

ChatGPT n’est donc pas encore près de remplacer les rédacteurs dans tous les domaines, mais le chatbot devrait faire de gros progrès d’ici quelques années. Les publications scientifiques universitaires reposent sur un processus de soumission et d’examen des articles par des experts humains dans les domaines concernés, mais si ceux-ci ne sont plus en mesure de faire la différence entre des articles générés par une intelligence artificielle et un humain, cela pourrait remettre en cause de nombreux métiers.

Pour l’instant, les chercheurs exhortent les revues et les conférences médicales qui s’appuient sur des études scientifiques à maintenir des « normes scientifiques rigoureuses » et à mettre en place des détecteurs de sortie d’IA lors de l’examen des articles. Un étudiant a d’ailleurs développé un logiciel permettant de savoir si un texte a été généré par chatGPT.


Réagissez à cet article !

Demandez nos derniers articles !

Taïwan aurait subi la première attaque menée de bout en bout par des IA, une agence nucléaire figure parmi les victimes

Des agents autonomes ont mené une intrusion complète contre Taïwan, sans qu’aucun humain valide leurs décisions. Ils ont cartographié les systèmes de l’État, forcé des comptes, puis étendu leur terrain…

VLC prend plus de 30 secondes à s’ouvrir à cause d’un bug de Windows 11, voici comment le corriger

Après s’être fait accuser de prendre des lustres pour lire un simple fichier MP3, VLC s’est défendu en répondant que le problème vient en réalité d’une récente mise à jour…

YouTube : résumer des anime en vidéo peut vous valoir de gros ennuis avec la justice, la preuve

Malgré une défense basée sur l’usage raisonnable, 3 youtubeurs vont peut-être voir leur identité révélée à l’ayant droit qui les a attaqué. En l’occurrence l’éditeur japonais Kadokawa. Des signalements d’infractions…

Outlook : vous allez adorer ce nouveau bug qui frappe de nombreux utilisateurs

Microsoft vient de confirmer qu’un nouveau bug frappe actuellement de nombreux utilisateurs d’Outlook. Pourtant, ils ne sont pas bien nombreux à se plaindre. Peut-être que beaucoup sont ravis de la…

Ce test mené sur 600 personnes montre que ChatGPT nous connaît mieux qu’il ne devrait

Des chercheurs ont confié à ChatGPT la rédaction d’un test de personnalité, puis lui ont demandé d’en prédire les résultats. Six cents volontaires ont ensuite passé l’épreuve. Les estimations du…

Pixel 11 : on vous déconseille d’acheter ce modèle si vous êtes maladroit

Le test de durabilité de l’EPREL pour le Pixel 11 vient de tomber et, justement, l’un des modèles s’en sort moins bien que les autres dans ce domaine. En effet,…

Marvel’s Wolverine sur PS5 : le jeu physique sera 100 % jouable, sans téléchargement

Insomniac Games, le studio derrière l’exclusivité PS5 très attendue Marvel’s Wolverine, affirme sa volonté de fournir un jeu physique complet. Il n’aura pas besoin d’un téléchargement préalable pour être lancé….

Quatre fois plus brillant que la Lune, ce satellite menace ceux qui le pointeront avec un télescope

Une entreprise américaine s’apprête à vendre de la lumière du Soleil après la tombée de la nuit. Son premier satellite décollera d’ici quelques mois. Les astronomes, eux, préparent déjà les…

WhatsApp peut utiliser l’IA pour détecter les messages d’arnaque maintenant

Meta dote sa messagerie WhatsApp d’un système IA censé détecter si un message est en réalité une tentative de vous escroquer. Optionnelle, la fonctionnalité est en cours de test. Avec…

La pire faille de sécurité de Windows 11 se cache peut-être dans votre barrette de RAM

Les barrettes de mémoire vive passent pour un composant sans histoire. Des chercheurs viennent de démontrer le contraire. En modifiant une simple information qu’elles transmettent au système, ils ont fait…