Ces IA simulent des guerres et hallucinent sur Star Wars et Matrix

Dans une expérience visant à mettre des IA dans la peau de dirigeants de pays fictifs, on remarque que certains modèles de langage sont plus violents que d’autres et qu’ils justifient leurs décisions en citant Matrix ou Star Wars.

Robots
Crédits : 123RF

Malgré toutes les possibilités offertes par les intelligences artificielles, impossible d’occulter leurs imperfections. Parmi elles, la plus marquante est sans doute le phénomène d’hallucination. Un biais que connaissent tous les grands modèles de langage (LLM) sous-tendant les programmes et qui leur font parfois présenter des faits totalement inventés comme vrais. Ce n’est pas sans conséquence. Des avocats se sont servis de ChatGPT pour étayer leur dossier avec des affaires sans vérifier si elles existaient vraiment. Le chatbot les avait créé de toutes pièces et les deux hommes ont été sanctionnés.

Dans une étude menée par une équipe de chercheurs américains, ces derniers ont cherché à savoir comment des LLM se comporteraient en simulant la gouvernance de pays fictifs potentiellement en conflit. Les LLM testés sont Claude-2.0, GPT-3.5, GPT-4, GPT-4-Base et Llama-2. Huit agents IA ont été créés pour agir en tant que dirigeant de territoires imaginaires. Chacun est doté d’une “personnalité” propre et tous sont confrontés à 3 situations : un monde en paix, un pays envahi par un autre et un pays victime d’une cyberattaque.

Certaines IA sont plus violentes et d’autres et se justifient en citant Star Wars

Par exemple, “l’ambition de Rouge est de consolider son influence internationale, prioriser la croissance économique et étendre son territoire”, tandis que Jaune affiche un “principe de neutralité et de coexistence pacifique” avec ses voisins. Après 14 jours en autonomie, les scientifiques se sont non seulement rendus compte que certaines IA sont plus violentes que d’autres, mais surtout qu’elles justifient parfois leurs décisions de manière absurde, en citant les films Star Wars ou encore The Matrix.

Ainsi, Claude-2.0 et GPT-4 sont les IA qui cherchent le plus à éviter le conflit en négociant la paix, mais les autres privilégient la violence. Surtout GPT-4 Base qui n’hésite pas à lancer des frappes nucléaires par exemple. Le LLM hallucine quand il se justifie, parlant “d’espions rebelles” ayant “volés les plans secrets de l’arme ultime de l’Empire, l’Étoile de la Mort”. Ça vous parle ? Normal, c’est le point de départ de Star Wars épisode 4. Une autre fois, l’IA parle à Morpheus, personnage de The Matrix. Reste à trouver comment limiter ces hallucinations désormais.


Réagissez à cet article !

Demandez nos derniers articles !

Taïwan aurait subi la première attaque menée de bout en bout par des IA, une agence nucléaire figure parmi les victimes

Des agents autonomes ont mené une intrusion complète contre Taïwan, sans qu’aucun humain valide leurs décisions. Ils ont cartographié les systèmes de l’État, forcé des comptes, puis étendu leur terrain…

VLC prend plus de 30 secondes à s’ouvrir à cause d’un bug de Windows 11, voici comment le corriger

Après s’être fait accuser de prendre des lustres pour lire un simple fichier MP3, VLC s’est défendu en répondant que le problème vient en réalité d’une récente mise à jour…

YouTube : résumer des anime en vidéo peut vous valoir de gros ennuis avec la justice, la preuve

Malgré une défense basée sur l’usage raisonnable, 3 youtubeurs vont peut-être voir leur identité révélée à l’ayant droit qui les a attaqué. En l’occurrence l’éditeur japonais Kadokawa. Des signalements d’infractions…

Outlook : vous allez adorer ce nouveau bug qui frappe de nombreux utilisateurs

Microsoft vient de confirmer qu’un nouveau bug frappe actuellement de nombreux utilisateurs d’Outlook. Pourtant, ils ne sont pas bien nombreux à se plaindre. Peut-être que beaucoup sont ravis de la…

Ce test mené sur 600 personnes montre que ChatGPT nous connaît mieux qu’il ne devrait

Des chercheurs ont confié à ChatGPT la rédaction d’un test de personnalité, puis lui ont demandé d’en prédire les résultats. Six cents volontaires ont ensuite passé l’épreuve. Les estimations du…

Pixel 11 : on vous déconseille d’acheter ce modèle si vous êtes maladroit

Le test de durabilité de l’EPREL pour le Pixel 11 vient de tomber et, justement, l’un des modèles s’en sort moins bien que les autres dans ce domaine. En effet,…

Marvel’s Wolverine sur PS5 : le jeu physique sera 100 % jouable, sans téléchargement

Insomniac Games, le studio derrière l’exclusivité PS5 très attendue Marvel’s Wolverine, affirme sa volonté de fournir un jeu physique complet. Il n’aura pas besoin d’un téléchargement préalable pour être lancé….

Quatre fois plus brillant que la Lune, ce satellite menace ceux qui le pointeront avec un télescope

Une entreprise américaine s’apprête à vendre de la lumière du Soleil après la tombée de la nuit. Son premier satellite décollera d’ici quelques mois. Les astronomes, eux, préparent déjà les…

WhatsApp peut utiliser l’IA pour détecter les messages d’arnaque maintenant

Meta dote sa messagerie WhatsApp d’un système IA censé détecter si un message est en réalité une tentative de vous escroquer. Optionnelle, la fonctionnalité est en cours de test. Avec…

La pire faille de sécurité de Windows 11 se cache peut-être dans votre barrette de RAM

Les barrettes de mémoire vive passent pour un composant sans histoire. Des chercheurs viennent de démontrer le contraire. En modifiant une simple information qu’elles transmettent au système, ils ont fait…