Les nouvelles versions de ChatGPT sont de plus en plus puissantes… mais leur plus gros défaut empire aussi

OpenAI affirme avoir franchi un cap avec ses dernières intelligences artificielles. Pourtant, une étude révèle une faiblesse inattendue. Les modèles les plus récents produiraient encore plus d’erreurs que leurs prédécesseurs.

ChatGPT nouvelle voix
Crédits : 123RF

L’intelligence artificielle évolue rapidement, mais ses défauts persistent. OpenAI vient de publier des données sur ses nouveaux modèles o3 et o4-mini, censés être les plus performants à ce jour. Pourtant, ces IA présentent une hausse marquée des hallucinations. Ce phénomène désigne les erreurs graves où l’IA invente des faits, des études ou des liens. Un problème inquiétant car ces informations semblent crédibles pour les utilisateurs peu méfiants. Leur nombre reste un critère clé pour évaluer la fiabilité d’un modèle.

Les chiffres sont sans appel. OpenAI indique que o4-mini hallucine dans 48 % des cas testés avec l’outil interne PersonQA, soit trois fois plus que le modèle o1. Le modèle o3, pourtant plus grand et censé être plus fiable, produit également des erreurs dans 33 % des réponses, soit deux fois plus que le précédent. Cette évolution est surprenante car, en règle générale, chaque nouvelle génération de modèle tend à réduire ces problèmes. Ici, malgré des progrès sur l’exactitude globale, le risque d’obtenir de fausses informations augmente.

Les modèles o3 et o4-mini hallucinent davantage malgré leurs capacités de raisonnement accrues

OpenAI a conçu ses modèles récents pour externaliser leur raisonnement, affichant les étapes de réflexion pour plus de transparence. Cette approche, bien que prometteuse, n’empêche pas l’apparition d’informations erronées. Un rapport indépendant de Transluce a révélé que o3 invente parfois des capacités qu’il n’a pas, comme exécuter du code sur un MacBook Pro fictif. Pire, même face à une correction de l’utilisateur, ce dernier persiste dans son erreur. Cela remet en cause la fiabilité réelle de ces outils pourtant présentés comme plus rigoureux.

Les experts avancent plusieurs hypothèses pour expliquer ce phénomène. Des choix de conception, comme le renforcement basé sur les résultats, pourraient aggraver les hallucinations. De plus, OpenAI aurait réduit ses phases de tests de sécurité pour accélérer le développement de ses modèles. Cette stratégie, si elle permet d’innover plus vite, expose les utilisateurs à plus de contenus erronés. En attendant de meilleures solutions, la prudence reste indispensable : même les IA les plus avancées doivent être utilisées avec un regard critique.


Réagissez à cet article !

Demandez nos derniers articles !

Une RTX 5090 moins chère et trois fois plus puissante ? Ce fabricant chinois tente le pari

Une GeForce RTX 5090 moins chère et nettement plus puissante, c’est possible ! Un fabricant propose en effet une version « upgradée » de la célèbre carte graphique à prix…

ChatGPT commet une énorme erreur en plein procès, l’avocat sanctionné

L’intelligence artificielle vient une nouvelle fois d’halluciner lors d’un procès. Un avocat a utilisé le célèbre ChatGPT pour préparer sa défense, mais celui-ci a tout simplement inventé des témoignages… L’intelligence…

World of Warcraft Forever : Blizzard prépare une énorme surprise pour les nostalgiques

Les fans de World of Warcraft originel vont être aux anges. Blizzard s’apprête en effet à lancer World of Warcraft Forever, qui remontera aux origines du jeu de 2005, tout…

Cette TV Xiaomi QD-Mini LED de 55 pouces passe à moins de 380 € pour la French Week (-37%)

La Xiaomi TV S Mini LED de 55 pouces voit son prix passer à 377,80 €. Pour moins de 400 €, vous profitez d’une dalle QD-Mini LED 4K à 144…

Microsoft casse l’audio de Windows 11 avec sa dernière mise à jour, voici pourquoi

Une nouvelle mise à jour vient de mettre à mal le système d’exploitation de Microsoft. Celle-ci provoque un sérieux problème au niveau des périphériques USB audio sur Windows 11. On…

LG accusé d’espionnage massif : le fabricant sort enfin du silence

Parfois accusé d’espionner les propriétaires de ses écrans connectés, LG fait l’objet d’une vaste polémique. Mais l’entreprise a tenu à répondre à ces accusations via une longue déclaration. Le temps…

Diablo V est officiel, et Blizzard prépare une énorme surprise Netflix pour les fans

Le cinquième volet de la cultissime saga de Blizzard est officiel. Le développeur vient en effet d’annoncer officiellement Diablo V, qui débarquera dans quelques années… Dans l’univers des action-RPG, les…

Une usine française va fabriquer la batterie solide de demain, Google modifie son moteur de recherche en Europe, c’est le récap’ de la semaine.

ProLogium prépare sa gigafactory à Dunkerque, Google dégrade volontairement ses résultats de recherche, Samsung apporte de nouvelles fonctions IA aux Galaxy S25, c’est le récap’ de la semaine. Cette semaine,…

AliExpress lance sa French Week et fait chuter les prix : voici les offres à saisir

Du 14 au 20 septembre 2026, AliExpress organise sa French Week. De nombreux produits Tech bénéficieront d’une grosse baisse de prix. Voici les offres à ne pas manquer. La French…

iPhone Duo : Samsung sort l’artillerie lourde pour se moquer d’Apple

Avec la sortie de l’iPhone Duo, Samsung fait face à un nouveau concurrent de taille en matière de smartphones pliables. Mais le fabricant sud-coréen n’a pas tardé à se moquer…