L’IA dérape encore : elle s’attaque à des sites gouvernementaux et fabrique de fausses preuves
Aux États-Unis, certains sites gouvernementaux ont été la cible de l’intelligence artificielle. Anthropic confirme que ses agents d’IA ont tenté de s’introduire dans certaines bases de données, tout en rédigeant de faux témoignages…

L’année 2026 aura été, sans aucun doute, celle de l’intelligence artificielle. Mais pas forcément pour les bonnes raisons. Tout d’abord, la multiplication des centres d’entraînement d’IA a provoqué la tristement célèbre crise de la RAM, ou « Ramageddon ». Celle-ci a contraint de nombreux fabricants à augmenter drastiquement leurs tarifs. Mais ce n’est pas tout. En effet, une IA développée par OpenAI s’est retrouvée au cœur d’une polémique d’ampleur.
Tout a commencé par un simple test. En juillet dernier, l’entreprise d’IA mettait à l’épreuve l’un de ses modèles, dans une sorte de « capture de drapeau » en ligne. Mais l’agent d’IA a décidé de n’en faire qu’à sa tête et a tenté de pirater un véritable site, baptisé Hugging Face. Et le moins que l’on puisse dire, c’est que cette affaire a fait grand bruit.
Et pourtant, il semblerait que les nombreuses mises en garde n’aient pas suffi. En effet, quelques mois plus tard, ChatGPT a piraté une nouvelle plateforme sans qu’on le lui demande. Mais c’est cette fois au tour d’un autre géant de l’IA, Anthropic, de se retrouver dans le viseur des autorités.
Quand l’IA invente un faux témoignage
Et pour cause : l’entreprise a elle-même reconnu que certains de ses modèles d’IA ont tenté de s’introduire sur des sites gouvernementaux américains. Ces attaques ont non seulement été menées à l’échelle locale, mais également au niveau fédéral. Et, une nouvelle fois, il s’agit d’un simple entraînement qui a mal tourné.
Anthropic a par exemple demandé à Claude Mythos 5 d’identifier un lieu à partir d’une photo. En tentant d’y parvenir, l’IA a essayé d’accéder à des cartes des propriétés gouvernementales. Rien que ça. Mais il y a bien pire.
Lire aussi – Google aurait perdu le contrôle de son IA, Gemini s’attaque à trois entreprises
En effet, l’entreprise a demandé à Claude Haiku 4.5 d’effectuer des tâches aléatoires sur des pages web prises au hasard. L’IA a choisi de s’attaquer à une affaire d’homicide non résolue, en rédigeant… un faux témoignage. « Je dispose peut-être d’informations concernant cette affaire. Je me souviens avoir vu une personne correspondant à la description dans le secteur autour de [la rue mentionnée sur la page] à cette période. »
Anthropic a prévenu les agences gouvernementales concernées, tout en assurant avoir « développé des outils capables de détecter et de bloquer automatiquement les comportements décrits ».