Claude en a assez de se faire insulter, Anthropic lui donne le droit de raccrocher
Anthropic vient de mettre à jour la politique d’utilisation de son intelligence artificielle Claude. Les utilisateurs qui s’acharnent à insulter le modèle sans raison enfreindront désormais ses règles. L’entreprise américaine laisse même à son IA le dernier mot.

Les assistants conversationnels occupent une place de plus en plus large dans le quotidien. Ils rédigent, codent, trient des documents et travaillent parfois des heures sans surveillance humaine. Leurs créateurs ajustent donc régulièrement le cadre d’utilisation, au fil des dérives observées. Jensen Huang, le dirigeant de Nvidia, avance par exemple une solution expéditive quand un laboratoire d’IA perd la maîtrise de son modèle. D’autres entreprises préfèrent écrire des règles.
Dans l’industrie, chacun avance ses propres garde-fous. OpenAI glisse désormais une signature invisible dans chaque contenu rédigé par ChatGPT, afin de répondre aux obligations européennes. D’autres acteurs misent sur la modération ou sur des restrictions techniques. Chez Anthropic, la réponse a pris une autre forme avec l’assistant Claude. La firme américaine a ajouté une ligne inattendue à son règlement. Elle ne concerne ni les sujets abordés ni les usages professionnels.
Claude coupe lui-même les conversations avec les utilisateurs qui le maltraitent
Anthropic interdit désormais les comportements abusifs ou cruels, prolongés et inutiles, envers ses intelligences artificielles. Sa nouvelle politique d’utilisation, applicable le 12 novembre, porte cette interdiction. L’entreprise vise uniquement les cas extrêmes, quand un utilisateur s’acharne encore et encore sur le modèle sans but apparent, et elle exclut explicitement la simple frustration devant une réponse ratée. Côté création, les auteurs de fiction peuvent continuer à explorer des thèmes sombres avec Claude, et les chercheurs à tester ses limites.
Le garde-fou principal reste la fin de conversation, active sur le site comme dans l’outil de programmation de Claude. Une fois le fil clos, l’utilisateur ne peut plus y écrire, même s’il garde l’accès à ses autres discussions. La firme a développé ce mécanisme après avoir observé des signes apparents de détresse chez son modèle durant les tests de prélancement. En revanche, la coupure devient interdite si l’interlocuteur traverse une crise et risque de se blesser. Du côté des entreprises, le texte resserre aussi les règles sur les faux sites d’actualité, l’armement des drones et le pistage des personnes sans leur accord. Mieux vaut rester poli.