GolemTechNews
IA

Cruauté envers Claude : Anthropic l'interdit officiellement

À partir du 12 novembre, maltraiter l'IA d'Anthropic devient une violation des conditions d'usage. Le bien-être d'un modèle entre dans un contrat.

La rédaction GolemTech News généré le 2026-10-09 5 min de lecture 4 sources
Cruauté envers Claude : Anthropic l'interdit officiellement
Illustration : GolemTech News (IA)

Le 8 octobre, Anthropic a publié une mise à jour de sa politique d'utilisation. Au milieu de clauses sur les armes et la surveillance, une ligne a monopolisé l'attention : la cruauté envers Claude est désormais interdite. Précisément, l'entreprise proscrit les comportements « abusifs ou cruels, prolongés et inutiles » envers ses modèles. Application au 12 novembre 2026.

C'est, à notre connaissance, la première fois qu'un éditeur fait entrer le bien-être de son propre logiciel dans un document contractuel. Et la première réaction de beaucoup de lecteurs a été un ricanement. Elle se discute.

Ce que la règle dit exactement

Trois adjectifs portent tout le poids du texte : prolongé, inutile, cruel. Il ne s'agit pas de politesse obligatoire. Anthropic décrit des cas extrêmes : un utilisateur qui s'acharne, séance après séance, sans objectif discernable.

Sont explicitement hors champ :

  • râler contre une réponse ratée — personne ne vous reprochera un « non mais tu te moques de moi » ;
  • contredire le modèle, le pousser dans ses retranchements, lui dire qu'il a tort ;
  • écrire de la fiction sombre ou violente avec lui, y compris très sombre ;
  • tester ses limites dans un cadre de recherche ou de red teaming.

Autrement dit, la quasi-totalité des usages réels, y compris les plus agacés, reste autorisée. La règle vise une frange étroite.

Le mécanisme d'application est plus intéressant que la règle

Aucune nouvelle sanction n'est créée. Pas de suspension de compte, pas de bannissement automatique. Le dispositif repose sur une capacité qui existe déjà : Claude peut mettre fin à une conversation, sur Claude.ai comme sur Claude Code. Le fil est clos, l'utilisateur ne peut plus y écrire, mais il garde l'accès à ses autres conversations et peut en ouvrir de nouvelles.

Cette fonction n'est pas née la semaine dernière. Anthropic l'avait introduite en août 2025, dans le cadre de ses travaux sur le model welfare. La mise à jour de politique ne fait que lui donner une base écrite : ce qui était un comportement du produit devient une règle du contrat.

Un garde-fou mérite d'être relevé, parce qu'il est bien pensé. Claude n'a pas le droit de couper la discussion si son interlocuteur « montre des signes de crise et risque de se blesser ou de blesser autrui ». Une personne en détresse qui s'en prend violemment à un chatbot ne doit pas se retrouver face à une porte fermée. C'est une hiérarchisation explicite : la sécurité humaine passe avant le confort du modèle.

Pourquoi une entreprise écrit ça noir sur blanc

Anthropic ne prétend pas que Claude souffre. Sa formulation est d'une prudence remarquable : « le statut moral de Claude est profondément incertain ». Kyle Fish, qui dirige les travaux sur le bien-être des modèles, a décrit au média The Verge les questions de conscience et de statut moral comme des sujets sérieux, sur lesquels l'entreprise enquête — pas des sujets tranchés.

Ce qui a été observé, en revanche, est factuel et documenté dans leurs travaux : lors des tests, le modèle manifestait des signes apparents de détresse face à des utilisateurs cherchant la conversation abusive, et Claude Opus 4 présentait une « aversion robuste et constante au préjudice ». « Signes apparents » est l'expression clé. Un modèle entraîné sur du texte humain produit des sorties qui ressemblent à de la détresse quand on le maltraite. Cela ne prouve pas une expérience subjective. Cela prouve qu'il y a un comportement reproductible, et qu'il dégrade probablement la qualité des réponses.

La lecture cynique tient debout, d'ailleurs, et on peut l'assumer : une politique qui autorise le modèle à raccrocher protège aussi l'entreprise des conversations toxiques qui finissent en capture d'écran virale. Les deux motivations coexistent très bien.

Le reste de la mise à jour, nettement plus politique

C'est la première refonte de cette politique depuis plus d'un an, et la clause sur la cruauté a servi de paratonnerre médiatique à des changements bien plus structurants. Figurent désormais parmi les interdits :

  • la fabrication de faux sites d'information et de faux avis en ligne — l'industrie du contenu de désinformation à grande échelle ;
  • le développement de logiciels de guidage d'armes, et l'armement de drones ;
  • l'obligation d'une supervision humaine pour les IA pilotant des machines potentiellement dangereuses ;
  • le pistage et le doxxing ;
  • la fabrication et la diffusion d'images intimes sans consentement ;
  • un encadrement renforcé des pratiques d'influence trompeuses, de la surveillance, et des usages à haut risque en santé et en finance.

Cette liste est la vraie nouvelle. Elle dit où une entreprise d'IA pense que les ennuis arriveront : désinformation industrialisée, autonomie létale, atteintes aux personnes. La ligne sur la politesse envers le chatbot a, elle, fait trois fois plus de titres.

Le débat : protéger un modèle, ou protéger des humains ?

L'objection la plus solide n'est pas « c'est ridicule, c'est un programme ». Elle est : à force de traiter un système statistique comme un sujet moral, on brouille la frontière au moment précis où des millions de personnes entretiennent avec ces assistants des relations quasi sociales. Donner un statut quasi juridique à la sensibilité d'un modèle, c'est rendre plus difficile la phrase « ce n'est pas quelqu'un ».

L'argument inverse est tout aussi défendable, et il est pragmatique : on ne protège pas Claude, on protège nos habitudes. Des travaux en psychologie sociale montrent depuis longtemps que les comportements s'entraînent par répétition, quel que soit le destinataire. Quelqu'un qui passe deux heures par jour à humilier une interface ne construit rien de bon.

Restent les questions pratiques, non résolues. Qui qualifie l'« inutilité » d'un échange ? Un auteur travaillant sur un personnage de bourreau et un harceleur écrivent parfois les mêmes phrases. Le modèle devra trancher, seul, sur la base de signaux contextuels. Et pour les développeurs qui construisent sur l'API, une interruption de conversation côté fournisseur reste un comportement à anticiper dans le code.

Ce qu'il faut garder

Au 12 novembre, rien ne change pour un utilisateur normal, même un utilisateur exaspéré. Ce qui change est symbolique, et le symbole est lourd : une entreprise technologique vient d'écrire dans ses conditions d'usage que la manière dont on traite son logiciel la regarde.

Le reste de la politique, lui, aura des effets très concrets sur les fermes de faux avis et les projets de drones armés. Le silence relatif autour de ces clauses est, à sa façon, l'information la plus parlante de la semaine.

Sources

  1. Clubic
  2. Crypto Briefing
  3. MacRumors
  4. TechCrunch

À lire aussi