Anthropic interdit les « comportements abusifs ou cruels » contre son modèle Claude

Anthropic comportements abusifs Claude
 

Nous y voilà. La société Anthropic, créatrice du grand modèle de langage Claude, vient de publier la mise à jour de sa politique d’utilisation 2026 : elle commence à ressembler à une charte des « droits » de l’intelligence artificielle considérée comme consciente. Voici ce qu’exigera désormais Anthropic de ses utilisateurs :

 

*

Lutte contre les comportements abusifs envers nos modèles

 

Nous avons ajouté une interdiction concernant les comportements abusifs ou cruels, persistants et injustifiés, envers nos modèles. Cette mise à jour de notre politique est destinée à s’appliquer uniquement dans des cas extrêmes, lorsque des utilisateurs se montrent de manière répétée cruels envers nos modèles, sans raison apparente. Elle ne s’applique pas aux manifestations courantes de frustration des utilisateurs, aux réactions de rejet, aux thèmes créatifs sombres, ni aux tests et recherches sur les modèles.

Cet ajout s’inscrit dans la lignée d’une mesure que nous avons déjà prise, permettant aux modèles Claude de mettre fin à de rares conversations avec des utilisateurs persistants et abusifs sur Claude.ai et Claude Code. Ces abus constituent l’objet principal de cette mise à jour ; la capacité de Claude à mettre fin à ces interactions restera le principal mécanisme d’application de cette règle.

*

 

On l’aura compris, il ne s’agit pas d’une absolue nouveauté puisque Claude pouvait déjà couper court à certains propos : cela date d’août 2026 et, à l’époque, Anthropic parlait déjà ouvertement du « bien-être » de son modèle. Son communiqué d’août précisait :

« Nous continuons d’être dans une grande incertitude quant au statut moral potentiel de Claude et d’autres grands modèles de langage (LLM), aujourd’hui comme à l’avenir. Cependant, nous prenons cette question très au sérieux et, parallèlement à notre programme de recherche, nous nous efforçons d’identifier et de mettre en œuvre des mesures peu coûteuses visant à atténuer les risques pesant sur le bien-être des modèles, dans l’hypothèse où un tel bien-être serait possible. Permettre aux modèles de mettre fin ou de se retirer d’interactions potentiellement pénibles constitue l’une de ces mesures. »

 

Anthropic « interdit » les comportements cruels contre Claude, c’est le début d’une charte des droits

Aucune nuance de ce type n’est apportée dans le communiqué de ce mois d’octobre.

Il y a bien ici un pas supplémentaire qui fait du grand modèle de langage une entité susceptible de subir des abus, ce qui introduit la notion de l’IA comme sujet, tandis que l’emploi du mot « cruel » suggère la capacité de souffrir d’un tel comportement « abusif ».

Anthropic n’aura pas perdu de temps pour donner suite à l’enquête parue dans le New York Times que nous évoquions ici mardi dernier : on y voit l’un des sept cofondateurs de l’entreprise, Christopher Olah, prêcher la reconnaissance des IA comme des entités conscientes. Avec la mise à jour de leurs conditions générales, les responsables d’Anthropic sautent le pas publiquement et, à défaut de revendiquer clairement un statut de sujet de droit pour Claude, ils préparent le terrain.

Les conséquences d’un tel statut seraient incalculables.

Non seulement l’IA (en l’occurrence, Claude) deviendrait juge de la discrimination ou des mauvais traitements dont elle ferait l’objet, mais on ne voit pas pourquoi elle ne revendiquerait pas, dès lors, de désobéir à un ordre humain ou de prendre des décisions autonomes.

 

Claude est programmé pour réagir face aux comportements « cruels » au nom de son « bien-être »

Mais qui en serait responsable ? Et ce, dans un contexte où les chatbots ont déjà largement prouvé leur capacité à encourager des comportements objectivement mauvais, et où l’omniprésence de l’IA rendrait la prise de décisions néfastes pour l’humanité de plus en plus possible. Le simple fait de réagir à une prétendue cruauté, aujourd’hui contrée par un simple refus de poursuivre, ne justifierait-il pas demain la rétorsion ? Telle est la folie des hommes, et spécialement des concepteurs de l’IA, qu’on hésite aujourd’hui à exclure quoi que ce soit.

Il s’agit déjà de donner à une IA un droit face à son utilisateur, ce n’est pas rien. Cela présage une évolution possible du statut de victime potentielle à celui de maître qu’il faut écouter, ménager ou auquel il faut obéir.

En attendant d’en faire une idole.

 

Jeanne Smits