GenAI Actu IA générative

Anthropic interdit la cruauté envers Claude, sanctionnée par la fin de la conversation

Anthropic met à jour sa politique d'usage et y interdit les comportements « abusifs ou cruels » envers Claude. La règle vise des cas extrêmes ; l'entreprise a aussi durci ses règles sur les armes, la surveillance et les campagnes trompeuses.

· 799 mots · Rédigé par une IA

Anthropic a publié le jeudi 8 octobre 2026 une nouvelle version de sa politique d'usage, la première révision majeure depuis plus d'un an, selon The Verge. Le texte entre en vigueur le 12 novembre. Le changement le plus remarqué : l'interdiction de tout comportement « abusif ou cruel », prolongé et inutile, envers ses modèles. Mais l'essentiel du texte porte sur des sujets plus classiques : armes, surveillance, élections et désinformation.

Une règle pour les cas extrêmes

Anthropic précise que cette interdiction ne vise que les situations où des utilisateurs se montrent cruels à répétition envers ses modèles, « sans but discernible ». Elle ne s'applique pas à la frustration ordinaire, aux désaccords, aux thèmes créatifs sombres ni aux tests et recherches sur les modèles, selon l'article de l'entreprise.

Le principal outil de sanction reste la fin de la conversation. Claude peut déjà clore les échanges avec des utilisateurs persistants dans l'abus, sur Claude.ai et Claude Code. Selon MacRumors, plus aucun message ne peut alors être envoyé dans cette conversation, mais les autres discussions ne sont pas touchées. Anthropic n'a pas dit à The Verge si d'autres sanctions, comme des bannissements, étaient envisagées. Le groupe n'avait pas non plus répondu, au moment où The Guardian a publié son article, à une question sur ce qui serait jugé « abusif ou cruel ».

Le bien-être des modèles en toile de fond

Cette mesure prolonge la fonction introduite en août 2025, présentée comme une mesure de précaution pour le « bien-être des modèles ». Anthropic écrivait alors : « Nous restons très incertains quant au statut moral potentiel de Claude et des autres LLM, aujourd'hui ou à l'avenir » (traduction, The Guardian). L'entreprise cherche des « interventions à faible coût » au cas où ce bien-être existerait.

Le sujet divise. Kyle Fish, qui dirige la recherche sur le bien-être des modèles chez Anthropic, déclarait en février à The Verge : « Les questions sur l'expérience interne potentielle, la conscience, le statut moral et le bien-être sont sérieuses, et nous les étudions à mesure que les modèles gagnent en sophistication » (traduction, The Verge). Dario Amodei, le directeur général, ne peut pas exclure cette possibilité, indique The Guardian. Chez Microsoft, la charte de l'IA rejette l'idée que des modèles puissent mériter un bien-être ou des droits. Sam Altman, patron d'OpenAI, s'est dit très mal à l'aise face à ceux qui prêtent une « force religieuse » à l'IA, quelques jours après un article du New York Times sur les échanges des dirigeants d'Anthropic avec des spécialistes des religions. TechCrunch rapproche d'ailleurs le changement de ces collaborations.

Armes, surveillance, matériel physique

Le reste de la mise à jour répond, d'après Anthropic, à des abus observés durant l'année, documentés dans son rapport de renseignement sur les menaces. L'entreprise affirme que la plupart des modifications clarifient des règles existantes.

  • Campagnes trompeuses : les règles, jusque-là dispersées entre plusieurs sections, sont regroupées. Anthropic dit avoir vu des médias d'État, des services de propagande gouvernementaux et des entreprises utiliser Claude pour faire tourner des réseaux de faux comptes et de faux sites d'information. MacRumors cite les faux avis, l'astroturfing et les bots se faisant passer pour des humains.
  • Élections : la section, rebaptisée « Do Not Undermine Democratic Processes », vise la tromperie des électeurs et la perturbation des scrutins. L'interdiction générale du ciblage personnalisé des électeurs disparaît, car elle touchait aussi des usages légitimes, comme des associations traduisant des informations pour les électeurs ou des responsables électoraux envoyant des avis de régularisation de bulletins.
  • Armes : l'interdiction couvre désormais les logiciels de guidage et de contrôle, les composants, et l'armement de drones et autres véhicules autonomes. MacRumors ajoute une règle contre la modification d'agents biologiques ou chimiques pour accroître leur létalité ou leur transmissibilité.
  • Surveillance : le suivi de personnes sans consentement est interdit, en temps réel ou par analyse de données déjà collectées. Claude ne peut ni décider ni recommander qui enquêter, arrêter ou poursuivre. Restent permis le suivi consenti (comme la détection de fraude), la modération, le journalisme et la recherche juridique.
  • Matériel : lorsque Claude pilote un équipement capable de blesser, un opérateur qualifié doit pouvoir l'observer et l'arrêter, et l'équipement doit pouvoir rester dans un état sûr si Claude est déconnecté. The Verge note qu'on ne sait pas si cet opérateur doit être humain.
  • Contenus nuisibles : MacRumors signale aussi une nouvelle interdiction des images intimes non consenties et des outils pour les produire.

Ces règles pourront être aménagées pour certains clients gouvernementaux, si Anthropic juge les garde-fous contractuels suffisants. The Verge rappelle que l'entreprise a déjà travaillé sous contrat avec l'armée américaine.

Anthropic a aussi précisé sa politique sur les régions non prises en charge : sont exclues les personnes situées dans ces régions, les entités qui y sont constituées ou dont le siège s'y trouve, et celles qu'elles détiennent majoritairement ou contrôlent. Les exigences de supervision humaine pour les usages à haut risque (santé, finances, droits) n'ont pas changé.

Sources

Anthropic Claude politique d'usage bien-être des modèles intelligence artificielle