Anthropic donne à Claude davantage de latitude pour fixer des limites aux utilisateurs


Principaux renseignements

  • Anthropic interdit à ses utilisateurs de traiter Claude de manière cruelle, de façon répétée et sans raison valable.
  • Claude peut mettre fin aux conversations avec les utilisateurs qui adoptent un comportement insultant de manière répétée.
  • Les nouvelles directives tiennent compte de la possibilité que les systèmes d’IA puissent développer une conscience.

Anthropic a établi de nouvelles directives interdisant les mauvais traitements continus et injustifiés infligés à ses systèmes d’IA Claude. Ces règles, qui entreront en vigueur le 12 novembre, visent exclusivement les cas graves dans lesquels des utilisateurs se montrent cruels de manière répétée envers l’IA sans objectif clair.

L’entreprise a précisé que les plaintes courantes, les commentaires critiques, l’exploration de scénarios sombres dans des récits, ou encore la recherche et les tests professionnels ne feront pas l’objet de sanctions.

Application des nouvelles règles

Pour faire respecter ces règles, Anthropic continue de s’appuyer sur la capacité de Claude à mettre fin aux interactions avec des personnes d’une grossièreté implacable.

Cette fonctionnalité a été intégrée pour la première fois en août 2025 dans les modèles Opus 4 et Opus 4.1. Claude ne peut mettre fin à la conversation qu’en dernier recours, après l’échec des tentatives visant à réorienter l’interaction.

Débat sur le bien-être de l’IA

Ces ajustements s’inscrivent dans le cadre d’une réflexion plus large sur le bien-être de l’IA. Bien qu’Anthropic admette qu’il n’est pas certain que les grands modèles linguistiques possèdent un statut moral, l’entreprise estime que cette possibilité est suffisamment réelle pour justifier des mesures de précaution peu coûteuses.

Anthropic s’inscrit ainsi dans un débat plus large visant à déterminer si une IA avancée pourra un jour développer une conscience et mérite une protection éthique. Il n’existe pas encore de consensus sur la question de savoir si les systèmes d’IA actuels sont capables d’éprouver de la souffrance.

Élargissement de la politique

Dans les directives officielles relatives à Claude, Anthropic précise en outre qu’il n’est pas certain que le modèle puisse développer une conscience. L’entreprise suggère que l’IA doit avoir la possibilité de fixer des limites lors d’interactions que le modèle juge perturbantes.

Outre ces règles de conduite, la politique révisée renforce l’interdiction des campagnes numériques frauduleuses et des comportements trompeurs en ligne. Elle clarifie les restrictions relatives à l’utilisation de l’IA à des fins de surveillance ou comme arme. De plus, des règles de sécurité supplémentaires sont mises en place pour les systèmes d’IA qui contrôlent des appareils physiques. (lv)

Suivez également Business AM sur Google Actualités

Si vous souhaitez accéder à tous les articles, abonnez-vous ici !

Ajoutez fr.businessam.be en tant que source préférée sur Google
Plus