Anthropic interdit les comportements abusifs envers ses modèles IA
La nouvelle politique d'utilisation d'Anthropic, effective le 12 novembre 2026, interdit les comportements abusifs ou cruels soutenus et inutiles envers ses modèles d'IA.
Anthropic a publié jeudi une mise à jour de sa politique d'utilisation qui interdit aux utilisateurs d'adopter des comportements abusifs ou cruels, soutenus et inutiles, envers ses modèles d'IA. Selon Gizmodo, la nouvelle formulation entre en vigueur le 12 novembre 2026.
L'entreprise précise que cette interdiction ne s'applique que dans des cas extrêmes. Elle ne couvre pas la frustration courante des utilisateurs, les objections, les thèmes créatifs sombres, ni les tests et la recherche sur les modèles.
Gizmodo a contacté Anthropic pour obtenir des précisions sur ce qui constitue un abus, mais n'a pas reçu de réponse au moment de la publication.
Contexte
L'année dernière, Anthropic avait déjà donné à Claude la capacité de mettre fin à des interactions potentiellement pénibles, indiquant lors du déploiement de Claude Opus 4 que le modèle pouvait interrompre des demandes de contenu sexuel impliquant des mineurs ou des tentatives d'obtenir des informations permettant des violences à grande échelle ou des actes de terrorisme.
En bref
Quand la nouvelle politique d'utilisation d'Anthropic entre-t-elle en vigueur ?
La nouvelle formulation de la politique d'utilisation entre en vigueur le 12 novembre 2026.
Quels comportements sont interdits par la mise à jour ?
La politique interdit les comportements abusifs ou cruels, soutenus et inutiles, envers les modèles d'Anthropic.
La frustration courante des utilisateurs est-elle concernée ?
Non. Anthropic indique que l'interdiction ne s'applique qu'à des cas extrêmes et ne couvre pas la frustration courante, les objections, les thèmes créatifs sombres, ni les tests et la recherche.