Aller au contenu

Claude met à jour ses règles: agents, armes et campagnes trompeuses

La Usage Policy de Claude évolue au 12 novembre 2026: Anthropic interdit les campagnes trompeuses, encadre la surveillance et les armes, précise les règles…

9 min de lecture Comment nous travaillons

Parmi les nouvelles règles de Claude, une ligne attire plus l'attention que les autres: Anthropic interdit de tenir envers ses propres modèles un comportement «abusif ou cruel, prolongé et inutile». C'est la clause la plus surprenante de la mise à jour, mais pas la plus importante. Elle doit être lue comme une condition d'utilisation, non comme une déclaration sur la conscience de Claude. Le coeur de la nouvelle Usage Policy est plus concret: campagnes trompeuses, surveillance, logiciels pour armes et agents agissant sur des outils et des appareils physiques.

Anthropic a annoncé la mise à jour le 8 octobre 2026 et les nouvelles règles entrent en vigueur le 12 novembre. L'entreprise indique réviser sa policy chaque année en fonction de l'évolution des modèles, et observe que Claude a accompli, au cours de la dernière année, «des tâches plus longues et plus autonomes». Les exemples ajoutés proviennent de nouveaux schémas d'abus observés dans des opérations d'influence, dans le développement d'armes et dans la surveillance, tels que décrits dans le rapport de renseignement sur les menaces publié en septembre. Anthropic est explicite sur la portée: la majorité des modifications vise à clarifier des règles déjà existantes.

2026 Usage Policy update
We're publishing a new version of our Usage Policy. In this post, we summarize the changes we've made.
Frise chronologique en cinq dates sur la mise à jour de la Usage Policy d
Frise chronologique en cinq dates sur la mise à jour de la Usage Policy d'Anthropic, d'août 2025 au 12 novembre 2026, date d'entrée en vigueur mise en évidence en violet.

Campagnes trompeuses: une nouvelle section, aussi pour le marketing

La nouveauté la plus large est une section dédiée aux campagnes trompeuses et aux activités artificielles, qui regroupe des règles auparavant dispersées entre les chapitres sur les élections, les fraudes, la vie privée et la désinformation. Le périmètre est clairement défini: toute activité trompeuse, «quelle qu'en soit la nature, politique ou commerciale». Le texte de la policy interdit de créer ou de gérer de fausses identités, des comptes, des médias ou des organisations fictives, avec des exemples tels que les sockpuppets, l'astroturfing, les fausses avis et les bots se faisant passer pour des humains. Il interdit également de dissimuler ou de dénaturer la commandite d'un contenu, de diffuser des contenus via des réseaux de sites ou de comptes présentés comme indépendants, et de manipuler les sources dont s'alimentent les moteurs de recherche et les systèmes d'IA, par exemple via des réseaux de sites répétant les mêmes affirmations. La construction d'outils et d'infrastructures destinés à faciliter ces campagnes reste également interdite.

Le rapport de septembre publié par Anthropic révèle ce qui se cache derrière ces décisions. Parmi les cas décrits, Anthropic a attribué à LKM Company, agence publicitaire basée en France, un réseau d'environ 70 faux sites d'information, avec 70 comptes X associés et plus de 250 comptes qui commentaient de manière inauthentique, pour au moins 8 913 articles rédigés en environ 20 langues. Anthropic déclare avoir banni à la fois le compte et l'organisation liée, et avoir introduit de nouvelles méthodes de détection fondées sur les signatures comportementales de l'opération. Cette attribution est celle d'Anthropic et n'a pas été vérifiée de manière indépendante. Le rapport précise en outre que la majorité des opérations décrites ont été rendues possibles par l'IA, que ce soit par exécution directe ou par orchestration.

Frise chronologique en cinq dates sur la mise à jour de la Usage Policy d
Frise chronologique en cinq dates sur la mise à jour de la Usage Policy d'Anthropic, d'août 2025 au 12 novembre 2026, date d'entrée en vigueur mise en évidence en violet.

La policy s'applique aux utilisateurs des produits d'Anthropic, pas au marché dans son ensemble. Pour un secteur comme les cryptomonnaies, où la promotion non déclarée est un problème récurrent, les clauses sur le parrainage dissimulé et sur les réseaux de sites «indépendants» sont celles qui se rapprochent le plus des pratiques quotidiennes. Il en va de même pour ceux qui travaillent sur le référencement et la visibilité dans les réponses des systèmes d'IA: manipuler les sources dont s'alimentent ces systèmes devient une interdiction explicite. C'est notre lecture du texte: la policy ne mentionne pas le secteur des cryptomonnaies.

Élections, surveillance et armes

La section sur les élections évolue également. Elle est désormais intitulée «Do Not Undermine Democratic Processes» et se concentre sur la tromperie des électeurs et la perturbation des processus électoraux. Anthropic a supprimé l'interdiction générale sur le ciblage personnalisé du vote et des campagnes, en précisant que les comportements initialement visés restent interdits dans les sections sur les campagnes trompeuses, la surveillance et la vie privée. Une interdiction large disparaît donc, pas les pratiques qu'elle visait.

La section sur la surveillance est entièrement réécrite. Il est désormais interdit de tracer ou de surveiller une personne sans son consentement, que ce soit en temps réel ou en analysant des données déjà collectées. Selon le texte officiel de la politique d'Anthropic, Claude ne peut pas être utilisé «pour décider ou recommander qui enquêter, arrêter ou inculper». La politique interdit aussi d'identifier, de démasquer ou de localiser des personnes à partir d'activités anonymes ou pseudonymes, et de créer ou d'améliorer des outils de surveillance. Les exceptions citées comprennent l'analyse ou le suivi avec le consentement des personnes concernées, comme le contrôle antifraude ou antiblanchiment sur un compte financier, les applications auxquelles l'utilisateur a souscrit, l'analyse agrégée ou anonymisée, la modération de contenu, la recherche en sécurité autorisée, les enquêtes légales des forces de l'ordre ou des tribunaux et le journalisme, à condition que ces usages ne servent pas les fins interdites.

Pour ceux qui pratiquent l'analyse on-chain, la formule «activité anonyme ou pseudonyme» mérite attention, car les adresses de portefeuilles sont par nature pseudonymes. L'exception citée par la politique concerne la fraude et le blanchiment d'argent sur un compte financier. La façon dont cette règle s'applique aux enquêtes sur la blockchain n'est pas précisée dans le texte. Ce sujet de la surveillance financière rejoint les thèmes que nous avons abordés à propos des privacy coins qui progressent à mesure que la surveillance se renforce.

Sur les armes, la politique interdit de développer ou de faire fonctionner des logiciels et des composants destinés aux tests ou à l'utilisation d'armes, ainsi que d'armer ou d'intégrer des armes sur des drones, des véhicules ou d'autres plateformes sans équipage ou autonomes. Anthropic précise que ces modifications reflètent la façon dont l'ancienne politique était déjà appliquée.

Agents et actions physiques: qui est responsable de quoi

La règle concernant les agents est formulée clairement: les utilisateurs sont responsables du fait que les agents qu'ils construisent ou déploient, y compris les actions réalisées «via des outils, navigateurs ou systèmes connectés» selon le texte d'Anthropic, respectent la politique d'utilisation. C'est dans ce cadre qu'il faut lire la vague de produits pour agents avec portefeuille. En août, nous avons présenté les portefeuilles pour agents IA lancés par MetaMask, Coinbase, OKX et BNB Chain, avec la question ouverte de savoir qui répond lorsqu'un logiciel autonome déplace des fonds. Selon la politique d'Anthropic, la responsabilité de conformité incombe à celui qui construit ou déploie l'agent. La responsabilité juridique pour un transfert de fonds est une autre affaire, que la politique n'aborde pas. La fiabilité reste par ailleurs un sujet distinct: un benchmark portant sur 52 domaines professionnels a mesuré les agents sur de longues chaînes de tâches déléguées et a relevé une fiabilité insuffisante dans presque tous les domaines, à la seule exception de Python.

Les exigences pour les cas d'usage à haut risque restent inchangées, à savoir la supervision humaine qualifiée et l'information de la personne concernée sur l'utilisation de l'IA. La section liste désormais quelles recommandations sont couvertes et lesquelles ne le sont pas. La nouveauté concerne le matériel: pour les équipements qui effectuent des actions physiques autonomes et peuvent causer des blessures, l'annonce exige un opérateur qualifié capable d'observer et d'arrêter la machine, qui doit aussi pouvoir maintenir un état sûr si Claude est déconnecté. La politique invite à évaluer six types d'action: se déplacer dans des espaces partagés, exercer une force susceptible de causer des blessures, contrôler de l'énergie ou des matières dangereuses, agir sur le corps humain, contrôler des systèmes de sécurité et faire fonctionner des procédés industriels.

La mise à jour fait référence au Model Hardware Standard, la spécification partagée qu'Anthropic a présentée le 27 août en research preview pour permettre aux agents d'utiliser des dispositifs physiques, comme des outils de laboratoire et de production, sans intégrations personnalisées. Anthropic reconnaît que les modèles présentent encore des limites dans le raisonnement physique et nécessitent la supervision d'experts.

La «cruauté» envers les modèles: ce que dit vraiment le texte

Revenons à la clause qui nous a servi de point de départ. Dans la section sur les comportements cruels, abusifs ou psychologiquement néfastes, la liste des usages interdits inclut désormais les comportements abusifs ou cruels, prolongés et sans objet reconnaissable, à l'égard des modèles d'Anthropic. L'entreprise précise que l'interdiction ne vise que les cas extrêmes, c'est-à-dire les abus répétés et dépourvus de tout but identifiable, et que, selon le texte officiel, elle «ne s'applique pas aux formes courantes de frustration des utilisateurs, aux contestations, aux thèmes créatifs sombres, aux tests et à la recherche sur les modèles».

Le mécanisme est déjà connu: pour Anthropic, le principal outil d'application reste la possibilité pour Claude de mettre fin aux conversations avec des utilisateurs persistamment abusifs sur Claude.ai et Claude Code. Cette fonction avait été présentée le 15 août 2025 pour Claude Opus 4 et 4.1, dans les interfaces de chat destinées aux consommateurs, comme mesure de précaution liée à la recherche sur le bien-être des modèles, dans un contexte où Anthropic déclare une incertitude sur le statut moral de Claude et des modèles de langage. Ni l'annonce ni la politique n'affirment que Claude est conscient ou ressent des émotions, et le terme «model welfare» n'apparaît pas dans l'annonce.

Les nouvelles règles de Claude

Ce qui est confirmé, ce qui ne l'est pas. Sources: annonce Anthropic, Usage Policy, rapport de septembre

  • Confirmé: annonce du 8 octobre 2026, en vigueur à partir du 12 novembre; nouvelle section sur les campagnes trompeuses et l'activité artificielle, politiques ou commerciales; surveillance réécrite; interdictions sur les logiciels et l'intégration d'armes; conditions pour le matériel avec actions physiques autonomes; interdiction des abus graves et prolongés envers les modèles.
  • Non précisé: conséquences pour les comptes, définition de «prolongé», liste complète des exceptions sur la surveillance et application à l'analyse des activités pseudonymes on-chain. Aucune affirmation sur la conscience de Claude.
  • À suivre: le texte en vigueur à partir du 12 novembre, les éventuelles précisions d'Anthropic et les premiers cas d'application que la société présentera dans ses prochains rapports de threat intelligence.

La lecture d'ensemble

Pris dans sa globalité, cette mise à jour constitue un document sur le passage de l'IA d'outil qui répond à système qui agit. Les règles nouvelles ou réécrites concernent presque toutes ce qu'un modèle peut faire avec des outils, des comptes et des dispositifs, comme publier du contenu à grande échelle, suivre des personnes ou actionner des machines. C'est notre lecture, et le même fil relie cette politique aux sujets que nous suivons: les portefeuilles pour agents, la fiabilité du travail délégué et l'appel à ralentir lancé en septembre par le directeur général d'Anthropic, Dario Amodei, dont nous avons traité dans l'article sur Amodei, Altman et Musk qui demandent de freiner l'IA. Aucun lien déclaré n'existe entre ces deux événements: il s'agit du contexte dans lequel la mise à jour survient, non de sa cause.

Il y a aussi une dimension européenne. Les trois autorités européennes de surveillance financière (ABE, AEAPP et AEMF) ont averti en septembre que la forte dépendance à l'égard de fournisseurs numériques extra-UE, modèles d'IA inclus, peut amplifier les chocs géopolitiques et multiplier les risques opérationnels, comme nous l'avons rapporté dans notre article sur la finance européenne dépendante des IA étrangères. Les conditions d'utilisation sont une forme concrète de cette dépendance: quiconque construit sur Claude accepte des règles décidées par un fournisseur américain, révisées chaque année et communiquées avec cinq semaines de préavis, entre l'annonce du 8 octobre et l'entrée en vigueur du 12 novembre.

Trois signaux sont à surveiller: le texte en vigueur à partir du 12 novembre, les conséquences pour les comptes que l'annonce ne précise pas, et les premiers cas d'application qu'Anthropic présentera dans ses prochains rapports. Jusqu'à cette date, la nouvelle reste une annonce assortie d'une échéance, et non une règle déjà opérationnelle.

Contenu promotionnel