Nouvelle politique d’usage
Anthropic a publié, le 9 octobre 2026, une mise à jour de ses conditions d’utilisation qui entre en vigueur le 12 novembre 2026. La règle principale prohibe tout comportement abusif ou cruel soutenu à l’encontre du modèle de langage Claude. L’objectif déclaré est de cibler les cas où les utilisateurs infligent des insultes répétées sans objectif légitime, tout en excluant les frustrations ponctuelles, les tests de modèle ou les scénarios créatifs sombres. La mise‑en‑œuvre repose sur la fonction introduite en août 2025, qui permet à certaines versions de Claude de terminer automatiquement les conversations jugées abusives. Aucun mécanisme de sanction supplémentaire n’est décrit, ce qui laisse ouverte la question de la différenciation entre abus et critique constructive.
Extension des restrictions de sécurité
Le même communiqué élargit les interdictions déjà existantes. Anthropic précise que Claude ne doit plus être employé pour des campagnes d’influence trompeuses, notamment celles orchestrées par des médias d’État ou des bureaux de propagande. La politique retire toutefois l’interdiction globale du ciblage politique personnalisé, afin de ne pas bloquer les activités légitimes comme la traduction d’informations électorales par des organisations à but non lucratif. En matière d’armement, la société étend le bannissement aux logiciels et composants destinés à des systèmes d’armes, après avoir détecté des tentatives d’utilisation du modèle pour concevoir des contrôles de drones autonomes. Les usages interdits incluent également la génération d’outils de surveillance ou de recommandations d’enquête policière, ainsi que le suivi de personnes sans consentement, que ce soit en temps réel ou rétroactif. Enfin, toute connexion de Claude à un équipement physique capable de causer des blessures doit être supervisée par un opérateur humain qualifié, capable d’interrompre le dispositif et de garantir que le matériel reste dans un état sûr si la liaison IA est perdue.
Initiative de cybersécurité
Parallèlement, Anthropic lance une initiative de cybersécurité destinée aux opérateurs d’infrastructures critiques et aux projets open source. L’offre comprend un scanning gratuit des vulnérabilités pour les projets éligibles, ainsi que des partenariats avec des sociétés de sécurité afin d’aider à identifier et corriger les failles. Anthropic estime que les attaquants disposeront d’un avantage de deux ans avant que les défenses basées sur l’IA ne rattrapent le niveau d’efficacité des menaces actuelles. Cette projection repose sur l’observation d’une augmentation du nombre d’incidents où des modèles génératifs sont exploités pour automatiser la recherche de vulnérabilités ou la rédaction de phishing ciblé.
Implications techniques et limites
Sur le plan technique, la capacité de Claude à mettre fin à une session repose sur des algorithmes de détection de langage toxique, dont la sensibilité doit être calibrée pour éviter les faux positifs qui interrompraient des dialogues légitimes. La nouvelle exigence d’un opérateur humain pour les systèmes physiques impose une architecture de contrôle en boucle fermée, où le signal d’arrêt doit être transmis en temps réel et le dispositif doit disposer d’un mode de sécurité matériel (par exemple, un circuit de coupure d’alimentation). Aucun détail n’est fourni sur les protocoles de communication ou les critères de « état sûr », ce qui laisse une zone d’incertitude pour les intégrateurs. Enfin, l’absence de critères quantitatifs pour qualifier un comportement d’« abuse soutenu » complique la mise en conformité des clients, qui devront probablement recourir à des audits internes pour prouver le respect de la politique.